当前位置：首页|资讯|OpenAI|ChatGPT

OpenAI 发布会：GPT-4o 有史以来最好的模型

作者：巴拉ba啦发布时间：2024-05-16

/ OpenAI 发布会：GPT-4o 有史以来最好的模型 /

中国时间凌晨 1 点，OpenAI 开了个会，带来了一堆新的东西：

ChatGPT 新 UI 新的 UI 设计

GPT-4o 文字，语音和视频，三个史诗级更新，足以颠覆很多行业

GPT-4o API 2 倍快，半价，5 倍访问限制（对比与 4-turbo）

桌面应用在 Mac 上提供了 ChatGPT 桌面应用。通过简单的键盘快捷键，可以立即向 ChatGPT 提问。还可以直接在应用程序中拍摄和讨论截图。

在发布会上，OpenAI 就发布了一款名为 GPT-4o 的新旗舰生成式人工智能模型，该模型将在未来几周内在公司的产品中“迭代”推出。它可以实时对音频、视觉和文本进行推理。

GPT-4o（“o”代表“omni”）是迈向更自然的人机交互的一步——它接受文本、音频和图像的任意组合作为输入，并生成文本、音频和图像的任意组合输出。它可以在短至 232 毫秒的时间内响应音频输入，平均为 320 毫秒，与人类的响应时间相似。在一次谈话中。它在英语文本和代码上的性能与 GPT-4 Turbo 的性能相匹配，在非英语文本上的性能显着提高，同时 API 的速度也更快，成本降低了 50%。与现有模型相比，GPT-4o 在视觉和音频理解方面尤其出色。

更重要的是从此以后，无论你是付费用户，还是免费用户，都能通过它体验 GPT-4 了。

接下来我们来看看发布会上对其能力的演示：

语音能力：语音能力中我认为最厉害的有几点：实时语音对话，在对话中你可以随时打断他，可以“听懂”用户的不同语气、语调，还能根据自己的回答生成不同语气的回复。

说真的，整个过程很自然很流畅，让我感觉就像是两个人面对面坐着交流。相比反应迟钝、没法打断还缺少情商的 Siri 等语音助手，ChatGPT 完胜！这才是 AI 语音助手！！

视频能力：GPT-4o 的到来，可以让我们和 AI 打视频电话，让它来解答各种问题，比如在线解数学题，相应极其自然。甚至还可以和你一起逗狗。

发布会上研发负责人 Barret 手写了一个方程，并打开摄像头拍给 ChatGPT，让它扮演「导师」的角色帮助自己解题，而且只能给提示，不能直接说答案。

接到任务的 ChatGPT，甚至开心大叫：「Oops，我好兴奋啊！」

桌面应用：

在发布会上演示了看代码，并进行简短描述。比如准确对应了函数名及其功能，并识别出了其中取平均值、最高值等操作的意图。

/ GPT-4o 强在哪呢？ /

改进推理 - GPT-4o 在 0-shot COT MMLU（常识问题）上创下了 88.7% 的新高分。此外，在传统的 5-shot no-CoT MMLU 上，GPT-4o 创下了 87.2%的新高分。

音频 ASR 性能 - GPT-4o 比 Whisper-v3 显着提高了所有语言的语音识别性能，特别是对于资源匮乏的语言。

音频翻译性能 - GPT-4o 在语音翻译方面树立了新的最先进水平，并且在 MLS 基准测试中优于 Whisper-v3。

视觉理解评估 - GPT-4o 在视觉感知基准上实现了最先进的性能。所有视觉评估都是 0-shot，其中 MMMU、MathVista 和 ChartQA 作为 0-shot CoT。

最最最重要的是，GPT-4o 不仅是目前全世界最好的模型，甚至可以在 ChatGPT 中免费用！！！

关注我，后续会给大家更多带来GPT的使用和最新资讯。

PS：因公众号平台更改了推送规则，如果不想错过内容，记得读完点一下“在看”，加个“星标”，这样每次新文章推送才会第一时间出现在你的订阅列表里。

点“在看”支持支持，谢谢啦

推荐体验

相关资讯

OpenAI 2024春季发布会:免费GPT-4o震撼登场 GPT-4o怎么用

引言 OpenAI在2024春季发布会上宣布了其最新旗舰模型GPT-4o，这是一个能够实时处理音频、视觉和文本的先进模型。那么如何使用GPT-4o? 后续有GPT-4o 使用说明. 目前免费用户对 GPT‑4o 只能有限的使用,想要体验完整的GPT‑4o还需要升级到Plus会员,详情请参考 ChatGPT Plus升级教程[1] 说明 GPT-4o（"o"代表"omni"，意为“全”）旨在实现更自然的人类-计算机交互，能够接受和生成文本、音频和图像的任意组合。 GPT-4o的升级亮点 1. 更强大的语言理

AI小路灯 2024-05-20

OpenAI 发布会：超大杯 GPT-4o，颠覆很多行业

OpenAI 发布会：超大杯 GPT-4o，颠覆很多行业

赛博禅心 2024-05-14

OpenAI 春季新品发布会：GPT-4o 和桌面 App 登场

2024年5月14日凌晨，OpenAI 在首次「春季新品发布会」上发布了新一代旗舰生成模型 GPT-4o、桌面应用程序，并展示了一系列新功能和能力。主要亮点免费优先：以后 OpenAI 做产品的原

11791 2024-05-14

奥特曼未亮相OpenAI发布会，网上狂吹GPT-4o是最优秀模型

奥特曼未亮相OpenAI发布会，网上狂吹GPT-4o是最优秀模型腾讯科技2024-05-14 02:04发布于北京腾讯新闻科技频道官方账号腾讯科技讯 5月14日消息，据国外媒体报道，OpenAI于

阿尔特曼 OpenAI 腾讯

腾讯科技 2024-05-14

OpenAI发布新模型GPT-4o

本报特约记者谢昭本报记者刘扬美国人工智能公司OpenAI于14日凌晨正式推出新一代人工智能（AI）模型GPT-4o，美国有线电视新闻网（CNN）注意到，它的最突出特点是在与人的交互方面更为自然。它可以在最快232毫秒的时间内响应音频输入，平均响应时间为320毫秒，几乎接近人类在交谈中的响应时间。

OpenAI 人工智能

环球时报新媒体 2024-05-15

近期资讯

鸿蒙 ArkUI实现地图找房

常用的地图找房功能，是在地图上添加区域、商圈、房源等一些自定义 marker，然后配上自己应用的一些筛选逻辑构成，在这里使用鸿蒙 ArkUI 简单实现下怎么添加区域/商圈、房源等 Marker.

儿歌八万首 2024-12-28

曝苹果、谷歌、三星表带暗藏高危致癌物威胁免疫系统健康

快科技12月29日消息，近日，《环境科学与技术快报》杂志发布了一项重要研究，揭示了流行智能手表表带中隐藏的健康风险。该研究特别关注了智能手表常用的氟橡胶表带材料。由于氟橡胶具有出色的

2024-12-29

手心输入法更新：自动下载360是三年前遗留

快科技12月29日消息，手心输入法在前不久时隔六年后发布了Windows端v3.1版更新，不过此次更新却引发了用户热议。根据用户反馈，新版本似乎会自动下载360弹窗过滤器，这一行为与手心输入法此前

2024-12-29

今晚开播：比亚迪王传福与科大讯飞刘庆峰同台科晚盛典

快科技12月29日消息，央视官方今日宣布，由总台社教节目中心精心筹备的首届《中国科技创新盛典》将于12月29日晚22:30在CCTV-1首播，并于12月30日晚20:30在CCTV-10重播。作为科技企业的杰出代表

2024-12-29

韩国载181人客机起火爆炸：179人遇难 2人生还

快科技12月29日消息，据央视最新报道，韩国全罗南道消防厅在务安机场，对济州航空7C2216航班乘客家属表示，事故客机上除2人幸存以外，其余人员全部遇难。此前消息称有3名获救人员，但其中1人已

2024-12-29

宁德时代回应减产磷酸铁锂电池：消息不实需求依旧旺盛

快科技12月29日消息，宁德时代近日对网上关于其计划减少磷酸铁锂产量的传言进行了辟谣，称这些传闻不属实。公司表示，目前新能源市场需求旺盛，宁德时代与供应商保持着良好的合作关系，共同推

2024-12-29

韩国载有181人客机失事起火：机型为波音737-800 机龄15年

快科技12月29日消息，综合央视等报道，当地时间今日上午9时7分左右，一架韩国济州航空飞机在全罗南道的务安国际机场降落过程中偏离跑道，撞上机场围墙后起火。视频发生事故的飞机是从泰国曼

2024-12-29

雷军挖了个95后天才少女“AI小萝莉”：开出千万年薪

快科技12月29日消息，小米在大模型赛场，频频按下快进键。先是，“雷军亲自重金挖人，开出千万年薪”的风传。据国内媒体报道，雷军开出千万年薪招揽了一位95后AI天才少女—&

2024-12-29

雷克萨斯行驶中起火烧成壳！女车主：起火后全车车标被扣走

快科技12月29日消息，日前，有雷克萨斯女车主发布视频维权称，自己的车辆质保期内行驶中起火，事故发生后全车车标被扣走，4S店对起火一事不管不问。女车主介绍，这辆混动雷克萨斯UX 260H是去年

2024-12-29

资深机长解读韩国737客机失事原因：机长竟然没放起落架！

快科技12月29日消息，29日上午9时7分许，由泰国曼谷起飞的济州航空7C2216号航班在位于全罗南道的务安机场降落时坠落，和机场围栏等发生碰撞后起火爆炸，机上有175名乘客和6名机组人员，共计181人

2024-12-29

推荐体验

AIGC重要产品

AI对话：类ChatGPT产品体验

好用的AI绘画工具

火热的AIGC产品

AIGC近期要闻

大公司发布的大模型产品都有哪些？

政府对AIGC的扶持政策

AIGC对就业的影响：我们会失业吗？

AIGC产业影响

AIGC对内容创作的影响

AIGC对绘画设计领域的影响

AIGC对各行各业的影响

意见反馈

Copyright © 2026 aigcdaily.cn 北京智识时代科技有限公司版权所有京ICP备2023006237号-1