scripod.com
GPT5横空出世AI超级智能首步,告别幻觉迎来新时代

Highlights

Transcript

Chapters

Pins

GPT5 横空出世 AI 超级智能首步,告别幻觉迎来新时代

敢想科技说

2025/08/08
敢想科技说

敢想科技说

2025/08/08
OverviewShownote
Unprocessed episode, you can be the first!
大家好,我是敢想老田。今天,咱们来聊聊科技界最近的一个大新闻 OpenAI 的 GPT5 正式发布了!这事儿可不得了,简直就像一颗炸弹在 AI 圈炸开了花。发布会是北京时间 8 月 8 日凌晨一点开的,那阵仗,堪比苹果的 WWDC,各路大咖轮番上阵,从 Sam Altman 到模型专家,个个眉飞色舞地吹嘘 GPT5 有多牛。说实话,我作为一个营销老手,看到这种场面都忍不住心潮澎湃。为啥这么激动?因为 GPT5 可不是小打小闹,它号称是 OpenAI 打造超级智能的第一步,能力全面屠榜,还大大减少了 AI 常犯的毛病,比如幻觉问题。接下来,我就带大家深入扒一扒这场发布会,看看 GPT5 到底牛在哪里,它如何从 GPT4o 那个中学生级别的 AI,一跃成为博士级别的专家。
先说说发布会的氛围吧。以往 OpenAI 的发布会都挺仓促,但这次不一样,搞了一个多小时,分了好几段主题。Sam Altman 一开场就放狠话,称 GPT5 是第一部配备视网膜显示屏的 iPhone 意思就是,它不再是那种问个问题就给你胡扯八道的家伙了。Altman 比喻得挺形象 GPT4o 像大学生,能聊但偶尔犯错 GPT5 却像博士专家,回答精准又专业。他还直接断言,GPT5 是世界上编码能力最强写作能力最强医疗健康领域最强的模型。这种自信,可不是空穴来风。发布会上展示的数据显示,GPT5 在文本 WebDev 和视觉感知领域都排第一,特别是在硬提示编码数学和创造力测试中,它轻松碾压了所有竞争对手。在代号峰会的测试中,GPT5 保持着最高的 Arena 分数,真叫字面意义的屠榜。OpenAI 的 ChatGPT 用户已近 7 亿,但他们之前在前沿模型上落后了点,现在 GPT5 一出,OpenAI 自信能重回王座。
最让我印象深刻的是 GPT5 如何解决了幻觉问题。幻觉,就是 AI 一本正经地胡说八道,这毛病一直是用户吐槽的重灾区。想想看,你问个问题,AI 给你编个答案,那不是坑人吗?OpenAI 这次下了血本,官方宣称 GPT5 的幻觉概率大幅降低。联网搜索时,它出错的风险比 GPT4o 低了 45 独立思考时,错误率比老模型低了 80。更棒的是,GPT5 变老实了,不再吹牛自己能干办不到的事。遇到不明确的任务,它会直接坦白说做不到。这背后是 OpenAI 做了超过 5000 小时的安全测试,模型安全研究负责人 Alex Beutel 说,GPT5 通过安全补全机制处理敏感问题,比如有人问如何点燃某种材料,它不会直接教你怎么做,而是给出宏观安全信息。这种改进,让 AI 更可靠,我敢说,这会让普通用户更信任 AI。发布会上还展示了 GPT5 的 ARCAGI2 测试结果,它在除 Grok 4 之外的所有模型中表现最优。这可不是小进步,是质的飞跃。
除了可靠性,GPT5 还加了个趣味功能四种人格模式。用户可以选择让 AI 以不同风格互动,比如犬儒模式爱抬杠机器人模式理性冷静倾听者模式像朋友聊天学霸模式专业严谨。ChatGPT 负责人 Nick Turley 说,这个模型给人的感觉特别好,普通用户会明显感受到变化。想象一下,你想学外语,切换学霸模式想吐槽生活,用犬儒模式这不就让人机互动更有温度了吗?发布会现场还演示了主题切换,代码编辑器爱好者肯定乐疯了,因为你可以为聊天窗口定制颜色主题。这些细节,让 GPT5 不只聪明,还更人性化。我个人觉得,这是 AI 从工具向伙伴演化的关键一步。
说到编码能力,Sam Altman 预言 GPT5 将开启软件按需生成的时代。在测试中,GPT5 在 SWEBench 和 Aider Polyglot 等基准上碾压对手,人类测试成绩达 42,SWE 基准高达 75。发布会上,后期训练负责人 Yann Dubois 现场演示,让 GPT5 生成一个带互动游戏的法语学习网站。几秒钟内,它就吐出几百行代码,网站界面完美运行。他还展示了一段提示词创作的 3D 游戏,物理效果逼真得惊人。不过,这里有个小插曲发布会 PPT 被网友吐槽坐标轴有错误,比如 528 大于 691,被嘲 PPT 可能是 GPT5 自己做的。哈哈,这说明 AI 再强,也得靠人监督啊!但整体看,GPT5 的编码能力确实逆天,Altman 说它会改变软件开发方式,未来可能就是一句话生成一个 APP 的时代了。
安全方面,GPT5 的进步让我安心。模型安全研究负责人 Alex Beutel 强调,他们重点解决了 AI 撒谎问题。过去,模型常声称完成了任务但实际没做,现在 GPT5 能可靠处理多步骤任务。安全补全机制处理恶意问题很聪明,比如问危险材料信息时,它只提供无害宏观数据。这不只是技术升级,是伦理的胜利。OpenAI 还测试了 5000 多小时,确保模型更诚实。想想看,医疗健康领域,GPT5 回答问题更准确,这能救命的!发布会上,健康相关演示显示 GPT5 误诊率大降,这得益于它理解和遵循指令的能力提升,还减少了拍马屁倾向。对咱营销人来说,这意味着 AI 输出更可信,能用在广告文案等场景,不用担心瞎编乱造。
那么,怎么才能用上 GPT5 呢?好消息是,所有 ChatGPT 用户免费了!这是 OpenAI 头一回免费开放前沿模型。Plus 用户有更多使用次数,Pro 用户能用更强推理能力的 Pro 版。用超量后,会自动切到 mini 版处理请求。GPT5 上线就取代了 GPT4o 等旧模型。API 里还加了新参数 Minimal,方便调整推理力度。定价上,标准版每百万输入 Token 125 美元,输出 10 美元 mini 和 nano 版便宜些。微软 CEO 纳德拉也宣布 GPT5 已整合进 Microsoft 365 CopilotGitHub Copilot 等产品,在 Azure 上训练。这扩展性太强了,开发者和小白都能轻松上手。我觉得,免费开放是 OpenAI 的聪明之举,能快速普及,推动生态。
最后,聊聊超级智能话题。Sam Altman 说 GPT5 是向 AGI 通用人工智能迈出的关键一步,但他讨厌 AGI 这词,因为定义模糊。他称 GPT5 是超级智能的种子,因为它能从新事物中生长进化,不像普通模型。Altman 承认 GPT5 还缺点东西,没达到真正 AGI,但这一步已很了不起。行业正在转向构建超级智能,OpenAI 这波操作可能重塑 AI 格局。我个人看法?GPT5 的发布不只是技术胜利,是文化变革。它减少幻觉提升诚实度,让 AI 更接近人类伙伴编码能力开启生成式软件时代免费策略加速创新。未来,AI 会无处不在,GPT5 就像 iPhone 初代,开启了新纪元。作为敢想老田,我建议大家试试它用它写文章学语言甚至创业,绝对颠覆想象。今天的分享就到这儿,下期再聊其他科技热点!

前往小宇宙评论区与主播互动