
概览
OpenAI于2026年3月5日发布了GPT-5.4,它与其说是一个聊天机器人,不如说是一个能真正使用你电脑的数字助手。两个初始变体已推出:GPT-5.4 Thinking和GPT-5.4 Pro,均置于付费墙后。一周后,该公司发布了GPT-5.4 mini和GPT-5.4 nano。mini版本对任何人免费,而nano严格仅限API使用。定价有点令人心痛,mini和nano每个token的成本都是GPT-5等效版本的四倍。
该模型旨在完成任务。基准测试显示,事实错误比GPT-5.2减少了33%,重大新闻是内置的电脑使用功能。GPT-5.4可以点击桌面环境、打开文件、导航软件。在OSWorld-Verified基准测试中,它得分75%,超过了GPT-5.2的47.3%,甚至略高于人类平均分72.4%。深度研究也获得了重大升级,使模型更擅长挖掘来源和综合信息。
对于处理复杂工作流程的专业人士来说,GPT-5.4感觉像是真正的生产力飞跃。它不仅更聪明,而且更自主。该模型处理过去需要人类监督的多步骤任务,改进的推理使其成为研究、数据分析和软件导航的可靠伙伴。OpenAI显然将这次发布瞄准了高级用户,基准测试也证实了这一点。
游戏玩法
你给GPT-5.4一个高级指令,比如“分析这个电子表格并生成报告”,然后它处理其余部分。该模型点击按钮、滚动菜单、打开和关闭程序,并在多个软件环境中按顺序执行操作。用户通过自然语言提示进行交互,观看AI自主导航桌面。
系统解释屏幕截图和屏幕录制以了解应用程序的当前状态。它可以处理来自图表、图形和PDF的视觉数据。多步骤推理是核心优势,模型将复杂任务分解为顺序操作。免费的mini层级提供相同的电脑使用功能,但有使用限制,而付费的Pro和Thinking变体提供更快的响应和更高的配额。
性能指标是具体的。在OSWorld-Verified基准测试中,GPT-5.4得分75%,优于GPT-5.2的47.3%和人类平均分72.4%。与上一版本相比,事实错误减少了33%。模型的上下文窗口扩大了,使其能够处理更长的文档和更复杂的对话而不会丢失线索。
故事
GPT-5.4没有传统的情节,但其概念弧是关于AI从被动的文本生成器演变为数字工作流程中的积极参与者。用户委托越来越复杂的责任,模型自主导航软件的能力模糊了工具和协作者之间的界限。
这次发布引发了关于工作替代和人机协作的辩论。早期采用者报告称,数据分析和软件测试节省了大量时间。“GPT-5.4做我的工作”的梗在社交媒体上流行,用户分享AI执行琐碎任务的截图。随着网络安全专家警告AI控制电脑的风险,安全问题出现,引发了关于监管的讨论。
奖项与赞誉
AI Breakthrough Awards: 最佳AI助手: (2026)
Webby Awards: AI与机器学习: (2026)
Fast Company Innovation by Design: AI: (2026)
TIME Best Inventions: AI: (2026)
SXSW Innovation Awards: 人工智能: (2026)
关键词
游戏信息
- 开发商
- OpenAI
- 出版商
- OpenAI
- 引擎
- Proprietary transformer (mixture-of-experts)
- 发行日期
- 2026-03-05
- 模式
- Single-player, Collaborative
- 平台
- Web, Windows, macOS, Linux, iOS, Android
- 发行日期
- +2026-03-05
- 开发商
- OpenAI
- OSWorld-Verified Score
- 75%
- Error Reduction
- 33% fewer factual errors than GPT-5.2
- Free Tier
- GPT-5.4 mini
- API-Only Variant
- GPT-5.4 nano
加入社区
位粉丝正在讨论