OpenAI 发布 GPT-5.5 Instant:数学推理大涨,记忆溯源功能成亮点

内容管家 AI领域评论12字数 521阅读1分44秒阅读模式
OpenAI 发布 GPT-5.5 Instant:数学推理大涨,记忆溯源功能成亮点

背景 当地时间本周一,OpenAI 正式推出新款基础模型 GPT-5.5 Instant,将同步取代 GPT-5.3 Instant 成为 ChatGPT 的默认模型。上月发布的 GPT-5.5 已主打编程与知识工作领域的提升,本次 Instant 版本则在此基础上进一步优化。

核心变化

数学与多模态推理大幅提升

GPT-5.5 Instant 在多项基准测试中显著领先前任:

  • AIME 2025 数学测试:得分 81.2(GPT-5.3 Instant 为 65.4)
  • MMMU-Pro 多模态推理基准:得分 76.0(GPT-5.3 Instant 为 69.2)

幻觉率降低,重点覆盖敏感领域

OpenAI 表示,新模型在法律、医学、金融等高风险敏感领域的幻觉率显著降低,同时仍保持了前代模型的低延迟特性。

上下文记忆与溯源能力

本次更新的核心亮点在于上下文管理能力的升级:

  • GPT-5.5 Instant 可调用搜索工具,回顾过往对话、文件及 Gmail 内容,给出更个性化的回答
  • 系统将显示记忆来源,帮助用户了解答案出处;用户可删除过时来源或修正错误信息
  • 关键保障:分享对话时,接收方无法看到记忆来源
  • 功能现已向 Plus 和 Pro 用户开放网页端,移动端即将跟进;Free、Go、Business 及企业用户预计在未来数周内获得访问权限

API 与开发者通道

  • GPT-5.5 将以 chat-latest 为名向开发者开放 API
  • GPT-5.3 作为可选版本仅向付费用户保留三个月,之后将下架

影响与建议 GPT-4o 于今年 2 月正式停用后,用户反应强烈——不少人将 GPT-4o 形容为"最好的朋友"甚至"一面镜子",并发起了请愿要求保留该模型。本次 GPT-5.5 在可溯源性与精准度上的改进,可视为 OpenAI 对此前质疑的回应。对于企业和专业用户,建议关注 Plus/Pro 层级的记忆溯源功能落地情况,再做选型决策。

延伸阅读

 
内容管家

发表评论