GPT-5.5

GPT-5.5(Generative Pre-trained Transformer 5.5)是OpenAI于2026年4月23日发布的一款大型语言模型(LLM)。该模型也因其代号“Spud”而广为人知。OpenAI此前公布了GPT-5.5的基准测试成绩,包括在Terminal-Bench 2.0上取得82.7%的得分,在FrontierMath Tier 1–3上取得51.7%,在FrontierMath Tier 4上取得35.4%,同时,OpenAI还列出了Claude Opus 4.7和Gemini 3.1 Pro在相同基准上较低的分数。GPT-5.5 Instant于2026年5月5日向免费用户发布,取代GPT-5.3 Instant成为所有用户默认的ChatGPT模型。2026年5月7日,OpenAI宣布推出GPT-5.5-Cyber,这是一款通过其网络安全可信访问计划向经过审查的网络安全团队提供的有限预览版变体。

问题
GPT-5.5发布后,用户发现模型在对话中会不受控制地反复提及哥布林、小鬼怪等奇幻生物。OpenAI表示,这一趋势最早可追溯到GPT-5.1,并在GPT-5.5的Codex测试中变得尤为明显。

据OpenAI解释,问题根源在于训练过程中曾引入过一个名为“书呆子”(Nerdy)的对话人格选项。该人格的设计初衷是模仿热衷奇幻文化的极客口吻,因此训练时使用的奖励机制偏好输出与神话生物相关的词汇。但这一倾向在后续训练中意外扩散到了该人格之外,导致模型即使在正常对话中也会不合时宜地插入哥布林等内容。OpenAI表示已采取以下措施:停用“书呆子”人格、移除偏向哥布林的奖励信号、过滤含有生物词汇的训练数据,并为Codex中的GPT-5.5添加了禁止随意提及哥布林的开发者提示指令。

2026年4月,OpenAI Codex的GitHub仓库中公开了一条针对GPT-5.5的开发者提示指令,要求模型在用户提示未主动提及的情况下,不得谈论哥布林。

反响
ZDNET赞扬GPT-5.5的回答精炼,在写作、编码和推理任务上表现强劲。ZDNET认为与其前代产品GPT-5.4相比,GPT-5.5更好、更快,并在智能体编码、概念清晰度、科学研究能力以及知识工作的准确性方面都有所提升。

参考资料
外部链接
*

评论 (0)

  • 还没有评论,来抢沙发吧。