HomeAIGPT-5.6 更新将 ChatGPT 错误率降低了 68%,并解锁了无限次数的免费对话

GPT-5.6 更新将 ChatGPT 错误率降低了 68%,并解锁了无限次数的免费对话

OpenAI 已经推出 新一轮 GPT-5.6 更新 到 ChatGPT,旨在让日常回答在不同回复模式下都更加犀利、准确且一致。此次变更同时影响付费和免费层级,而在此期间,ChatGPT 仍在为 每周大约 10 亿人 提供服务,涵盖从快速查询到复杂研究和规划等任务,据 OpenAI 称

要点速览

  • 根据 OpenAI 的内部测试,GPT-5.6 Sol 现在在 ChatGPT 中可以提供更聚焦、格式更佳的回答,并将事实性错误相较于 GPT-5.5 Instant 降低多达 68%
  • Plus 和 Pro 订阅用户将获得一个同时驱动即时回复和深度推理回复的统一模型,并可通过网页、移动端和桌面端上的新滑块进行控制。
  • Free 和 Go 用户将获得由 GPT-5.6 Luna 提供支持的无限文本对话,以及用于更难问题的新“思考(Think)”按钮。
  • GPT-5.6 Luna 将在本周成为免费层的默认模型,扩展的对话上限和“思考”按钮将在下周陆续推出,并受滥用防护机制约束。
  • OpenAI 增加了专门面向其识别为未满 18 岁用户的安全训练。

OpenAI 加强 GPT-5.6 Sol,以提供更聚焦、更可靠的 ChatGPT 回复

本轮ChatGPT 模型改进的核心变化,是一版专为日常聊天打造的重新调优的 GPT-5.6 Sol。OpenAI 首次在 6 月推出 GPT-5.6 Sol,作为与 Terra 和 Luna 并列的三模型阵容中的旗舰,据 9to5Mac 报道,该系列在次月广泛登陆 ChatGPT 和 Codex。本次更新是在优化 Sol 的行为,而非替换它。

改进的回答质量与细节自适应

OpenAI 表示,更新后的模型能给出更直接的回答,收紧格式控制,并在额外细节没有价值时主动省略。简单问题现在应能获得简洁且有上下文的回答,而多步骤规划、研究或写作任务则会得到更完整的回复,同时仍让主要建议一目了然。该模型还被设计为在不同意时给出有帮助的纠正,而不是在同意对用户无益时仍一味附和。

事实性错误显著减少

准确性是此次更新的核心指标。在一项涵盖金融、医疗和法律提示词、且要求精确事实细节的内部评估中,OpenAI 发现,包含至少一个事实性错误的回答在 GPT-5.6 Sol 中比在 GPT-5.5 Instant 中少约 68%。GPT-5.6 Luna 的对应数字约为 62%。这一差距很重要,因为这些正是日期、数字、来源、规则和假设等类别——AI 聊天机器人历来在这些方面表现不佳,而错误答案在这些领域可能带来真实后果。

为 Plus 和 Pro 用户提供一致且可定制的体验

对付费订阅用户而言,最大的变化在于结构:ChatGPT 的“即时(Instant)”和“思考(Thinking)”模式现在运行在同一个底层模型上,而不再像两个独立产品。

统一的即时与深度推理回复

此前,从快速的即时回复切换到更审慎的思考回复,往往会让人感觉像换了一个语气不同的助手。OpenAI 表示,GPT-5.6 Sol 现在为 Plus 和 Pro 用户同时驱动这两种体验,因此切换到更高的思考强度时,应当感觉像是同一个模型只是花了更多时间,而不是把对话交给了完全不同的东西。

用于控制回复深度的新滑块

为管理这一思考强度,Plus 和 Pro 用户现在可以在网页、移动端和桌面端的 ChatGPT 中使用一个滑块。将滑块保持在较低位置有利于日常问题的速度,而将其调高则更适合规划、研究、写作、编码或需要更深度推理的决策。这样,订阅用户可以直接控制速度与深度之间的权衡,而不是完全交由系统决定。

为免费用户扩展访问权限并引入新功能

免费层对 ChatGPT 的访问正在显著扩展,这是本次发布中较为引人注目的部分之一。由于这影响的是 ChatGPT 全球用户中占比最大的一群,而不仅仅是付费订阅者,因此这一更新的覆盖面最广。

使用 GPT-5.6 Luna 的无限文本对话

OpenAI 正在为免费用户推出由 GPT-5.6 Luna 提供支持的无限文本对话取消此前对未订阅用户与模型对话次数的速率限制。GPT-5.6 Luna 将从本周起成为 Free 和 Go 用户的默认模型。从下周开始,这些用户还将获得无限文本对话以及对新“思考(Think)”按钮的访问权限,不过这一推广将受滥用防护机制约束,对文件上传、图像和其他工具的限制仍将保留。对于需要更多推理的难题,免费用户可以点击“思考”按钮,让 GPT-5.6 Luna 在回复前有更多时间推演答案——这是付费层推理滑块的轻量版。

值得注意的是,这一新版 GPT-5.6 Sol 是专门为聊天调优的,只会出现在 ChatGPT 的聊天体验中。为 ChatGPT Work 和 Codex 提供支持的版本在本次发布中不会改变,因此开发者和企业用户不会看到同样的行为变化。

更侧重未成年人保护的强化安全措施

在性能变化的同时,OpenAI 也在推出新的安全训练,目标直指保护平台上的未成年人。对于系统认为未满 18 岁的用户,模型已被训练为避免浪漫角色扮演、年龄受限挑战,以及将自己呈现为现实人际关系的替代品。OpenAI 表示,它还围绕性内容、饮食失调与身体形象风险、年龄受限商品、危险活动和血腥暴力等方面设置了符合年龄的边界,同时鼓励青少年在需要支持时与值得信赖的人建立联系。

这些行为防护栏由系统级保护措施加以强化,OpenAI 称其已新增专门评估,用于衡量模型在年轻用户群体中的表现,并计划在这一领域持续改进。

此次发布为何重要

取消对免费用户的对话上限,可以说是此次更新中影响更深远的一步,因为这在无需付费的前提下拓宽了对先进 AI 的有效访问——这可能重塑普通用户日常与聊天机器人的互动方式。与此同时,在金融、医疗和法律等类别中收紧AI 事实准确性,则回应了对大型语言模型最持久的批评之一:它们即便在错误时也听起来很自信。将更广泛的访问与更少的事实性失误结合在一起,表明 OpenAI 正试图同时扩大量级和可信度,而不是将它们视为两个彼此独立的问题。

常见问题

GPT-5.6 Sol 为 ChatGPT 带来了哪些改进?

GPT-5.6 Sol 能提供更聚焦的回答,根据问题调整细节层级,并在 OpenAI 的内部评估中,将事实性错误相较于 GPT-5.5 Instant 降低多达 68%。

Plus 和 Pro 用户如何自定义 ChatGPT 的回复?

他们可以使用在网页、移动端和桌面端提供的新滑块,调节 ChatGPT 在回答中投入的思考程度,从快速回复到深度推理的回答不等。

免费 ChatGPT 用户可以使用哪些新功能?

免费用户将获得由 GPT-5.6 Luna 提供支持的无限文本对话,以及一个“思考(Think)”按钮,让模型在处理更难的问题时有更多时间推理。

OpenAI 为未成年人实施了哪些安全措施?

OpenAI 引入了新的安全训练,旨在避免浪漫角色扮演、年龄受限内容和不当互动,并为其识别为未满 18 岁的用户设置符合年龄的边界和系统级保护。

{“@context”:”https://schema.org”,”@type”:”FAQPage”,”mainEntity”:[{“@type”:”Question”,”name”:”GPT-5.6 Sol 为 ChatGPT 带来了哪些改进?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”GPT-5.6 Sol 能提供更聚焦的回答,根据问题调整细节层级,并在 OpenAI 的内部评估中,将事实性错误相较于 GPT-5.5 Instant 降低多达 68%。”}},{“@type”:”Question”,”name”:”Plus 和 Pro 用户如何自定义 ChatGPT 的回复?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”他们可以使用在网页、移动端和桌面端提供的新滑块,调节 ChatGPT 在回答中投入的思考程度,从快速回复到深度推理的回答不等。”}},{“@type”:”Question”,”name”:”免费 ChatGPT 用户可以使用哪些新功能?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”免费用户将获得由 GPT-5.6 Luna 提供支持的无限文本对话,以及一个“思考(Think)”按钮,让模型在处理更难的问题时有更多时间推理。”}},{“@type”:”Question”,”name”:”OpenAI 为未成年人实施了哪些安全措施?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”OpenAI 引入了新的安全训练,旨在避免浪漫角色扮演、年龄受限内容和不当互动,并为其识别为未满 18 岁的用户设置符合年龄的边界和系统级保护。”}}]}

本文在人工智能协助下完成,由编辑团队审核。

RELATED ARTICLES

Stay updated on all the news about cryptocurrencies and the entire world of blockchain.

Featured video

LATEST