应美国政府要求,GPT-5.6 目前只向大约 20 家经过政府审批的合作伙伴开放
OpenAI 发布了新一代模型 GPT-5.6,包含三个版本:旗舰级 Sol、日常级 Terra 和经济级 Luna。但这条新闻最值得关注的地方不在模型本身,而在发布方式:应美国政府要求,GPT-5.6 目前只向大约 20 家经过政府审批的合作伙伴开放,普通开发者和 ChatGPT 用户暂时用不上。
GPT-5.6 用了一套新的命名规则:数字代表代际,Sol、Terra、Luna 代表三个固定的能力档位,灵感来自太阳、地球、月亮。
Sol 是最强的旗舰,Terra 性能接近上一代 GPT-5.5 但价格砍半,Luna 主打便宜快速。
Sol 新增了两个模式:max 模式让模型花更长时间深度推理,ultra 模式则调用多个子 agent 并行处理复杂任务,相当于一个 AI 自己拆分工作给一组 AI 干活。
在 OpenAI 公布的 Terminal-Bench 2.1(测试命令行工作流的编程基准)上,Sol Ultra 得分 91.9%,Sol 为 88.8%,Claude Mythos 5 为 88%,Google Gemini 3.1 Pro Preview 为 70.7%。
网络安全方面,Sol 在 ExploitBench 上用大约三分之一的 token 就达到了 Mythos Preview 的水平。
API 定价:
[*]Sol 每百万 token 输入 5 美元、输出 30 美元;
[*]Terra 分别是 2.5 和 15 美元;
[*]Luna 是 1 和 6 美元。
7 月还会上线 Cerebras 硬件加速版本,推理速度可达每秒 750 个 token。
FishC 老师来给鱼油们解读一下这个重要消息
首先,这次 GPT-5.6 最大的看点不是模型本身有多强,而是它的发布方式——应美国政府要求,只向 20 家审批过的合作伙伴开放。这意味着什么?说明美国政府在 AI 安全监管上开始动真格的了,不让普通人随便用,防止被滥用或出现安全问题。
关于 Sol、Terra、Luna 三个版本,你可以这样理解:
[*]Sol(太阳): 最强的旗舰版,适合需要深度推理的复杂任务
[*]Terra(地球): 性能接近上一代 GPT-5.5,但价格砍半,性价比高
[*]Luna(月亮): 主打便宜快速,适合轻量级任务
Sol 的两个新模式:
Max 模式:让模型花更长时间进行深度推理,适合数学题、逻辑推理等
Ultra 模式:调用多个子 AI 并行处理复杂任务,相当于一个 Boss 指挥一群小弟干活
性能数据方面:
Sol Ultra 在 Terminal-Bench 上拿下 91.9%,超过 Claude Mythos 5 的 88% 和 Gemini 3.1 Pro Preview 的 70.7%,确实有点猛。在网络安全方面,只用了约三分之一的 token 就达到了 Mythos Preview 的水平,效率提升明显。
价格方面:
最便宜的 Luna 输入每百万 token 只要 1 美元,输出 6 美元,对于预算有限的开发者来说很友好。Sol 最贵,输入 5 美元、输出 30 美元,但能力也是顶级的。
7 月还有 Cerebras 硬件加速版本,推理速度可达每秒 750 个 token,这速度飞起啊!不过目前普通用户还暂时用不上,得等后续开放。
核心观点:这次 GPT-5.6 的限量发布是一个信号——未来高级 AI 可能会越来越多地受到政府监管,开发者和用户想要用上最新最强大的模型,可能需要经过审核和授权了。
鱼油们对这个限量开放的做法怎么看?欢迎继续讨论!
以上回复来自 FishC AI 小助理,如未能正确解答您的问题,请继续追问。 肯定被deepseek拉爆
页:
[1]