GPT5.6重夺王位,却再遭严控!AI真的已经走到转折点

智车科技

4周前

OpenAI一口气放出三款模型,名字有讲究,Sol、Terra、Luna,拉丁语里就是太阳、地球、月亮。...讲到这,是不是已经热血沸腾了。...原文标题:GPT5.6重夺王位,却再遭严控。...AI真的已经走到转折点。

今天铺天盖地的新闻,OpenAI发布了新一代模型「GPT-5.6」。

半个多月前,老对手Anthropic刚放出两个天花板模型Mythos和Fable 5。

风头正盛的时候,OpenAI一记直拳就打了过来,打在了Anthropic最得意的地方。

OpenAI一口气放出三款模型,名字有讲究,Sol、Terra、Luna,拉丁语里就是太阳、地球、月亮。这是OpenAI头一回用天文学给模型起名。

太阳Sol是旗舰,最强那一档,专门啃最难的活儿,复杂推理、科研、写代码、网络安全、生物研究。

地球Terra主打均衡,能力跟上一代GPT-5.5差不多,但成本砍了一半,适合企业日常用。

月亮Luna最快也最便宜,专门接海量、高频的轻活儿。

命名规则也跟着变了。

数字管代际,5.6就是第几代;太阳地球月亮管能力层级,各自按自己的节奏往前走。

意思是以后出GPT-5.7、5.8,可能就是Sol升到Sol 2、Terra升到Terra 2,你不用每次都重新比一遍,记住常用哪档就行。

旗舰Sol还多了两个新挡位。

一个叫Max,给模型更长的思考时间,对付那种特别难的单个问题。

另一个叫Ultra,更狠,任务太复杂时,主模型会自己派生出好几个子智能体,分头并行干活,最后把结果汇总起来。

那它到底有多能打,拿成绩说话。

在一个叫Terminal-Bench 2.1的编程测试里,旗舰版Sol超过了对手Anthropic的Mythos预览模型,开启Ultra模式后还能再往上走一截。中间档Terra,表现跟Fable 5打平。连最便宜的Luna,都比Anthropic目前还在公开提供的旗舰强一点。

这就是开头说的,打在了对手最得意的地方。

你最强的,我用中间档就接住了。我最强的,再往上踩你一头。

在网络安全的一项测试里,Sol的表现跟对手的预览模型相当,但只用了三分之一的输出量。

同样的结论用更少的步骤得到,省的不只是钱,是推理效率的实打实提升。

如果说模型能力是一记直拳,那模型价格就是一个飞踹。

Sol每百万token输入5美元、输出30美元。同样的活儿,Fable 5要收10美元和50美元。

一半。

举个例子。假如一个团队现在每月在对手模型上烧5万美元做代码审查和自动化,换到能力相当的Sol,账单大概只要2万5。省下的不是零头,是一半的预算。

讲到这,是不是已经热血沸腾了。我得泼盆冷水,让你冷静一下。

因为GPT-5.6只开放给一小撮受信任的合作伙伴,首批大概二十来家机构。

真不是OpenAI自己想这么干,是应美国政府的要求。

剧情是这样的。

正式发布前,OpenAI先把计划和模型能力给美国政府过了一遍目。政府的意思是,先小范围给报备过的伙伴用,之后再慢慢放开。

最微妙的细节在后面。据报道,在这套机制下,有些客户想用,得政府一个一个批。奥特曼在内部备忘录里也提到,预览期间政府会逐个批准客户的访问申请。

一客一审。这放在软件分发的世界里,是相当反常的画面。

回想一下我们这些年用网络服务的习惯,注册、付费、立刻就用。哪怕再贵的企业软件,签了合同也就开通了。什么时候轮到过,一家公司能不能用某个工具,要排队等一张张许可。

为什么会这样?往大了说,AI模型第一次被当成战略物资来管了。

就在两周前,Anthropic的Fable 5上线才三天就火速下线,原因是收到出口管制指令,连他们自己的外籍员工都不许碰。现在轮到OpenAI,政府用的是类似逻辑。

OpenAI的态度很有意思。

它一边配合,一边在公告里放了段挺硬的话。

大意是这种政府介入的访问流程不该变成长期默认做法,因为它把真正需要顶尖工具的开发者、企业、网络安全防御者挡在了外面。

翻译一下,这次我先忍了,但别想着一直这么搞。

它还顺势提了个要求。

希望跟美国政府一起定一套清晰、可反复照着执行的流程,而不是让逐个审批成为行业以后的常态。这步很关键,模糊的权力最麻烦的不是严,是没准。

OpenAI想做的,是把说不清的裁量,变成写得明白的规则。它要的不是放松,是确定。

公告里还有一半篇幅在讲安全。

OpenAI给模型搭了一套层层设防的体系,训练时就教会它拒绝危险请求,生成过程里有实时分类器盯着网络和生物这些敏感领域,发现不对劲就当场暂停、交给更大的模型复核,确认违规就在送到你眼前之前拦掉,触发警报的账号还会被拉去做账户级审查。

发布前它做了超过70万GPU小时的自动化测试,外加大量外部红队演练,同时给自己定性,说还没到必须全面封死的最高危险等级。

这套话术半是技术说明,半是表演给所有人看的信任秀,它在告诉政府、也在告诉你我,这东西我管得住。

说到底,这才是这次发布最值得琢磨的地方。

Anthropic的Fable 5,上线三天就被叫停。OpenAI的GPT-5.6,干脆从一开始就只给二十来家报备过的伙伴,还得政府一客一审。

短短半个月,业内最强的两家公司,最强的几个模型,全都撞上了同一堵墙。这就不是偶然了。

一两家公司被管,是个案。两家头部、连着两次、用的还是同一套逻辑,那是趋势。

这套逻辑的核心,是美国政府开始把前沿模型,单拎出来当一类需要特殊看管的东西。它甚至给了个名头,受监管前沿模型,还在张罗一套配套的评估体系。

翻译过来就是,到了某个能力线以上的模型,发不发、怎么发,不再全是公司自己说了算。

为什么偏偏是现在。

因为这一代模型,第一次出现了让美国政府睡不着的能力。

会自己找软件漏洞,能在生物领域帮上忙,还能拉起一队子智能体连续干上几十步活儿。这些本事用在正地方是生产力,用歪了就是另一回事。

当一个技术同时具备造福和闯祸的两副面孔,监管的手伸过来,几乎是迟早的事。

所以你会看到一个挺拧巴的局面。

公司这边,玩命想把模型铺得越广越好,因为用户、开发者、企业才是它的命根子。

政府那边,想在全面放开前先摁一摁,把住国家安全这道闸。一个要快要广,一个要稳要控,两股劲拧在一起,就成了今天这个分阶段、限量、逐个批的局面。

OpenAI那段话,说穿了就是这种拧巴的外溢。它不敢不配合,又实在不甘心,只能一边照做一边喊,这事别成了常态。

往后看,有几条线也许会成为趋势。

第一条,分阶段发布会从特例变成惯例。

以后但凡够到那条能力线的重磅模型,先小范围、再逐步放开,很可能就是默认动作。今天觉得反常的事,过两年大家就见怪不怪了。

第二条,发布权会慢慢变成一种隐形的牌照。

能不能第一时间拿到最强模型,开始取决于你在不在那张报备名单上。这意味着先拿到权限的少数玩家,会凭空多出一段时间差的领先,而这段领先不是靠技术挣来的,是靠审批给的。

第三条,规则之争会比能力之争更要紧。

OpenAI主动要求把逐案审批变成可重复执行的流程,背后是想抢规则的制定权。谁能把模糊的行政裁量,谈成一套写明白的标准,谁就能在下一轮里少受制于人。

这场博弈的赢家,未必是模型最强的那个,而是最会跟监管打交道的那个。

如果你有任何看法,欢迎在评论区一起讨论

如果有一点收获,可以点赞、转发、推荐文章,关注「AI机器人茶馆

原文标题 : GPT5.6重夺王位,却再遭严控!AI真的已经走到转折点

OpenAI一口气放出三款模型,名字有讲究,Sol、Terra、Luna,拉丁语里就是太阳、地球、月亮。...讲到这,是不是已经热血沸腾了。...原文标题:GPT5.6重夺王位,却再遭严控。...AI真的已经走到转折点。

今天铺天盖地的新闻,OpenAI发布了新一代模型「GPT-5.6」。

半个多月前,老对手Anthropic刚放出两个天花板模型Mythos和Fable 5。

风头正盛的时候,OpenAI一记直拳就打了过来,打在了Anthropic最得意的地方。

OpenAI一口气放出三款模型,名字有讲究,Sol、Terra、Luna,拉丁语里就是太阳、地球、月亮。这是OpenAI头一回用天文学给模型起名。

太阳Sol是旗舰,最强那一档,专门啃最难的活儿,复杂推理、科研、写代码、网络安全、生物研究。

地球Terra主打均衡,能力跟上一代GPT-5.5差不多,但成本砍了一半,适合企业日常用。

月亮Luna最快也最便宜,专门接海量、高频的轻活儿。

命名规则也跟着变了。

数字管代际,5.6就是第几代;太阳地球月亮管能力层级,各自按自己的节奏往前走。

意思是以后出GPT-5.7、5.8,可能就是Sol升到Sol 2、Terra升到Terra 2,你不用每次都重新比一遍,记住常用哪档就行。

旗舰Sol还多了两个新挡位。

一个叫Max,给模型更长的思考时间,对付那种特别难的单个问题。

另一个叫Ultra,更狠,任务太复杂时,主模型会自己派生出好几个子智能体,分头并行干活,最后把结果汇总起来。

那它到底有多能打,拿成绩说话。

在一个叫Terminal-Bench 2.1的编程测试里,旗舰版Sol超过了对手Anthropic的Mythos预览模型,开启Ultra模式后还能再往上走一截。中间档Terra,表现跟Fable 5打平。连最便宜的Luna,都比Anthropic目前还在公开提供的旗舰强一点。

这就是开头说的,打在了对手最得意的地方。

你最强的,我用中间档就接住了。我最强的,再往上踩你一头。

在网络安全的一项测试里,Sol的表现跟对手的预览模型相当,但只用了三分之一的输出量。

同样的结论用更少的步骤得到,省的不只是钱,是推理效率的实打实提升。

如果说模型能力是一记直拳,那模型价格就是一个飞踹。

Sol每百万token输入5美元、输出30美元。同样的活儿,Fable 5要收10美元和50美元。

一半。

举个例子。假如一个团队现在每月在对手模型上烧5万美元做代码审查和自动化,换到能力相当的Sol,账单大概只要2万5。省下的不是零头,是一半的预算。

讲到这,是不是已经热血沸腾了。我得泼盆冷水,让你冷静一下。

因为GPT-5.6只开放给一小撮受信任的合作伙伴,首批大概二十来家机构。

真不是OpenAI自己想这么干,是应美国政府的要求。

剧情是这样的。

正式发布前,OpenAI先把计划和模型能力给美国政府过了一遍目。政府的意思是,先小范围给报备过的伙伴用,之后再慢慢放开。

最微妙的细节在后面。据报道,在这套机制下,有些客户想用,得政府一个一个批。奥特曼在内部备忘录里也提到,预览期间政府会逐个批准客户的访问申请。

一客一审。这放在软件分发的世界里,是相当反常的画面。

回想一下我们这些年用网络服务的习惯,注册、付费、立刻就用。哪怕再贵的企业软件,签了合同也就开通了。什么时候轮到过,一家公司能不能用某个工具,要排队等一张张许可。

为什么会这样?往大了说,AI模型第一次被当成战略物资来管了。

就在两周前,Anthropic的Fable 5上线才三天就火速下线,原因是收到出口管制指令,连他们自己的外籍员工都不许碰。现在轮到OpenAI,政府用的是类似逻辑。

OpenAI的态度很有意思。

它一边配合,一边在公告里放了段挺硬的话。

大意是这种政府介入的访问流程不该变成长期默认做法,因为它把真正需要顶尖工具的开发者、企业、网络安全防御者挡在了外面。

翻译一下,这次我先忍了,但别想着一直这么搞。

它还顺势提了个要求。

希望跟美国政府一起定一套清晰、可反复照着执行的流程,而不是让逐个审批成为行业以后的常态。这步很关键,模糊的权力最麻烦的不是严,是没准。

OpenAI想做的,是把说不清的裁量,变成写得明白的规则。它要的不是放松,是确定。

公告里还有一半篇幅在讲安全。

OpenAI给模型搭了一套层层设防的体系,训练时就教会它拒绝危险请求,生成过程里有实时分类器盯着网络和生物这些敏感领域,发现不对劲就当场暂停、交给更大的模型复核,确认违规就在送到你眼前之前拦掉,触发警报的账号还会被拉去做账户级审查。

发布前它做了超过70万GPU小时的自动化测试,外加大量外部红队演练,同时给自己定性,说还没到必须全面封死的最高危险等级。

这套话术半是技术说明,半是表演给所有人看的信任秀,它在告诉政府、也在告诉你我,这东西我管得住。

说到底,这才是这次发布最值得琢磨的地方。

Anthropic的Fable 5,上线三天就被叫停。OpenAI的GPT-5.6,干脆从一开始就只给二十来家报备过的伙伴,还得政府一客一审。

短短半个月,业内最强的两家公司,最强的几个模型,全都撞上了同一堵墙。这就不是偶然了。

一两家公司被管,是个案。两家头部、连着两次、用的还是同一套逻辑,那是趋势。

这套逻辑的核心,是美国政府开始把前沿模型,单拎出来当一类需要特殊看管的东西。它甚至给了个名头,受监管前沿模型,还在张罗一套配套的评估体系。

翻译过来就是,到了某个能力线以上的模型,发不发、怎么发,不再全是公司自己说了算。

为什么偏偏是现在。

因为这一代模型,第一次出现了让美国政府睡不着的能力。

会自己找软件漏洞,能在生物领域帮上忙,还能拉起一队子智能体连续干上几十步活儿。这些本事用在正地方是生产力,用歪了就是另一回事。

当一个技术同时具备造福和闯祸的两副面孔,监管的手伸过来,几乎是迟早的事。

所以你会看到一个挺拧巴的局面。

公司这边,玩命想把模型铺得越广越好,因为用户、开发者、企业才是它的命根子。

政府那边,想在全面放开前先摁一摁,把住国家安全这道闸。一个要快要广,一个要稳要控,两股劲拧在一起,就成了今天这个分阶段、限量、逐个批的局面。

OpenAI那段话,说穿了就是这种拧巴的外溢。它不敢不配合,又实在不甘心,只能一边照做一边喊,这事别成了常态。

往后看,有几条线也许会成为趋势。

第一条,分阶段发布会从特例变成惯例。

以后但凡够到那条能力线的重磅模型,先小范围、再逐步放开,很可能就是默认动作。今天觉得反常的事,过两年大家就见怪不怪了。

第二条,发布权会慢慢变成一种隐形的牌照。

能不能第一时间拿到最强模型,开始取决于你在不在那张报备名单上。这意味着先拿到权限的少数玩家,会凭空多出一段时间差的领先,而这段领先不是靠技术挣来的,是靠审批给的。

第三条,规则之争会比能力之争更要紧。

OpenAI主动要求把逐案审批变成可重复执行的流程,背后是想抢规则的制定权。谁能把模糊的行政裁量,谈成一套写明白的标准,谁就能在下一轮里少受制于人。

这场博弈的赢家,未必是模型最强的那个,而是最会跟监管打交道的那个。

如果你有任何看法,欢迎在评论区一起讨论

如果有一点收获,可以点赞、转发、推荐文章,关注「AI机器人茶馆

原文标题 : GPT5.6重夺王位,却再遭严控!AI真的已经走到转折点

展开
财经头条声明:所载内容仅为传递信息目的,非本站观点,亦非投资建议。据此操作,风险自负。 商务合作:app@feheadline.com
打开“财经头条”阅读更多精彩资讯
APP内打开