首页 今日快讯文章正文

OpenAI给10亿人免费换上GPT-5.6,但真正的杀手锏是下周的Astra

今日快讯 2026年08月08日 22:50 2 aa

今天早上,OpenAI扔了个重磅消息出来——GPT-5.6 Luna的文本对话,不限量了。

全球十亿人,直接免费用。你没听错,是十亿人,不是十万,不是百万。ChatGPT的周活跃用户刚刚突破了这个数字,而OpenAI转头就把最新的模型免费开放给了所有人。

要知道,GPT-5.6系列是7月9号才发布的,距离今天满打满算还不到一个月。这么快就把主力模型白送给全球用户,放在任何一家科技公司身上都有点疯狂。

不过得说清楚一件事——免费的是Luna,GPT-5.6家族里最小的那个。上面还有Terra和Sol,一个比一个大。Luna主打的是快和便宜,从今天起它成了Free和Go用户的默认模型,直接替换掉了GPT-5.5。

免费用户还多了一个新东西——"Think"按钮。遇到难题按一下,让模型多想一会儿再回答。这是免费档第一次能主动调用更高的推理能力。

当然,免费也不是什么都不要钱。不限的只有文本对话。文件上传、图片生成、语音这些,额度照旧,该限制还是限制。

Sol也升级了,话变少了

免费用户有福利,付费用户也没落下。

GPT-5.6 Sol迎来了一次大升级。以前在ChatGPT里,Instant快答和Thinking慢想简直像两个不同的人格——语气不一样,格式不一样,切过去像换了个模型。现在统一由Sol接管,唯一的区别就是思考时间长短,再也没有那种割裂感了。

之前只有ChatGPT Work专属的"五档思考滑块",这次直接下放到了普通聊天界面。人人都能自由调节AI的思考深度。

新版Sol最直观的变化是话变少了。官方博客里举了个例子——"下班从Mission骑车到海边会不会被淋湿"。旧版Instant拉了一长串:降雨、风速、气温、海雾、海滩危险警示,末了还加一句"你穿棉T恤可能会觉得黏"。新版Sol第一句就给了结论:不会淋湿,真正的麻烦是逆风,带件轻薄防风外套就行。追问"我五点半出发",旧版又把整份预报重播了一遍,新版只更新了结论。

把"详尽"换成"抓重点",这就是新版Sol的全部气质。

更重要的是事实准确率。OpenAI专门挑了金融、医疗、法律这三个最容不得胡说八道的领域做内部评测——只要一条回答里出现一处事实错误,整条就算错。结果Sol比GPT-5.5 Instant的错误率少了68%,Luna也少了62%。

免费不是发善心,是被逼的

OpenAI这波操作,乍一看是在发福利,但稍微了解点行情的人都知道——这是被逼的。

一周前,OpenAI刚把GPT-5.6 Luna的价格砍了80%,输出价格从每百万Token六美元直接砍到一块二。降价当天,DeepSeek V4 Flash正式版API上线了。

效果怎么样?根据第三方模型聚合平台OpenRouter的数据,本周DeepSeek V4 Flash的调用量是GPT-5.6 Luna的近三倍。三倍。降价降了个寂寞。

开发者用脚投票的逻辑很简单——华泰证券的研报显示,DeepSeek V4 Flash混合价格约0.06美元/百万Token,比GPT-5.6 Luna低了65%。性能差不多的情况下,成本差这么多,换谁都知道怎么选。

降价不行,那就免费。Luna做普惠入口换用户和数据,Sol守住付费底盘。这套组合拳本质上就是互联网时代的免费流量策略,只不过被OpenAI用在了AI模型上。

这恰恰说明国产开源模型已经对硅谷巨头的定价权构成了实质性威胁。

但真正的重头戏是Astra

免费Luna也好,升级Sol也罢,都只是开胃菜。

真正的杀手锏是下周的Astra。

今天圈内知名爆料人已经放出了独家消息:OpenAI准备下周推出下一代主力模型Astra。这是一次全新的预训练,自GPT-4.5以来OpenAI训练过的最大模型。最新的内部检查点代号"mewfour",已经是Release Candidate——发布前的最后一版。

其实这事早就藏不住了。7月30号,OpenAI一段预览视频被火速删除,有网友手快截了图,画面里闪过一个词——"mewthree"。这周又有爆料跟进:mewfour已经在内部测试了。从mew、mewtwo一路数下来,OpenAI家的"超梦"已经悄悄进化到第四形态了。

更有意思的是,官方其实早就把消息摆在明面上了。8月1号,OpenAI发了一篇数学博客,说自家模型解决了10个悬置十年以上的开放数学问题。谁也没想到,下一代模型的官宣就藏在这篇博客里。OpenAI发布了249页的论文、62页的推理说明和一套Lean 4形式化证明文件,全部上传到了GitHub开源。所有证明证书可以被机器自动校验,不存在未经论证的逻辑断点。

按Sol API费率计算,完成全部十项难题推理对应的Token总成本大约2000美元。

十项突破覆盖了高维几何、编码理论、群论、算术电路复杂性、量子复杂性、格密码、极值组合学等领域。每个问题的主要结果至少十年没有进展。

Astra跟GPT-5.6不是一回事

Astra跟GPT-5.6走的是完全不同的路子。

GPT-5.6系列解决的是"单次推理更强"的问题——更强的编码能力、更长的上下文、更低的幻觉率。它们是沿着Scaling Law的既有轨道继续往前推。

但Astra不一样。它的核心能力在于突破"单次交互、短期任务"的固有框架。Astra可以把复杂总任务自动拆分,多个智能体分工并行推演,持续互相质询、交叉验证,在长期推理链路中维持目标一致性。

说白了,过去你用ChatGPT是"问一句答一句",遇到复杂的长线任务,模型很容易中途断片、遗忘上下文、或者陷入死循环。Astra的定位完全不同——它专为"长时间运行任务"设计。

有知情人士透露,OpenAI在华盛顿的闭门演示中重点展示了这个能力:让多个AI智能体在几个小时甚至几天的时间里持续协同工作,分工明确,互相修正,直到把最终成果交到你手上。这相当于你拥有了一个全自动的虚拟公司团队。

据开发者测算,Astra的参数规模可能在7到10万亿之间,大约是GPT-5.6 Sol的两倍。依托年内新增的算力和优化的基础设施,服务成本有望低于Anthropic的Mythos 5。

Astra这个词在拉丁语里意思是"群星"。OpenAI已经有了Sol(太阳)、Terra(地球)、Luna(月亮),现在来了个"群星"。命名逻辑一脉相承,但格局明显升了一级。

突然刹车

但事情在最后一刻起了变化。

就在大家以为Astra下周就要正式亮相的时候,OpenAI紧急踩了刹车。

当地时间8月7号,OpenAI表示,内部与专家评估显示,Astra在智能体编程和网络安全领域取得了重大突破。根据公司的《准备框架》,Astra已经成为OpenAI旗下首个在网络安全领域达到"关键"风险级别的模型。

什么标准算"关键"?两条:一是在无需人类干预的情况下,能在多个经过安全加固的真实关键系统中识别并开发出有效的零日漏洞利用程序;二是仅需提供高层级战略目标,就能自主构想并实施全新的端到端网络攻击。

换句话说,Astra可能具备自主发现和利用系统漏洞的能力——而且不需要人帮忙。

OpenAI宣布暂停所有尚未满足强化安全标准的Astra相关内部活动,设置了隔离测试环境,限制了网络与工具访问权限,强化了模型权重保护与加密。对Astra的所有智能体应用实施了全局监控,通过评估思维链来审查和拦截高风险操作。

OpenAI还特别强调了一件事:Astra是一款尚未发布的模型,没有参与此前针对Hugging Face的网络攻击事件。

CEO奥特曼随后发话:Astra是一款性能强劲的模型,正在全力推进它的公开发布。但他也说,鉴于模型在网络安全方面的强大能力,还需要一点时间来确保万无一失。

"希望大家不用等太久。"

OpenAI给10亿人免费换上GPT-5.6,但真正的杀手锏是下周的Astra


2026年,OpenAI不轻松

这一连串动作背后,是OpenAI在2026年面临的压力。

自年初以来,OpenAI接连完成了组织架构重组、调整了微软合作协议、大幅调整了模型定价、关停了非核心业务、发力企业智能体、启动了IPO筹备。原定最快今年秋季的IPO,目前已经倾向于推迟到2027年。主因是去年净亏损高达385亿美元。

模型层的技术优势在被追赶,API的定价权在被侵蚀,企业市场在被蚕食,IPO的时间窗口在收窄。

谷歌持续依托Gemini推进多模态自主交互能力,Anthropic持续优化Claude的长上下文和长周期任务执行稳定性,深度绑定代码开发赛道。全球开源模型不断缩小能力差距,依靠极低定价抢夺中小开发者。

单纯依靠更强的单次问答能力,已经很难持续拉开代差了。

下一代竞争的胜负手,在于自主执行复杂工作流的能力——也就是行业反复讨论的Agent时代。攻克前沿数学猜想,是对长周期智能能力最严苛的试炼。而Astra,就是OpenAI给出的答案。

免费Luna是送给十亿用户的见面礼。但真正的杀手锏,是那个因为太强而被暂时按住不发的Astra。

下周能不能看到它正式亮相,还是个未知数。但有一件事已经板上钉钉了——AI行业的下一个时代,正在敲门。

发表评论

长征号 Copyright © 2013-2024 长征号. All Rights Reserved.  sitemap