GPT-6 Astra刷屏 梁文锋专注LLM路线获认可
「OpenAI发布GPT-6 Astra后热度持续走高,Anthropic的Fable 5.1则反响平平。日本教授今井翔太指出,DeepSeek创始人梁文锋此前“专注大语言模型才是AGI主线”的内部表态,在Astra的全能表现下愈发具有说服力。OpenAI战略调整见效,国产大模型期待下一代发力。」
近日,Anthropic与OpenAI分别发布了各自的新一代大模型Fable 5.1和GPT-6 Astra。然而两款产品的市场反响却大不相同:Fable 5.1很快淡出公众视野,而Astra则持续刷屏、热度不减。有观点分析,Fable 5.1不仅定价偏高,而且在很多环节处处设限,令不少客户感到不满。相比之下,Astra虽然在编码性能上可能稍逊一筹,但综合能力表现突出,Token使用效率更高,综合成本反而有所下降,应用范围也更为广泛。大量开发者与用户正在积极探索如何利用Astra改变现有的工作方式。
Astra的爆发也引发了不少技术人士的思考。日本JAIST大学客座教授今井翔太从另一个角度切入,提到了DeepSeek创始人梁文锋此前一场内部演讲中的表态。DeepSeek此前对多模态支持并不完善,这与梁文锋的观点密切相关。梁文锋认为,视频生成AI、世界模型或物理模型都不是通往AGI的主线,现阶段应当专注大语言模型的发展,之后再借助大模型的能力去解决其他领域的问题。今井翔太表示,在看到Astra展现出的全能表现之后,梁文锋这番表态的说服力正在变得越来越强。
按照梁文锋的说法,DeepSeek真正的核心目标就是AGI,其他事情只是顺手可以完成。站在更高的技术目标之上,再去做下一层的技术应用,很多时候会形成一种“降维打击”的效应。他也同时强调,DeepSeek不会将主要精力投入上述AI方向,并非因为这些领域没有价值,而是它们并不是限制AGI发展的关键瓶颈。
事实上,OpenAI也曾因为来自Anthropic以及中国开源大模型的竞争压力而调整战略,一度放弃视频生成模型,将资源聚焦于AI核心能力,包括编码等方向。从目前的结果来看,这番调整已经显现出明显成效。在GPT-5.5以及如今的GPT-6相继发布后,OpenAI被认为重新回到了行业巅峰。此次Astra登场,OpenAI方面更是充满自信地表示要开启AGI时代。英伟达CEO黄仁勋也对此表示赞同,同时还借机强调了自家GPU在训练Astra中的作用。他透露,这一次只使用了十万张显卡,而下一次的规模将会达到四十万张。
有评论指出,虽然美国科技公司动辄用“实现AGI”来进行营销显得颇为老套,但Astra展现出的能力确实比以往更上一层楼。与此同时,也必须承认国产AI大模型与领先阵营之间的距离被拉开了,尤其是在算力资源本就存在差距的背景下。美国公司的旗舰大模型已经完成了一轮发布,接下来国产大模型的表现,值得关注Kimi 3.1、GLM-5.5、MiniMax M3 Pro、Qwen4以及DeepSeek V4.1等新一批产品能否带来新的突破。
来源:Heooo AI工具导航