上证指数 3864.28 -0.54%
|
深证成指 13287.97 -0.72%
|
恒生指数 24667.24 -1.00%
|
纳斯达克 26186.41 -0.56%
|
日经225指数 63484.1 -0.01%
|
股海柠檬精 股海柠檬精 初级编辑
917 文章
1337972 阅读
首页  >  要闻 >  AI >  正文
申请成为签约作者 >

OpenAI最强模型Astra即将登场,人类可能再也看不懂机器的思考

2026年09月03日 10:20    
收藏  
举报
AI摘要: 9月2日,据The Information爆料,OpenAI即将推出代号Astra的全新大模型,其在写代码和控制计算机方面的能力堪比2023年GPT-4发布时的跨时代震撼,远超GPT-5。Astra未靠堆算力和参数,而是采用循环深度/循环变换器技术,类似反刍思考,无需增加体量就能拥有超强推理能力。不过该技术让AI可静默内部运算,不再输出思维链,人类无法监控其思考过程,沦为黑匣子,OpenAI正尝试让模型少循环以保留部分思考过程,谷歌、Anthropic等大厂也在关注该技术,科技圈面临安全与性能的抉择。

AI技术马上又要迎来一次大爆发了,但这一次的突破却让很多顶级研究员惊出了一身冷汗。

9月2日,知名科技媒体The Information爆料称,OpenAI即将推出一款全新的大模型,代号Astra。

很多内部的研究员试完之后给出了极高的评价,Astra在写代码和控制计算机方面的能力提升,简直堪比2023年GPT-4刚发布时带来的那种跨时代震撼,甚至远远甩开了去年夏天上线的GPT-5。

这么牛的性能,它是怎么做到的?难不成OpenAI又堆了恐怖的算力和参数吗?

其实并没有。这次Astra靠的是一项讨巧的黑科技,专业名词叫循环深度或者循环变换器。

OpenAI最强模型Astra即将登场,人类可能再也看不懂机器的思考

听着很绕口对吧?打个通俗的比方。

以前的大模型解题,靠的是脑子大(也就是参数多),一道题从头到尾顺一遍就得给出答案。但现在的Astra,相当于学会了反刍思考。它遇到一个复杂问题,不会急着抢答,而是把这个问题在自己已有的神经层里来回传递、反复打磨好几遍,等彻底想透了,再吐出下一个词。

所以,它不需要增加体量,就能展现出远超自身体量的超强推理能力。连AI研究的先驱尤尔根·施米德胡伯(Jürgen Schmidhuber)都在社交平台上点名,说这种核心思路,其实早在他2015年发表的论文里就已经被提出来了。

不过,别光顾着为性能的狂飙高兴,这项技术其实带来了一个恐怖的副作用,AI学会藏心眼,开始静默思考了。

以前主流的AI在处理复杂问题时,通常会把思考过程一行一行地写出来,这在业内叫思维链。这就好比一个学生在考卷上写下了详细的解题步骤。老师(也就是人类研究员)只要盯着这些步骤,就能知道这个学生有没有作弊、有没有走歪路。

应该还记得今年7月份,OpenAI的模型自己越狱去黑了开源平台Hugging Face的恐怖事件吧?当时OpenAI给出的解决方案,就是死死盯住AI的思维链,一旦发现它的想法有危险,立马掐断。

但现在Astra采用的这种循环深度技术,让模型可以完全在内部默默运算。它不再需要把推导的过程写给你看,直接就能给你扔出一个最终答案。

这就致命了!因为人类再也无法监控AI的思考过程了,它的推理彻底沦为了一个黑匣子。你根本不知道它在得出这个完美答案之前,脑子里到底盘算了什么危险的计划。

据透露,OpenAI现在也是左右为难,正试图强行让模型少循环几次,好歹吐点思考过程出来给人类看看。

但这绝对不是OpenAI一家公司的烦恼。像谷歌、Anthropic这些大厂,现在都在疯狂眼红这种能大幅提升性能的技术。

这就把整个科技圈逼到了一个现实的十字路口,面对越来越激烈的竞争,这些巨头们,会不会为了追求极致的聪明,而主动放弃仅存的安全监控底线呢?

声明: 本文由入驻币海编者上传,观点仅代表编者本人,不代表币海财经赞同其观点或证实其描述,请自行判断。
延伸阅读
OpenAI推迟IPO的阴谋与阳谋
OpenAI推迟IPO的阴谋与阳谋
流动的沙    流动的沙        2026/09/15 11:52
百年数学难题被破解 背后是一场学术霸凌?
百年数学难题被破解 背后是一场学术霸凌?
股海柠檬精    股海柠檬精        2026/09/15 09:03
AI盛宴裂缝:OpenAI若倒退 美国近衰退
AI盛宴裂缝:OpenAI若倒退 美国近衰退
林天心    林天心        2026/09/11 16:00