导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

GPT-6 Astra发布一周遭“变笨”投诉:OpenAI再陷发布后削弱争议

导语:OpenAI最新旗舰模型GPT-6 Astra在发布仅一周后遭遇用户集体质疑。多名开发者和用户在社交平台表示,该模型回答速度变快、质量却明显下降,怀疑OpenAI在发布后悄然下调推理强度或资源投入。

Myriad:英伟达股价能涨多高?点击进行预测。

一周前,GPT-6 Astra还因能在游戏引擎中逐街重建曼哈顿而受到好评。仅仅一周后,同一批用户开始晒截图追问OpenAI:模型到底发生了什么。

用户称“像被做了发布后脑叶切除”

匿名开发者synthwavedd在X上表示:“Astra今天对我来说明显变笨了。发布后脑叶切除只是时间问题,遗憾。”这类抱怨在AI用户中并不陌生:受欢迎的聊天机器人和智能体常在发布后突然“被削弱”。多数情况下,性能下降疑似有合理解释;但当大量用户同时表达相同感受时,就值得审视。

此前曾称赞Astra的开发者Pranjal Paliwal回头阅读模型为他写的代码后表示不满,并称:“我们没有AGI,我们有的是回归。”AGI即通用人工智能,OpenAI总裁在Astra发布时曾使用这一说法。一周后,用户却用它来描述相反情况。

投诉集中:更快、更差、推理“果汁”变少

开发者Pankaj Kumar列出症状:回答更快、质量更差,并怀疑OpenAI降低了“juice value”。创始人Saba直接询问OpenAI,为什么她如今必须把任务简化才能完成。“Juice value”并非官方术语,但被广泛理解为模型在回答前投入的思考计算量,以及用户对OpenAI在发布演示结束后悄悄调低该参数的怀疑。

部分用户进行了对比测试。Salio和研究员Md Ismail Sojal分别用相同提示词测试发布日版本和当前版本Astra,两人都发现当前版本结果更差。也有人选择回退。构建编程工具Opencode的Dax Raad表示,其团队已回到Astra的前代GPT-5.6 Sol,因为支出翻倍,性能下滑却不值得。ChatGPT用户Mustafa Sahinli更直言,Astra现在让他感觉像发布一周后的Claude Opus 4.6,讽刺Anthropic也曾遭遇发布后反弹。

并非所有人都认为OpenAI削弱了Astra

匿名用户Antikythera给出最详细的反驳,认为时间线被倒置了。“它和发布时一样笨,”Antikythera写道,“模型很好,但有很多问题。它很懒,写东西像上瘾一样爱用项目符号。人们在发布周过度吹捧,现在有时间测试并看到错误。”换句话说,模型没有变,只是用户不再被惊艳,开始注意到它一直都是“项目符号上瘾者”。

T3Chat创始人Theo也有类似看法:Astra实际上比Claude Fable更不稳定,有时能写出出色代码,有时又极其愚蠢。目前看到的,可能只是蜜月期结束后,用户更频繁地发布坏结果。

GPT-5.6 Sol曾经历相同周期

这并不新鲜。OpenAI上一代旗舰GPT-5.6 Sol在7月也经历相同周期:用户报告其最高推理模式一夜之间变浅。OpenAI高管Tibo Sottiaux否认故意削弱模型,但确认公司一直在试验推理努力设置,即控制模型回答前思考多少步的参数。一条回复总结了这个玩笑:闭源实验室发布模型,几天后模型感染某种疾病,突然变笨。另一条给出怀疑论者的解释:“它们很可能被量化了,这样就不会烧掉公司太多钱。”量化模型意味着降低内部数学精度以削减成本,通常以一定准确率为代价。OpenAI从未确认故意对已发布模型这样做。

OpenAI尚未就Astra发布类似Sol的声明。Astra仍是该公司首个跨过其所谓网络安全风险关键阈值的模型,意味着它能在无人工引导下发现并串联未知软件漏洞,该能力在OpenAI Daybreak计划下仅限经过审查的防御方使用。无论是否变笨,它仍定价为每百万输入token 10美元、每百万输出token 50美元,是Sol发布时价格的2.5倍。