首頁LBank 新聞中心
GPT-6 Astra 使用者表示 OpenAI 最新模型變笨了。這種情況以前也發生過。
gpt-6-astra-openai-model-dumber-nerfed
GPT-6 Astra 使用者表示 OpenAI 最新模型變笨了。這種情況以前也發生過。
上市一週後,使用者開始抱怨 GPT-6 Astra 被削弱了。OpenAI 的上一個模型在七月也經歷了同樣的情況。
2026-09-12 來源:decrypt.co

簡而言之

  • Astra「效能削弱」的抱怨在推出僅一週後便湧入X平台。
  • 此前,用戶在模型推出時就發現了寫作品質問題。
  • OpenAI的前一個模型Sol在七月也遭遇了同樣的反彈。

一週前,GPT-6 Astra在遊戲引擎中逐街重建曼哈頓,其強大能力讓用戶驚嘆不已。本週,同樣一群人卻在發布截圖,詢問OpenAI他們的模型究竟發生了什麼事。

「對我來說,Astra今天感覺明顯變笨了,」知名匿名開發者synthwavedd在X上發文表示。「上市後被『腦葉切除術』只是時間問題。真遺憾。」

Myriad:Nvidia股價會飆漲到多高?點擊做出你的預測。

這是一種熟悉的論調,AI用戶已經習慣了他們喜歡的聊天機器人與代理程式突然感覺被「削弱」了效能。大多數情況下,模型感知到的效能下降都有合理的解釋。但當足夠多的人在同一時間說著同樣的事情時,就值得仔細審視發生了什麼。而目前社交媒體上充斥著用戶對GPT-6 Astra迅速失望的例子。

開發者Pranjal Paliwal,此前曾讚揚該模型,他回頭仔細檢查了Astra為他編寫的程式碼。他對所發現的內容並不滿意。

「我們沒有通用人工智慧(AGI),」他寫道,「我們只有倒退。」

天啊,我終於看了Astra寫的程式碼。
我收回前言。

我們沒有通用人工智慧。
我們只有倒退。

怎麼能同時這麼聰明又這麼笨!

— Pranjal Paliwal (@betterclever) September 11, 2026

AGI,即通用人工智慧(artificial general intelligence)的縮寫,是業界對一種機器人的稱呼,它本質上能夠像人類一樣進行認知活動。OpenAI自己的總裁在Astra發布時使用了這個詞。一週後,他的一位用戶卻用它來描述相反的情況。

這些抱怨有著相似的模式。開發者Pankaj Kumar列出了這些症狀:回答速度更快,但品質更差,並懷疑OpenAI「降低了其『能量值』」。創始人Saba直接詢問OpenAI,為什麼她現在必須「降低要求」才能完成任務。

「能量值」並非官方術語。沒有人對其進行定義。但這是這裡每個人都明白的簡稱:模型在回答前所花費的運算思考量,以及懷疑OpenAI在發布演示完成後悄悄調低了這個刻度。

有些人進行了嚴謹的測試。Salio和研究員Md Ismail Sojal都用相同的提示詞對比了Astra發布當天的版本和今天的版本,結果顯示目前的版本表現更差。

今天的GPT-6 Astra輸出看起來更糟。
推出時的GPT-6 Astra vs 今天的GPT-6 Astra。

- Tibo說他們有算力
- 相同的提示詞,相同的設定。
- 我在Astra推出時和今天都跑了完全相同的提示詞。
- 差異比我預期的還要大…。

— Md Ismail Šojal 🕷️ (@0x0SojalSec) September 11, 2026

其他人則直接換回去了。開發編碼工具Opencode的Dax Raad表示,他的團隊已轉回使用Astra的上一代模型GPT-5.6 Sol,因為其成本翻倍,但負面影響卻不值得。ChatGPT用戶Mustafa Sahinli更直白地說:Astra現在讓他感覺就像Claude Opus 4.6「發布一週後」的表現,這是在諷刺Anthropic自己的模型在發布後也遭遇了反彈。

然而,並非所有人都認為OpenAI是故意削弱了其最新模型。匿名用戶Antikythera發布了這批意見中最詳盡的反駁,他認為時間線是反向的。

「它就和剛推出時一樣笨,」Antikythera寫道。「這個模型不錯,但它有很多問題。它很懶惰。寫作像個『列點狂魔』……人們在發布週過於興奮,現在他們有時間測試並看到它的錯誤了。」

換句話說:什麼都沒變。你只是不再被它迷住了,所以才注意到這個模型一直有點「列點狂魔」的毛病。

T3Chat創始人Theo也有類似的看法:Astra實際上比Claude Fable更不穩定,所以它有時能產生出色的程式碼,有時則會寫出徹頭徹尾的蠢程式碼。現在蜜月期已過,似乎有越來越多的用戶更頻繁地發布那些笨拙的結果。

GPT-6 Astra做出了我從未想過模型能做到的不可思議之事。它也做出了我見過模型做過最愚蠢的一些事。

總體來說,Fable 5.1只是做我要求的事情。pic.twitter.com/X2UwI7tDnD

— Theo - t3.gg (@theo) September 8, 2026

這也不是新鮮事了。OpenAI上一款旗艦模型GPT-5.6 Sol在七月也經歷了同樣的循環,當時用戶報告稱其頂級推理模式在一夜之間變得膚淺。OpenAI高層Tibo Sottiaux否認故意削弱其效能,但證實公司一直在測試「推理努力」這項設定,該設定控制著模型在回答前會「思考」多少步驟。

一則回覆總結了這個流傳的笑話:封閉實驗室發布一個模型,幾天後它就會染上「某種疾病,然後突然變笨」。另一人則用一句話提出了犬儒主義者的理論:「它們很可能被量化了,這樣就不會燒掉公司那麼多錢。」

不過這次它們一開始就很笨。我給Astra一個任務,它徹底失敗了,然後5.6 SOL在xHigh模式下完成了清理工作...

— Physicist 🏖️ 💻 (@heisenberg_btc) September 11, 2026

量化模型意味著降低其內部運算的精確度以削減成本,這通常會以犧牲準確性為代價。OpenAI從未證實曾故意對已發布的模型進行量化處理。

OpenAI尚未針對Astra發布類似Sol的聲明。該模型仍然是公司首個跨越其所謂網路安全風險關鍵門檻的模型,這意味著它可以在沒有人類指導的情況下發現並串聯未知的軟體漏洞,這項能力僅限於OpenAI「破曉計畫」(Daybreak program)中經過審查的防禦者使用。

無論變笨與否,它仍然需要每百萬輸入Token支付10美元,每百萬輸出Token支付50美元,是Sol推出時費用的2.5倍。