Claude Opus 5深夜發佈,以一半價格逼近Fable 5。

數字生命卡茲克
數字生命卡茲克2026年7月25日
左等右等,Claude Opus 5,就在這個週六的凌晨,正式發佈了。
目前,已經全量上線,在所有Claude產品裏,全線可用。
100萬上下文,知識最新截止時間來到了2026年的5月,新的不得了。
本來在Codex上掛了幾個/goal的目標任務,準備早睡了,結果這一激靈,直接停了,然後所有的任務取消,掛到Claude裏,全部用Opus 5重跑。
甚至今天做的很多的任務,Fable 5額度用光了,使用GPT-5.6 sol執行的,現在,我也準備再用Opus 5重跑一遍了。
主要是,給你們看看這個Claude Opus 5的跑分,你們就知道這個模型,有多離譜了。
咱們客觀的說,Anthropic這家公司,從上到下天天被人罵,壞事做盡,天天當小丑,來來回回耍猴,但是吧,你不得不說,他們的模型確實好,確實是牛逼。。。
所以如今出現了很詭異的風氣,包括我自己也是,我真的很討厭Anthropic,但是爲了產品、爲了工作、爲了效率,身體又很誠實,每次緊巴巴的把Claude Fable 5額度用完的時候,總是有一種戒斷反應。
然後只能去發發牢騷。
相信我,用習慣了Fable 5之後,再讓你去用Claude Opus 4.8,你會覺得,這是什麼蠢東西。
這一個月的時間,我的人生好像被按下了加速鍵,Claude Fable 5下線又上線,GPT-5.6 Sol的接棒和幾乎無限的重置,Kimi K3的國產崛起,再加上今天Claude Opus 5的上線。
我感覺我做的產品、我的代碼,幾乎每一週就要大幅的優化一遍,因爲我是外行也是個菜逼,模型的進步,幾乎也代表着我的產品的進步。
而這一個月的時間,我做的AI資訊平臺AIHOT的月活也翻了一倍,正式達到了60萬的月活,這還是一個很讓我開心的事情,感謝AI時代,感謝大模型,愚鈍、外行如我,也能探索自己的產品,做出對他人有利的東西。
這背後的工作,其實每一個點,都可以拎出來分享萬字長文了,任何東西你想把它做好,背後花費的心力真的不是一點兩點。
所以很多人總說,新模型上線就你天天激動,我每次都想回,我能不激動嗎,因爲這代表着我的產品、我的工作,又能更快速的進步、給大家帶來更好的體驗,也能做出更多我想做的功能了呀。
回到Claude Opus 5上。

Anthropic給Opus 5的定位非常清楚,它在很多領域已經逼近Fable 5了。

就像上面那張跑分圖。

甚至在ARC-AGI-3上,是最誇張的,Opus 5是30.2%,GPT-5.6 Sol是7.8%,Opus 4.8只有1.5%,可惜Fable 5沒有這塊的跑分,不知道能到都多少。

它相當於直接做到了第二名的接近四倍。

這種抽象推理、動態適應和陌生任務泛化,一直是模型最容易露怯的。

因爲過去的模型經常能複述世界,能模仿答案,但是一旦規則沒見過,立刻開始犯蠢了,所以ARC-AGI-3,在現在的時間點,挺能代表一個模型真正的智力和泛化程度的。

甚至在AA的跑分上,居然比Fable 5還要強。

但是價格只有Fable 5的一半。

輸入每百萬Token 5美元,輸出每百萬Token 25美元,價格跟Opus 4.8一樣。

還有一個Fast Mode,速度大約提升到2.5倍,價格翻倍。

我知道你現在想說,我靠,Claude Opus 5比Claude Fable 5都要強了?那我還用個屁的Claude Fable 5啊,又貴又垃圾。
但是,我想說,現在模型廠商的伎倆吧,其實都是有誤導性的,你只看到了他們放出來的這些評測集,基本都是代碼、Agent、辦公等等。
但是,真正的跑分,在Opus 5的系統卡里和過去Fable 5(也就是Mythos 5)的對比裏,我全整理了出來,可以看看實際的情況。
所以,從這裏就可以看出,Fable 5更像一顆更大的純大腦,擅長無工具推理、原生視覺理解、專業醫療表達、高難編程,以及網絡安全等極難專業任務。
而Opus 5 更像一個執行系統成熟的Agent,特別會使用工具、檢查結果、發現錯誤、重新嘗試,最終任務完成率更高。
如果硬要我說,一個感覺是新預訓練帶來的版本之子,一個是當下RL的版本之子。
所以,在較難的工程任務、Agent任務、真實任務裏,Claude Opus 5的實現效果可能會更好,但是從方案設計、規劃的角度來說,依然是Claude Fable 5效果最好。

所以如果只問Opus 5有沒有把Fable 5徹底淘汰,答案很簡單,暫時沒有。

可如果問它是不是當前最適合大規模拿來幹活的Claude,我個人已經準備直接切了。

尤其是那些過去覺得Fable最好用,又實在捨不得額度,最後只能咬牙退回Opus 4.8的任務,主要還是每週的Token額度Fable 5只能用50%,另外50%不用光,那是真的就浪費掉了。

這次終於有一個舒服得多的中間解了,50%額度的Claude Fable 5+50%額度的Claude Opus 5,而且效果確實不錯。

比如我今天重構了一下AIHOT的整個API、RSS還有Skill,那玩意其實之前推出的太倉促了,效果不是很好,所以呢,就是爲了讓大家請求起來體驗更好,同時也降低對我服務器的請求次數,讓我壓力更小點,就重搞了一下。

因爲Fable 5我的額度用完了,於是我用了一個邪修的方式,直接讓ChatGPT網頁版的GPT-5.6 Sol Pro來幹了,這個其實是一個小技巧,就是在Review深度、思考深度上,都比Codex本地的Max或者Ultra更好用,而且,還不燒你的Codex額度。

這個東西搞完以後,我其實把方案扔給了Codex上的GPT-5.6 Sol、Kimi K3、Opus 4.8,讓三者來深度Review,看看這個方案對不對,是不是能解決本質問題,還有沒有可以優化的空間。

這三者給的答覆幾乎就是沒啥問題,只能硬挑一點小問題。

然後我就直接給GPT-5.6 Sol Ultra設了個目標,讓他自己去幹了,大概3個小時,不知道開了多少個Agent,幹完了。

又用K3、GPT-5.6 Sol自己開了對抗式審查,看看有沒有BUG和漏洞啥的,基本也就一些小的無關痛癢的,我以爲就沒啥問題了。

結果剛剛用Claude Opus 5跑了一下,給我嚇得一身冷汗,驗證了一下,確實對的,趕緊改。。。

而且這個問題還挺嚴重的。。。

除了體驗之外,又發現了漏洞。

第一個漏洞給我嚇尿了,我現在看到什麼擊穿邊緣緩存幾個字我就PTSD,兩週前被各種攻擊爬流量給我賬單幹崩就是這麼幹出來的。。。

立馬就直接開修去了。

確實能感覺到,更聰明一點,有一點Fable 5那個味了,雖然Fable 5經常看完我之前做的東西,就會跟我說,你之前做的是一坨屎,有更好的辦法,我覺得你可以重構。。。

而且在配合Claude Design以後,我覺得UI設計的細節也變得更好了一些,比如爲了配合新的API啥的上線,我就把Agent接入界面也給重做了一些,之前GPT-5.6 Sol真的設計的就是一坨屎,給我幹完長這樣,我人都麻了,我想罵人。

Opus 4.8設計了一版,也不是特別好看,晚上拿Claude Opus 5重設計了一下,正常多了。

寫作這塊大家也不用看了,繼續拉完了。

依然還是Claude Opus 4.6最好。

然後這一次,因爲Opus 5在編程任務上的強大,在整個Claude Code的使用上,帶來了一個很大的變化。
官方也直接寫了一個教程。
這個我覺得反而是更加重要的。
因爲隨着模型的能力的進化,我們其實會發現,很多的約束、很多的Skill,已經變得毫無用處了。
比如說我幾個月前給大家安利的一個開發的插件,叫Superpowers,坦率的講,在幾個月後的今天,模型進步到今天這個智力程度,那玩意已經幾乎沒啥用了,還有很多很多很多的Skills。
我現在的本地裏,Skills只有6個了,幾乎全部是我自己做的。
模型越進步,所需要的外面的限制就要越少。
所以這一次,Anthropic爲了Opus 5和Fable 5,直接把這個版本的Claude Code的System Prompt刪掉了80%以上,然後發現,編碼評測沒有出現可測量的下降。

文章第一張核心圖,畫的是一個Claude真正看到的完整上下文。

System Prompt裏寫着根據情況留下文檔,Skill裏寫着禁止添加註釋,用戶又說做得跟舊版本一樣。

這活就沒法幹了。

模型當然可以理解,可它必須花思考Token去調和衝突,猜哪條優先,猜所謂舊版本到底包括哪些東西。

上下文越長,類似的小衝突越多。

所以呢,Anthropic把Claude 5時代的變化總結成六組心法:

過去給規則,現在給判斷空間。

過去給大量示例,現在設計好接口。

過去把全部內容塞在最前面,現在按需展開。

過去在不同地方重複提醒,現在把工具說明寫得簡單清楚。

過去把記憶塞進CLAUDE.md,現在交給自動記憶。

過去只寫一份簡單規格,現在直接提供代碼、測試、HTML原型和完整參考物。

其實你會發現,就是從手冊制,你給模型規劃好任務的方案,變成了設計Harness,設計一個讓模型自己完成目標的工作環境。

真正強的Harness,會把狀態、權限、約束和反饋做進環境裏,把目標和判斷留給模型。

X上的大佬其實也提到了。

我因爲一直幾乎是裸的,除了幾個自己的Skills,幾個MCP,幾個官方的插件,一些規範化的文檔,其實就沒啥了,所以我一上手的體驗反而非常好。

這裏其實官方也感受到了這個問題,所以他們非常推薦大家在Claude Code裏,先運行一下/doctor這個命令,來幫大家清除一些垃圾。

是時候,簡化你的Agent和工作流了,模型,會吞噬一切。

最後,在今天這個時間點,也簡單的再給大家分享一下我的工作流和使用的模型吧。

大體量重構方案規劃和底層研究:Claude Fable 5。

常規方案設計+Review:Claude Opus 5。

代碼執行+BUG修復:Claude Opus 5或GPT-5.6 Sol(看人在電腦前還是不在電腦前,在電腦前我選Claude,人在外面我選GPT)

大型代碼Review:ChaGPT網頁版上的GPT-5.6 Sol Pro。

UI設計:Claude Design + Claude Opus 5。

部分項目的展示站:Kimi K3(直出前端太好看了)。

大概就是這樣。

感覺這個列表,未來會輪動的越來越快,模型進化的速度,好像邁過了某種奇點。

就像Grok在收購了Cursor之後,模型能力瞬間起飛,迭代速度也變得極其恐怖,接下來,真的就是兩週一更新了。

幾乎每天一睜眼,我們就有新模型用,我們的能力邊界,又再進一步擴寬。

真的,好像沒有比這更幸福的事了。

以上,既然看到這裏了,如果覺得不錯,隨手點個贊、在看、轉發三連吧,如果想第一時間收到推送,也可以給我個星標⭐~謝謝你看我的文章,我們,下次再見。

>/ 作者:卡茲克

>/ 投稿或爆料,請聯繫郵箱: [email protected]