
Claude Fable 5.1:對你的生意意味著什麼,以及如何為每類任務選對模型
發佈於:
閱讀時間: 3 min
主題: 技術
作者: Leandro Valencia
Claude Fable 5.1 到底改變了什麼、每類任務該用哪個 Claude 模型(Fable、Opus、Sonnet、Haiku),以及如何在不燒掉預算和用量上限的前提下,為你的生意搭一套 AI 工作節奏。
目錄
真正改變了什麼
先從對開票賺錢的人重要的事說起,而不是對發論文的人重要的。
Fable 5.1 和 Mythos 5.1 是同一個模型,只是保護級別不同。 Fable 5.1 對所有人開放。Mythos 5.1 只提供給從事網路安全和生命科學的已驗證組織。除非你身處這兩個領域,否則 Mythos 與你無關:你用的是 Fable。
降價了,而且降在最痛的地方。 輸入和輸出的每百萬 token 價格不變($10 和 $50)。降了 75% 的是快取讀取:從每百萬 token $1 降到 $0.25。翻譯一下:模型重新讀取它已經處理過的上下文——在長時間智慧代理工作中這隨時都在發生——現在的成本只有原來的四分之一。Anthropic 估計,典型負載成本下降約 25%,高度智慧代理化的任務最高約 45%。如果你有透過 API 跑的自動化流程,這就是今天最重要的新聞。
它提升的恰恰是生意需要的地方。 在企業工作流基準 AutomationBench 上,Fable 5.1 拿到 31.4%,對比 Fable 5 的 17.1% 和 Opus 5 的 26.9%,幾乎是前代的兩倍。在 GDPval-AA v2(知識工作)上從 1723 升到 1853。在電腦使用(OSWorld 2.0)上從 72.9% 升到 77.9%。
但別把這些數字當成績單讀:AutomationBench 的 31.4% 意味著模型完成了測試中不到三分之一的自動化商業任務。全自動化的時代還沒到。到的是:一塊以前幾乎不可用的領地,出現了大幅改善。
商業客戶的證言比表格更有資訊量。 Hebbia 說它產出了他們測試過的所有模型裡最好的 PowerPoint 簡報。Rogo 回報在財務投影片生成和「用平實的英語解釋複雜資料」上有提升。做合約審查的 Crosby 在其紅線標註基準上從 47.9 升到 57.0,而且大部分提升來自首次嘗試的品質。Canva 稱讚它的寫作。Shopify 提到它能撐住長時間無人監督的工作:「它自己做記錄,隨情勢變化重新排優先級,並從上次中斷處繼續。」
簡報、合約、財務文件、寫作、長時間無人監督的工作。這份清單不是巧合:它正是一個單打獨鬥的創業者因為無人可託付而做得又差又晚的那部分行政工作。
給內容創作者的一個細節。 出於對歐盟 AI 法案的合規要求,2026 年 8 月之後發布的模型會在生成文字中攜帶隱形浮水印。它不影響品質、不包含你的資訊,偵測 API 目前只對監管機構和被涵蓋的組織開放私有預覽。但如果你以賣文字為生,最好知道:存在一種技術機制,可以估計一段文字是否由 Claude 生成。
幾乎所有人都在犯的錯誤
這是全文的核心觀點,而且不會出現在任何發布官宣裡:
大多數人選定一個模型,然後用它做所有事。 通常是最貴的那個,因為「最好的,就是對哪都最好的」。這是一個管理錯誤,不是技術錯誤。
這相當於花每小時 300 美元請一位資深顧問來幫你回郵件。他會做得很好。也會做得又慢又貴,而且在你真正需要他的那個任務到來之前,預算就先燒完了。
今天的 Claude 家族是四個價格與能力輪廓差異很大的模型。下面是 API 每百萬 token 的價格,這是判斷各自處在哪個聯盟最客觀的指標:
| 模型 | 輸入 | 輸出 | 輪廓 |
|---|---|---|---|
| Fable 5.1 | $10 | $50 | 頂級能力、長時智慧代理、沒有清晰路徑的問題 |
| Opus 5 | $5 | $25 | 結構已知的複雜工作 |
| Sonnet 5 | $2 | $10 | 日常主力,品質/成本比出色 |
| Haiku 4.5 | $1 | $5 | 大批量、高速度、機械性任務 |
Fable 的輸出 token 單價是 Haiku 的十倍。如果你用 Fable 去分類 500 封郵件,你就在為一項 Haiku 同樣能做好的工作多付十倍的錢。
還有一個幾乎沒人碰的第二個旋鈕:努力等級(effort)。Fable 5.1 可以設定為 low、medium、high、xhigh 或 max。Anthropic 指出了一個重要事實:在低或中等努力下,Fable 5.1 能以低得多的成本取得與 Fable 5 相當或更好的結果。預設值在 Claude Code 裡是 High,在 Claude Cowork 和 claude.ai 裡是 Medium。
也就是說:槓桿有兩個,不是一個。用哪個模型,以及用多少努力。
矩陣:什麼任務用什麼模型
這張表值得收藏。
| 任務類型 | 模型 | 理由 |
|---|---|---|
| 戰略、不可逆決策、市場分析 | Fable 5.1(高努力) | 推理品質比成本更重要的場合 |
| 大型商業提案、合約審查 | Fable 5.1 | Crosby 測得的最大提升在首次嘗試品質 |
| 給客戶的簡報和 deck | Fable 5.1 | Hebbia 和 Rogo 認為它是做投影片最強的模型 |
| 基於真實文件的財務分析 | Fable 5.1 | 資料召回更好,且傾向追溯一手來源 |
| 長時間無人監督的智慧代理(數小時) | Fable 5.1 | 能保持線索並續跑;快取讀取還便宜 |
| 寫文章、腳本、newsletter | Opus 5 或 Sonnet 5 | 品質足夠;只有旗艦內容才升到 Fable |
| 競品調研、多來源綜合 | Opus 5 | 以 Fable 一半的價格拿到好推理 |
| 郵件、客戶回覆、跟進 | Sonnet 5 | 中等體量下品質穩定 |
| 改寫、摘要、翻譯 | Sonnet 5 | 品質/成本的甜蜜點 |
| 分類、資料擷取、打標籤 | Haiku 4.5 | 機械性、大批量工作 |
| 高頻內部問答、客服第一道過濾 | Haiku 4.5 | 速度和成本低於一切 |
一條出奇好用的經驗法則:做錯了也沒什麼事,就用便宜的模型。做錯了會丟掉一個客戶、一份合約或六個月,就用 Fable。
如果你不寫程式:Claude.ai 和 Claude Cowork
這一節給只透過 App 使用 Claude、一行程式碼都不碰的人。
先說最實際的存取問題:Fable 不在免費方案裡。 Pro(約 $17-20/月)透過用量點數使用。Max($100/月起)可用 Fable,週上限為正常的 50%。Team 和 Enterprise 直接包含。Opus、Sonnet 和 Haiku 在所有付費方案裡都有。
對自由工作者的解讀是:Pro 就夠你有選擇地使用 Fable——留給每個月真正值得的那五六件事——其餘工作交給 Sonnet 或 Opus。只有當你發現每週有多次被限額卡住時,升級 Max 才有意義,在那之前不必。
操作層面:這週就能搭起來的
商業提案。 上傳三份你贏下的提案和一份你輸掉的,先讓 Fable 提取贏的那幾份的共同模式,再寫下一份。關鍵指令不是「幫我寫一份提案」,而是「找出我贏的那幾份有什麼共同點、輸的那份缺了什麼」。
簽約前的合約審查。 上傳合約,分開要三樣東西:偏離標準的條款、用大白話解釋的具體風險、以及一份帶建議紅線的版本。Fable 5.1 的躍升正是在這裡被測量和記錄的。它替代不了大交易裡的律師,但能讓你不至於閉著眼睛簽一份 $2,000 的合約。
客戶 deck。 把原始資料給它——而不是一個已經想好的結構——先要敘事,再要投影片。常見錯誤是開口就要 slides:你會得到漂亮的設計蓋在軟弱的論證上。
月度結帳。 上傳銀行對帳單和發票,要一份標出異常的對帳,外加一段說明利潤率為何變化的文字總結。這件事過去要吃掉你一整個下午。
客戶往來信函。 用 Sonnet,不是 Fable。建一個包含你的語氣、服務和價格的專案,日常信函都在那裡起草。
客服和重複問題。 找出你每週都要回答的十個問題,用 Sonnet 把它們做成標準答案庫。這是小生意能做的投入最小、回報最大的自動化。
戰略層面:幾乎沒人做的事
這才是 Fable 5.1 自己把訂閱費賺回來的地方,而 95% 的使用者沒吃到,因為他們始終把 Claude 當寫手用。
你請不起的顧問委員會。 把你的生意全貌——真實數字,不是理想化版本——描述給它,讓它從三個角度批判你的模式:一個懷疑一切的投資人、你最凶的競爭對手、你最不滿的客戶。價值不在答案裡,而在那些你從沒問過自己的問題裡。
定價診斷。 給它你的成本結構、目前報價和成交率,要分析,不要建議。區別很重要:「我該收多少錢?」會得到一個編造的數字;「給我看三個定價情境下我的利潤率如何變化、我隱含了哪些假設」會得到一個能支撐決策的東西。
帶來源的競品分析。 Fable 5.1 表現出跳過二手報導、直奔一手來源的傾向。明確要求它為每條論斷給出引用和連結,沒帶來源的內容直接丟棄。
複盤重建。 丟掉客戶時,把整個專案的往來記錄全部給它,要一條標出關係從哪裡開始變歪的時間線。這不舒服。但這是不再重複同一個錯誤的最便宜方式。
真正的季度規劃。 每個季度一次,把 Fable 調到高努力,做完整套練習:什麼有效、什麼沒用、時間漏到哪裡、該停止做什麼。鎖死兩個小時。這是整個季度槓桿最大的會議,也是永遠被推遲的那一場。
如果你在用 Claude Code 或 API
這一節給已經寫點程式或跑自動化的人。
快取讀取降價改變了算術。 每百萬 token $0.25 意味著,在呼叫之間維持一個大而穩定的上下文不再是主要開支。如果你的架構是為了減少重複讀取而設計的,去複查一下:你最佳化的那個成本很可能已經不存在了。Cognition 把 Devin 上 Opus 5 的流量遷到 Fable 5.1 時說得很直白:在新的快取價格下,過去必須用 Opus 的負載,Fable 級別的模型也變得經濟了。
把 effort 當成本槓桿用,而不只是品質槓桿。 升級模型之前,先試試在同一個模型裡提高努力。反過來也一樣:如果你的任務在 Fable 中等努力下就能跑通,別出於慣性用 high 跑。Claude Code 的預設值是 High;對很多重複性任務來說這是過量的。
用瀑布式設計。 在小生意裡效果最好的模式是:Haiku 過濾並分類進入的流量,Sonnet 處理大頭,Fable 只在前兩者標記為困難 的個案上出手。每五十次 Haiku 呼叫配一次 Fable 呼叫,就會徹底改變你的月帳單,而且不犧牲結果。
無人值守的工作現在是真可行了。 多家早期合作方回報了數小時無監督的運行,Ramp 提到一次 38 小時的任務。對小生意而言,這意味著你可以在下班時丟出一個大任務——遷移資料、重構、處理歷史檔案——第二天早上檢查結果。從失敗可恢復的任務開始。
一個可能弄壞你東西的變更。 從現在起建立的 API 帳戶,無法再在保留推理記錄的同時手動編輯 Claude 的先前上下文。這是反蒸餾措施。現有帳戶暫時不受影響,但未來版本會生效。如果你的整合會改寫對話歷史,去檢查一下。
批次處理仍然是被遺忘的折扣。 非同步負載半價。如果你的流程不需要即時回應——夜間報表、積壓任務處理、資料庫 enrichment——你在白白付雙倍的錢。
安排得好的一週長什麼樣
少談理論,多講日程。一套可行的結構:
每天,用 Sonnet: 郵件、客戶回覆、草稿、會議紀錄、跟進。這佔 80% 的量,不需要更多。
每週,用 Opus 5: 一週複盤、一個課題的調研、長文內容寫作、重要會議準備。
每月,用 Fable 5.1: 財務結帳、待簽合約審查、那份大提案、給重要客戶的 deck。
每季度,用高努力的 Fable 5.1: 完整的戰略會議。商業模式、定價、競爭、該停掉什麼。
背景,用 Haiku 4.5: 一切屬於大批量和分類的活。
關鍵不在精確的分配——按你的生意調整——而在原則:按做錯的代價選模型,而不是按習慣。
值得避免的三個錯誤
要答案而不是要分析。「我該定什麼價?」給你一個語氣自信的編造數字。「給我看分析和假設」給你一個能用來做決策的東西。再好的模型也不會比你更懂你的市場。
把基準測試當保證。 AutomationBench 的 31.4% 相比 17.1% 是巨大進步,但仍然不到三分之一。永遠要複核輸出結果。
預設用貴的模型。 這是最昂貴、也最容易矯正的錯誤。如果 Sonnet 能解決你的任務,Fable 不會給你五倍好的結果,只會給你五倍貴的帳單。
這週我會做的事
如果只能選三個具體動作:第一,找出這個月裡做錯一次就真金白銀受損的三件事,把它們挪到 Fable 5.1。第二,找出你出於慣性每天在貴模型上做的三件事,把它們降到 Sonnet 或 Haiku。第三,在月底前約上兩小時的戰略會議。
就這麼簡單。不需要重構你的業務,需要的是停止用一個模型做所有事。
如果你想更進一步,為你的生意搭建一套完整的 AI 營運系統,這正是我們在 Transforma 裡做的事。
註:如果你購買軟體、授權或數位訂閱,透過我的連結在 Eneba 可享 95 折。這是聯盟連結:你更便宜,我能維持這個部落格。
來源
相關文章
繼續探索您可能感興趣的相似內容

Z.ai和GLM模型:3個月日常使用,真實價格,以及適合誰(以及不適合誰)
3個月使用Z.ai/GLM進行實際開發的詳細分析。真實價格,實用用例,以及關於誰真正適合的誠實看法。

Amplitude 與 Claude:產品分析完整指南
了解 Amplitude 是否值得使用、如何逐步分析用戶行為,以及如何透過 MCP 將資料接入 Claude,像與資深分析師對話一樣向你的資料提問。

如何在 Claude Cowork 安裝並精通 Superpowers Skill
學習從 Claude 官方 Marketplace 或 GitHub 在 Claude Cowork 安裝 Superpowers。認識這個採用 TDD 與系統化開發的 AI 技能框架,讓你的代理能自行規劃、測試並審查自己的程式碼。