yii.
← Digest
EP82 · 2026年5月25日 星期一 · 10 min read

Anthropic 一週做了 9 件事,從模型公司變平台公司

一家模型公司,七天內同時開九條新戰線 — Opus 4.7 上線、Stainless 收編、SpaceX 22 萬顆 GPU 進場

每天花 1% 的時間,掌握科技脈動。

今日金句#

“Automation is a lie — seemingly automated tasks still require human oversight, judgment, and direction.” 「自動化是個謊言——看起來自動化的任務,仍然需要人類監督、判斷和引導。」 — Dan Shipper, Every CEO (原文)

“Agents are only as useful as what they can connect to.” 「Agent 的價值,取決於它能連接到什麼。」 — Katelyn Lesse, Head of Platform Engineering, Anthropic (原文)

“The LLMs produce non-deterministic output and generate code much faster than we can read it.” 「LLM 產生非確定性的輸出,產生程式碼的速度遠超我們閱讀的速度。」 — olano.dev, “—dangerously-skip-reading-code” (原文)

今日主軸:Anthropic 的「七天九連發」與隨之而來的反向聲音#

Anthropic 把一整套擴張動作壓縮在七天內放出:Claude Opus 4.7 GA(軟體工程任務升 13%、視覺輸入支援 375 萬像素、推出 xhigh 推理層級)、Claude Design 推出(讓 Claude 直接做設計稿、原型、Slides,用戶迭代次數從 20 個 prompt 縮到 2 個)、收購 Stainless(官方 SDK 與 MCP server 工具鏈整入 Anthropic)、與 SpaceX 簽算力協議(300+ MW、22 萬顆 NVIDIA GPU、一個月內到位,同時 Pro/Max 速率限制加倍)、KPMG 全球策略聯盟(27.6 萬名專業人員直接配發 Claude)、金融服務 agents(Opus 4.7 在 Vals AI 金融基準 64.37% 業界第一)、和 Blackstone/Hellman & Friedman/Goldman Sachs 合資新企業 AI 服務公司、Claude for Small Business(15 個內建工作流,整合 QuickBooks/PayPal/HubSpot)、以及一則表態:Claude 永久不會放廣告。

但同一週裡,反向的聲音也出現了。HN 上 olano.dev 的 “—dangerously-skip-reading-code” 拿到 190 分熱議——「LLM 寫程式的速度遠超我們能閱讀的速度」,他主張 code review 應該從審程式碼轉成審 spec。Simon Willison 同一天轉貼 Armin Ronacher(Flask/Jinja 作者)對 AI slop 的批評:開源社群正在被 LLM 生成的低品質 issue 報告淹沒,這些 issue 用自信的語氣下錯誤的結論、捏造最小重現步驟。Lenny’s Newsletter 上 Every CEO Dan Shipper 則丟出「自動化是個謊言」——AI 越多,反而需要更多的「Forward Deployed Engineer」做品質把關。

加速最快的玩家在做平台收編,懷疑最深的聲音在同一週浮上水面——這不是矛盾,是同一件事的兩個面。

必讀#

  1. Claude Opus 4.7 GA:軟體工程能力升 13%、視覺輸入升 3 倍 — Anthropic AI
  2. Claude 速率上限加倍 + SpaceX 22 萬顆 GPU 進場 — Anthropic AI
  3. Claude Design 上線:對話一次出設計稿、原型、Slides — Anthropic Labs AI
  4. Anthropic 收購 Stainless:把 SDK 與 MCP 工具鏈收編 — Anthropic AI
  5. DeepSeek Reasonix:終端原生編碼 agent,宣稱 99.82% prefix-cache 命中 — HN Dev
  6. --dangerously-skip-reading-code:AI 生成的程式碼,沒人讀得完 — HN Dev
  7. Anthropic 金融服務 agents:10 個模板 + Opus 4.7 領先 Vals AI 基準 — Anthropic AI
  8. Claude 永久不放廣告:Anthropic 的商業模式聲明 — Anthropic News
  9. Anthropic 與 KPMG 全球策略聯盟:27.6 萬員工配發 Claude — Anthropic News
  10. AI 悖論:自動化越多,反而需要更多人類 — Lenny’s Newsletter AI
  11. Armin Ronacher:AI 生成的 issue 報告正在污染開源 — Simon Willison Dev
  12. Microsoft 釋出原始 DOS 1.x、2.x 完整原始碼 — HN (410 pts) Dev

1. Claude Opus 4.7 GA:軟體工程能力升 13%、視覺輸入升 3 倍#

Anthropic 把 Opus 4.7 全面開放,API ID claude-opus-4-7,定價跟 4.6 同(輸入 $5/M、輸出 $25/M token)。在 93 項軟體工程任務基準上比 4.6 提升 13%,Rakuten 內部測試生產任務解決數翻 3 倍;視覺輸入最大邊支援 2,576 像素(約 375 萬像素,是上一代的 3 倍以上),可吃工程圖、化學式、複雜表格;新增 xhigh 推理等級,控制推理深度與延遲。Bedrock、Vertex AI、Microsoft Foundry 同步上線。

  • 軟體工程基準 93 項任務平均提升 13%
  • 視覺輸入最大邊 2,576px → 化學結構、CAD 圖直接可讀
  • 新 tokenizer 可能讓 token 用量上升 1.0–1.35 倍,預算需重新估

💡 為什麼重要:這不是漸進升級,是 Anthropic「平台化」的引擎——後面五則 Anthropic 公告(Claude Design、金融 agents、KPMG、小企業方案、Stainless)全都建立在 Opus 4.7 之上。對開發者來說,最重要的是「3 倍視覺解析度」直接打開工程圖、設計稿、CAD 圖的場景。

🔗 閱讀原文 | 來源: Anthropic

2. Claude 速率上限加倍 + SpaceX 22 萬顆 GPU 進場#

Pro / Max / Team / Enterprise 用戶五小時速率上限直接 ×2,同時 Pro 和 Max 移除尖峰時段限制。背後的原因是 Anthropic 跟 SpaceX 簽了一筆算力協議——300+ MW 新容量、22 萬顆 NVIDIA GPU、一個月內到位。同期還有 Amazon(年底前 1 GW)、Google/Broadcom(2027 起 5 GW)、Microsoft/NVIDIA/Fluidstack(800 億美元)。

  • SpaceX 算力:300+ MW、22 萬顆 NVIDIA GPU、1 個月內上線
  • Pro / Max 用戶感受最直接:速率加倍 + 無尖峰限制
  • 國際擴展:支援受規管行業需要的「區域內基礎設施」

💡 為什麼重要:Claude Code 的「五小時上限」一直是長期重度用戶的痛點,這次直接 ×2 算是回應社群最大抱怨。SpaceX 進場是更大訊號——AI 算力不再只能從 AWS/Azure/GCP 拿,雲端寡頭壟斷正在被切開。

🔗 閱讀原文 | 來源: Anthropic

3. Claude Design 上線:對話一次出設計稿、原型、Slides#

Anthropic Labs(內部產品實驗室)的第一個正式對外產品。可以讀程式碼庫和設計檔案自動套用 design system,輸入支援文字、DOCX、PPTX、XLSX、參考程式碼、甚至擷取網站元素;輸出可導出 Canva / PDF / PPTX / HTML,或直接交給 Claude Code 接續實作。Brilliant 把原型迭代從 20+ 個 prompt 壓到 2 個,Datadog 把一週的設計週期壓到一次對話。

  • 自動讀程式碼庫套用色彩、字型、元件
  • 設計 → Claude Code 一條龍:把交接環節整個拿掉
  • 預設 Claude Pro/Max/Team/Enterprise 都能用

💡 為什麼重要:設計工具市場(Figma、Canva、Stitch)剛剛多了一個直接威脅。但更關鍵的是「設計到開發」這個歷年最痛的交接環節被打通——產品團隊可以直接從對話走到 Flutter / SwiftUI 程式碼。對 Flutter 開發者來說,這是非常值得監測的趨勢。

🔗 閱讀原文 | 來源: Anthropic Labs

4. Anthropic 收購 Stainless:把 SDK 與 MCP 工具鏈收編#

Stainless 成立於 2022 年,一直是 Anthropic 官方 TypeScript / Python / Go / Java SDK 的生成方,也為數百家其他公司自動產 SDK、CLI、MCP server。Head of Platform Engineering Katelyn Lesse 一句話總結為什麼買:「Agents are only as useful as what they can connect to.」

  • 官方 SDK 自動生成、MCP server 自動產生
  • 跟 OpenAI 的 Responses API + Tools 形成對比:Anthropic 走「連接力」路線
  • 對接生態系:API 開發者進入 Claude agent 的官方路徑被打通

💡 為什麼重要:MCP(Model Context Protocol)是 Anthropic 自己推的標準,收 Stainless 等於把 MCP server 的「自動生成 + 官方化」這條路鋪起來。未來蓋 Claude agent 連外部工具,標準路徑會是 MCP 而非 raw API。對開發者意味著:早點熟悉 MCP server 的寫法是值得投資的。

🔗 閱讀原文 | 來源: Anthropic

5. DeepSeek Reasonix:終端原生編碼 agent,宣稱 99.82% prefix-cache 命中#

HN 上 387 分熱議,10 小時內衝上首頁。號稱用 DeepSeek 原生模型做終端 agent,prefix cache 命中率 99.82%,每回合成本壓到 $0.05 以下。但 HN 留言區也在質疑:這跟 Claude Code + DeepSeek bridge 的差異到底在哪?是真正的架構創新還是包裝?

  • 主打成本:每回合 $0.05 以下、99.82% cache hit
  • DeepSeek 主要走開源路線,正面對 Claude Code / Codex 的商業組合
  • 文件不夠詳細,社群目前是「半信半疑」狀態

💡 為什麼重要:跟 Anthropic 的全平台收編形成反向對照——開源陣營也在做 agent 工具,但成本是核心賣點而非整合度。如果你的 token 預算是限制,DeepSeek + 自包裝的路線值得列入評估清單。

🔗 閱讀原文 | 來源: HN

6. --dangerously-skip-reading-code:AI 生成的程式碼,沒人讀得完#

HN 上 190 分、191 留言的長帖。作者主張:LLM 生成程式碼的速度遠超人類閱讀速度,傳統 code review 流程在 AI coding agent 時代已經破產。他的建議是把 review 嚴謹度從「審程式碼」移到「審 spec 與自動化測試」——Amdahl 定律告訴我們,光是把生成那一段加速,整體流程不會變快,瓶頸會跑去 review。

  • 單一開發者一天 20k 行 AI 程式碼 = 整個團隊讀不完
  • 解法:標準化 Markdown spec + 自動化 PR check + 不靠人工審查
  • 跟 Armin Ronacher 的 AI slop 批評是同一條主軸

💡 為什麼重要:這篇可能是這週 AI coding 討論中最被分享的反思文。對 Claude Code / Cursor 重度用戶來說,是一個需要面對的問題——你的 PR 隊伍是不是已經卡在 review 端?

🔗 閱讀原文 | 來源: HN

7. Anthropic 金融服務 agents:10 個模板 + Opus 4.7 領先 Vals AI 基準#

一次推出 10 個金融服務代理模板:研究、KYC 篩選、月結、Pitchbook 生成等。Opus 4.7 在 Vals AI 的金融代理基準達 64.37%,業界第一。新增 8 個資料連接器(Dun & Bradstreet、Moody’s、Fiscal AI、SS&C Intralinks 等),整合 Microsoft 365 Excel / PowerPoint / Word。Citadel、Goldman Sachs 已部署。

  • 即插即用模板覆蓋前/中/後台
  • Vals AI 金融基準 Opus 4.7 = 64.37%(業界第一)
  • 與 Microsoft 365 整合:直接讀 Excel 出 Pitchbook

💡 為什麼重要:Anthropic 的「垂直行業滲透」策略開始具象化。對台灣金融科技團隊來說是個訊號——AI agent 在金融場景的合規化、流程化模板已經到位。

🔗 閱讀原文 | 來源: Anthropic

8. Claude 永久不放廣告:Anthropic 的商業模式聲明#

罕見的長文表態:Claude 不會走廣告變現路線。理由是 AI 對話涉及高度敏感個人脈絡(睡眠、心理、工程細節),放廣告會把「優化使用者最佳利益」變成「優化廣告投放參與度」。營收來源明列:企業合約、付費訂閱、教育合作、非營利折扣、小型開源模型。

  • 跟潛在會走 ad-supported 路線的 Google Gemini / ChatGPT 形成定位反差
  • 對受規管行業(金融、法律、醫療)採購的訊號意義很強
  • 未來路線:代理商務(用戶授權購買)、第三方工具整合

💡 為什麼重要:在「AI 工具到底會不會變成下一個 Facebook」的長期辯論裡,Anthropic 公開站到「不會」這一邊。這個表態跟 KPMG 聯盟、SpaceX 算力、Stainless 收購是配套的——它在告訴企業客戶:「你可以放心把敏感業務交給我」。

🔗 閱讀原文 | 來源: Anthropic

9. Anthropic 與 KPMG 全球策略聯盟:27.6 萬員工配發 Claude#

KPMG 在 138 個國家、27.6 萬名專業人員全面取得 Claude 存取權。Claude 整合進 KPMG Digital Gateway 客戶平台(稅務、法律服務);KPMG 與 Anthropic 共同開發「Blaze」產品,主打私募股權場景的 Claude Code + 遺留系統現代化。

  • KPMG 稅務副主席:「以前要幾週,現在幾分鐘」
  • 「Blaze」針對私募股權的垂直整合產品
  • 同期也談到網路安全(漏洞檢測 + 修補)合作

💡 為什麼重要:Anthropic 走的不是「賣 API 給開發者」這條路,而是直接讓全球前四大會計師事務所的整個團隊變成 Claude 用戶。這是矽谷 AI 公司從未做過的「自上而下滲透」策略。

🔗 閱讀原文 | 來源: Anthropic

10. AI 悖論:自動化越多,反而需要更多人類#

Every CEO Dan Shipper 在 Lenny’s 上的長訪談,丟出 12 個 AI 時代預測。最核心的論點是「Automation is a lie」——表面被自動化的任務,仍然需要人類監督、判斷、引導方向。新的稀缺職位是 Forward Deployed Engineer(駐場工程師)和全棧設計師。SaaS 不會死,因為使用者會「自帶 token」進 SaaS app,反而推高 SaaS 利潤率。

  • 「The future of work will happen inside Codex or Claude Code」
  • 「I would buy SaaS stocks right now」
  • 「The AI job apocalypse is not happening」

💡 為什麼重要:跟 Armin Ronacher、olano.dev 兩篇湊起來看,這週同時冒出三篇都在強調「AI 工具需要人類審查 / 引導 / 把關」。對團隊主管來說,現在就該開始想「我們的 Forward Deployed Engineer 在哪?」

🔗 閱讀原文 | 來源: Lenny’s Newsletter

11. Armin Ronacher:AI 生成的 issue 報告正在污染開源#

Flask / Jinja 作者罕見地公開抱怨:GitHub 上越來越多 AI 撰寫的 issue 報告——自信但不準確的結論、捏造的最小重現步驟、過度推測的根本原因分析。他懇求回到最基本的格式:「我跑了這個指令、預期結果、實際結果、完整錯誤訊息」。Simon Willison 把它列為這週 AI slop 對開源社群危害的代表案例。

  • 開源維護者第一線的真實痛點
  • 「I ran this command. I expected this to happen. This happened instead. Here is the exact error or log.」
  • 跟 olano.dev 的 dangerously-skip 是同一個故事的另一面

💡 為什麼重要:如果你維護開源專案,這篇是必讀。如果你在用 Claude / Codex 自動提 issue 或 PR,這篇也是必讀——你的「貢獻」可能正在污染對方的工作流。

🔗 閱讀原文 | 來源: Simon Willison

12. Microsoft 釋出原始 DOS 1.x、2.x 完整原始碼#

HN 上 410 分熱議。Microsoft 把 MS-DOS 1.25、2.0 的完整原始碼放上 GitHub(含組合語言原始檔)。歷史意義濃厚——這是 PC 時代最初的作業系統,幾代開發者的「原始記憶」。

  • 完整組合語言原始檔可讀
  • 跟 80386 microcode 反組譯(昨天 HN 熱門)形成「電腦考古學」週
  • 教育價值極高(OS 課程材料)

💡 為什麼重要:對於想理解「電腦最底層怎麼運作」的開發者,這是無價的學習材料。也提醒我們,Microsoft 的開源策略正在持續轉向——這跟 2020 年前的封閉文化已經不一樣。

🔗 閱讀原文 | 來源: HN (410 pts)

推薦閱讀#

大神動態#

  • Dan Shipper:Every CEO 在 Lenny’s Newsletter 訪談中丟出「Automation is a lie」金句(詳見必讀 #10)
  • Armin Ronacher:Flask / Jinja 作者罕見公開批評 AI 生成的 issue 報告污染開源(詳見必讀 #11)
  • Simon Willison:轉貼並整理 Armin Ronacher 的批評為本週 AI slop 代表案例(詳見必讀 #11)
  • Greg Brockman:OpenAI 總裁訪談,HN 163 分(詳見推薦閱讀)

中文技術圈#

開源精選#

  • microsoft/MS-DOS — Assembly | ⭐ 持續增長 | Microsoft 釋出原始 DOS 1.x、2.x 完整原始碼,PC 時代的原始記憶。
  • langgenius/dify — TypeScript | ⭐ 142K | Production-ready agentic workflow 開發平台,持續是 agent 工作流的代表開源項目。
  • langflow-ai/langflow — Python | ⭐ 148K | 視覺化 AI agent 工作流建構工具。
  • firecrawl/firecrawl — TypeScript | ⭐ 123K | AI agent 用的網頁抓取與清理工具。

影音精選#

Theo:Cursor Composer 2.5 壓倒 Claude Code?#

11 小時前 · Theo (t3.gg)

Theo

Cursor 旗下 Codium 發布 Composer 2.5,一款專為程式碼任務優化的小型模型,在內部基準測試上表現驚人。Theo 雖是 Codium 早期投資人,強調此次評測無商業利益,認為主要 AI 實驗室的領先優勢正在受到壓力。影片也提及 SpaceX 收購 Codium 的傳言。

  • Composer 2.5 是專為 code task 訓練的小型專用模型
  • 在 internal benchmark 上接近 Claude Sonnet 4 等級
  • Theo 認為大實驗室的領先距離正在被壓縮
  • SpaceX 收購 Codium 傳言:與 Anthropic-SpaceX 算力協議並列觀察

💬 Yii 的話:跟今日主軸的 Anthropic 收編動作對照看更有意思——AI 編碼工具市場正在進入「中型專業模型」階段,這跟去年「大模型壟斷」的格局已經完全不同。對 Flutter / Mobile 開發者來說,這意味著未來的 IDE agent 不一定要走 Claude / GPT 通用模型,可能會有專為 Dart / Swift 訓練的小型專用模型出現。

20VC:每年淘汰末尾 10%,是頂尖銷售團隊的鐵律#

18 小時前 · 20VC

20VC

20VC 短片:頂尖銷售主管認為每年淘汰末尾 10% 是健康組織的標配,甚至應每季檢視 2.5%。績效高的員工反而歡迎這種文化,因為它彰顯了優秀者的稀缺價值。

  • 末尾 10% 年度淘汰 = 健康文化標配
  • 高績效員工歡迎這種文化(強者效應)
  • 與前 Snowflake CRO Chris Degnan 的世界級銷售方法論連動

💬 Yii 的話:這集是 Anthropic 跟 20VC 此前那集「Anthropic 高薪搶人」的續集——薪資危機之外,更殘酷的是這種「績效淘汰」文化也在 AI 時代被重新搬上檯面。對台灣團隊來說,文化嫁接時要小心。

今日觀察#

Anthropic 把九件事壓在一週裡放出,這不是巧合而是策略——它在告訴市場:我不再只是一家「模型公司」。Opus 4.7 是底層引擎、Claude Design 是視覺層、Stainless 是 SDK / MCP 工具鏈、SpaceX 是算力後盾、KPMG 是滲透通路、金融 agents 是垂直行業模板、Blackstone 合資公司是中端市場入口、Small Business 方案是長尾市場、Claude 永久不放廣告則是品牌定位。但反差是:就在同一週,olano.dev 的 “—dangerously-skip-reading-code” 衝上 HN 190 分、Armin Ronacher 罕見公開批評 AI slop 在污染開源、Lenny’s 上 Dan Shipper 投下「自動化是個謊言」 這種長期觀點文。加速最快的玩家在做平台收編,懷疑最深的聲音在同一週浮上水面——對個別開發者來說,這個分裂值得記下來:未來最稀缺的不是會寫 prompt 的人,是知道「什麼東西不該交給 agent」的人。


覺得有用嗎?分享給一個也在追蹤新知的朋友。

也歡迎中長期投資者體驗新工具 → Moniit banner

同期還有