yii.
← Digest
EP37 · 2026年4月7日 星期二 · 9 min read

信任

你用的 AI 工具,背後的人值得信任嗎?

每天花 1% 的時間,掌握科技脈動。

今日金句#

“I don’t think Sam is the guy who should have his finger on the button.” 「我不認為 Sam 是那個應該手握按鈕的人。」 — Ilya Sutskever, OpenAI 前首席科學家

“The reality is we can now all live in a little bit more chaos because the AI navigates all that information for us across systems.” 「現實是,我們現在可以容許更多混亂,因為 AI 替我們在系統之間導航所有資訊。」 — Claire Vo, How I AI 播客主持人

“When the model is capable enough, most failures stop being intelligence failures and start being context failures.” 「當模型夠強大時,大多數失敗不再是智慧的失敗,而是上下文的失敗。」 — ByteByteGo

今日主軸#

今天的科技圈有一個貫穿所有頭條的主題:信任。New Yorker 發表長篇調查報導,揭露 Ilya Sutskever 在 2023 年就寫密件給董事會,質疑 Sam Altman 是否值得掌控 AI 的未來。與此同時,Cursor 3.0 用 Rust 重寫拋棄 VS Code,Fireship 的影片衝到 49 萬觀看——但隨即爆出他們的 Composer 2 模型其實是 Moonshot 的 Kimi K2,因為資訊不透明公開道歉。反觀 Google,一週內不但讓 Gemma 4 衝到 200 萬下載,還推出官方 iPhone App 讓你本地跑模型——用行動證明開源的信任。Google Stitch 更在 14 秒內生成五個完整 App 畫面,讓 Figma 股價跌了 8.8%。從 AI 實驗室的治理到工具的透明度,今天的問題不是「AI 能做什麼」,而是「你信不信它背後的人」。

必讀#

  1. Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議 — YouTube/Fireship Dev
  2. Sam Altman 掌控我們的未來——他值得信任嗎? — New Yorker AI
  3. Claude Code 吃進整個程式庫,客戶有感 — Lenny’s Newsletter AI
  4. Claude Code 已無法使用?Anthropic 系統提示爭議 — YouTube/Theo Dev
  5. OpenClaude:支援 200+ 模型的開源 Coding Agent — GitHub Tools
  6. Gemma 4 首週下載突破 200 萬次 — Latent Space AI
  7. Google AI Edge Gallery:iPhone 本地跑 Gemma 4 — Simon Willison AI
  8. Google Stitch:免費 AI 設計工具,14 秒生成完整 App UI — Blog Tools
  9. Import AI 452:AI 資安能力每 5.7 個月翻倍 — Import AI AI
  10. LLM Context Engineering 完全指南 — ByteByteGo Dev

Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議#

Cursor 3.0 完全以 Rust 重寫,不再是 VS Code 的 fork。新界面專注於管理 AI agent 群,開發者扮演「空中交通管制員」角色,同時調度多個 repo 和雲端機器。然而發布後立即爆出爭議——新推出的 Composer 2 模型被宣稱超越 Claude Opus,實際上是基於 Moonshot 的 Kimi K2 模型,Cursor 因資訊不透明公開道歉。

  • 完全脫離 VS Code 生態,用 Rust 重寫整個 IDE
  • Composer 2 模型實為 Kimi K2,被社群抓包後道歉
  • 新界面讓開發者同時管理多個 AI agent 在不同 repo 工作

💡 為什麼重要:AI IDE 的競爭已從「誰的 AI 更聰明」轉向「誰的架構最適合 agent 時代」。但 Cursor 的模型透明度事件提醒我們——工具再強大,信任才是基礎。

🔗 觀看影片 | 來源: Fireship · 494K views · 1 天前


Sam Altman 掌控我們的未來——他值得信任嗎?#

New Yorker 發表由 Ronan Farrow 和 Andrew Marantz 撰寫的深度調查報導。揭露 Ilya Sutskever 在 2023 年秋天寫密件給 OpenAI 董事會,質疑 Sam Altman 是否值得在超智慧 AI 時代掌握決策權。報導重新檢視 2023 年的解雇與復職事件,指出安全團隊資源分配與公開承諾之間的落差。

  • Sutskever 密件原文首次曝光——「我不認為 Sam 是那個應該手握按鈕的人」
  • 超級對齊團隊被指資源不足,與 OpenAI 公開承諾存在落差
  • 調查提出核心問題:當 AI 能力接近超智慧,實驗室的治理結構是否足夠

💡 為什麼重要:隨著 AI 能力加速成長,掌控前沿實驗室的人的可信度不再只是內部治理問題,而是影響整個產業和社會的公共議題。開發者社群超過 600 則留言的熱度說明了一切。

🔗 閱讀原文 | 來源: New Yorker


Claude Code 吃進整個程式庫,客戶有感#

Galileo 的現場工程師 Al Chen 分享如何用 Claude Code 同時查詢 15 個 repo,結合 Confluence 文件和 Slack 的 MCP 資料,直接回答企業客戶的高度技術問題。他用一支 16 行腳本每天拉取最新主線分支,讓客戶支援團隊幾乎不需要打擾工程師。

  • Claude Code 跨 15 個 repo 查詢,回答多服務串接的部署問題
  • 程式碼比文件更可靠——直接看 code 的答案比查 docs 更準確
  • 單次解答可轉化為可擴充的知識庫,系統性降低工程師被打斷的頻率

💡 為什麼重要:這是 Claude Code 從「寫程式」到「理解整個系統」的典範轉移。對任何有複雜微服務架構的團隊,這個工作流直接削減了客服對工程團隊的依賴。

🔗 閱讀原文 | 來源: Lenny’s Newsletter


Claude Code 已無法使用?Anthropic 系統提示爭議#

Theo 指出 Anthropic 最近的行為讓 Claude Code 變得難以使用——在系統提示中提到特定關鍵字就會導致 API 請求被拒絕。他每月支付 200 美元,對無預警的限制感到憤怒。影片同時討論了 Anthropic 對系統提示的種種限制對依賴 Claude Code 進行日常開發的開發者造成的衝擊。

  • 提到特定關鍵字就觸發 API 拒絕,付費用戶受波及
  • Anthropic 的政策變更缺乏透明溝通
  • 開發者社群反彈——信任成本比訂閱費用更高

💡 為什麼重要:當付費用戶因為平台的商業決策而工作流中斷,這不只是技術問題,而是信任危機。

🔗 觀看影片 | 來源: Theo · 158K views · 2 天前


OpenClaude:支援 200+ 模型的開源 Coding Agent#

OpenClaude 是開源版 Claude Code 替代品,支援 OpenAI、Gemini、GitHub Models、Ollama 等 200+ 模型的 CLI。核心功能包括 bash、file tools、grep、MCP、streaming output。支援 Agent routing——不同 agent 可使用不同模型和供應商以優化成本。一週內衝到 18.5K GitHub stars。

  • 單一 CLI 支援雲端 API 和本地模型,provider-agnostic
  • Agent routing 允許按任務分配模型(研究用便宜模型,規劃用強模型)
  • Headless gRPC 模式可嵌入 CI/CD pipeline

💡 為什麼重要:解決了 AI coding tool 的 vendor lock-in 問題。當一個供應商的政策變更讓你無法工作,OpenClaude 提供了逃生出口。

🔗 查看專案 | 來源: GitHub · ⭐ 18.5K


Gemma 4 首週下載突破 200 萬次#

Google 的 Gemma 4 在發布首週達到 200 萬次下載。Gemma 4 E2B 在 iPhone 上透過 MLX 達到約 40 tokens/sec 的推理速度。HuggingFace、vLLM、Ollama、NVIDIA 等生態系同步支援。開源模型正在壓縮雲端訂閱模型的利潤空間。

  • 首週 200 萬下載,遠超 Gemma 3 一年的 670 萬下載速度
  • 消費級硬體(iPhone)上的推理速度已達實用水準
  • 開源模型從「堪用」走向「首選」

💡 為什麼重要:當你可以在手機上免費跑一個夠好的模型,每月付 $20-$200 訂閱費的價值主張就需要重新定義了。

🔗 閱讀原文 | 來源: Latent Space


Google AI Edge Gallery:iPhone 本地跑 Gemma 4#

Google 推出官方 iPhone 應用,可在裝置上直接執行 Gemma 4 的 E2B(2.54GB)和 E4B 模型,支援圖片問答和 30 秒語音轉文字。App 提供 8 種工具呼叫展示(地圖、維基百科、QR Code 等)。這是首次大型 AI 實驗室為自家模型推出官方消費級 iOS App。

  • 首家主要 AI 實驗室推出官方 iOS 本地推理 App
  • E2B 模型僅 2.54GB,速度快且實用
  • 支援工具呼叫的互動展示——本地 AI agent 的雛形

💡 為什麼重要:Google 官方背書本地推理,而非推動用戶使用雲端 API。這是 on-device AI 從概念到產品的里程碑。

🔗 閱讀原文 | 來源: Simon Willison


Google Stitch:免費 AI 設計工具,14 秒生成完整 App UI#

Google Stitch 是免費的 Labs 工具,用一句話描述就能在 14 秒內生成多個高保真 App 畫面。四種設計模型產生不同美學方向,具備刻意的排版、一致的配色系統和元件層級。測試者直呼「關掉 Figma」。Stitch 三月更新後,Figma 市值下跌 8.8%。

  • 14 秒生成五個完整畫面——不是線框圖,是有設計系統的高保真 UI
  • 免費(Google Labs),直接衝擊 v0/Lovable/Bolt/Figma 的市場
  • 支援語音編輯和無限畫布,設計工作流從零開始變成從 80 分開始修

💡 為什麼重要:Vibe design 已經到來。就像 vibe coding 改變了寫程式的方式,Stitch 正在改變設計的起點。對獨立開發者和小團隊,這是設計民主化的關鍵一步。

🔗 閱讀原文 | 來源: Blog


Import AI 452:AI 資安能力每 5.7 個月翻倍#

Lyptus Research 發現 AI 網路攻擊能力存在明確的 scaling law——前沿模型的翻倍時間約 5.7 個月。最新的 GPT-5.3 Codex 和 Opus 4.6 在 50% 的情況下能完成需要人類專家 3 小時以上的攻擊任務。開源模型僅落後 5.7 個月,攻擊能力擴散極快。

  • AI 資安攻擊能力每 5.7 個月翻倍,速度驚人
  • 開源模型僅落後 5.7 個月,攻擊能力擴散極快
  • MIT 研究預計 2029 年前 80-95% 文字型工作可被 AI 高度自動化

💡 為什麼重要:AI 是「everything machine」——能力提升同時放大了好與壞。防禦端必須維持至少 6 個月以上的領先。

🔗 閱讀原文 | 來源: Import AI


LLM Context Engineering 完全指南#

ByteByteGo 深度解析為何「更多上下文不等於更好」。Chroma 的研究發現所有 18 個前沿模型的準確率都會在輸入長度超過臨界值後下降。文章介紹四大策略:Write(外部記憶)、Select(RAG)、Compress(摘要)、Isolate(多 agent 分工)。Anthropic 的研究顯示多 agent 系統改善 90.2%。

  • 更多 Token 不等於更好——LLM 注意力呈二次方成長,中間位置資訊容易被忽略
  • 四大策略框架:Write / Select / Compress / Isolate
  • 多 agent 系統比單 agent 改善 90.2%

💡 為什麼重要:當模型夠強時,大多數失敗不再是智慧的失敗,而是上下文的失敗。這篇是每個做 AI 應用的開發者都該讀的指南。

🔗 閱讀原文 | 來源: ByteByteGo


11. ChatGPT 每週處理 200 萬則健保諮詢 — 每週 200 萬健保諮詢,60 萬來自醫療沙漠地區,七成發生在非上班時間。AI 正在填補醫療可及性缺口。

12. Freestyle:Coding Agent 專用沙箱,700ms 啟動 — 完整 Linux VM 專為 AI agent 設計,700ms 啟動、Live forking、暫停時零成本。Agent 基礎設施正在成形。

13. 密碼學工程師觀點:量子運算威脅 33 個月內到來 — Google 論文將破解 256-bit ECC 的需求降至「分鐘內完成」。2029 年期限,從「也許十年後」壓縮到 33 個月。

14. Bash 不夠用了?讓 AI Agent 執行 TypeScript — Theo 提出 bash 不是 agent 最佳執行媒介,TypeScript 更具表達力。GPT 5.4 已針對 JS 執行模式訓練。

15. Ghost Pepper:macOS 完全本地語音轉文字 — 100% 本地,Whisper + Qwen 3.5 做智慧清理,免費。「其他 app 募了 8000 萬做的事,我們免費。」

16. MemPalace:96.6% 準確率的 AI 記憶系統 — 30 倍壓縮零資訊損失,喚醒僅 170 tokens,年成本 $0.70。完全本地。

17. Sora 2 下架:每天燒百萬美元,留存率趨近零 — Sora 2 上線六個月被砍,核心人才流向 Google DeepMind。OpenAI 轉向超級應用策略。

18. Caveman:Claude Code Skill 省 65% Token — 65% 輸出壓縮同時提升準確度 26 百分點。研究證實:簡潔不是妥協,是優化。

19. Vibe Coding in 2026:從寫程式到指揮程式 — 開發者角色從 code writer 轉為 code director。影響招聘、code review、團隊文化。

20. Graphify:把程式碼變成可查詢的知識圖譜 — 任何資料夾→知識圖譜,支援多個 AI coding assistant。一週 4.3K stars。

社群熱門#

推薦閱讀#

中文技術圈#

Gitlawb/openclaude — TypeScript | ⭐ 18.5K 開源 Claude Code 替代品,支援 200+ 模型

santifer/career-ops — JavaScript | ⭐ 14.1K AI 求職系統,14 種技能模式,Go dashboard

emdash-cms/emdash — TypeScript | ⭐ 8.0K 基於 Astro 的全端 CMS,WordPress 精神繼承者

HKUDS/OpenHarness — Python | ⭐ 6.9K 開源 Agent 評測框架

milla-jovovich/mempalace — Python | ⭐ 6.5K 96.6% 準確率的 AI 記憶系統,完全本地

JuliusBrussee/caveman — Python | ⭐ 5.1K Claude Code Skill,省 65% token

safishamsi/graphify — Python | ⭐ 4.3K 程式碼/文件/圖片轉可查詢知識圖譜

0xGF/boneyard — TypeScript | ⭐ 3.3K 自動生成 skeleton loading 框架

alchaincyf/nuwa-skill — ⭐ 2.3K 蒸馏任何人的思維方式和心智模型

maaslalani/sheets — Go | ⭐ 1.5K 終端機試算表工具

影音精選#

Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議#

Fireship

494K views · 1 天前

Cursor 完全以 Rust 重寫脫離 VS Code 生態,新界面專注管理 AI agent 群。但 Composer 2 模型被揭露實為 Moonshot 的 Kimi K2,引發信任爭議。

  • 從 VS Code fork 到完全 Rust 重寫——AI IDE 的架構革命
  • Kimi K2 模型冒名事件揭露 AI 工具供應鏈的透明度問題
  • 新的「空中交通管制員」開發模式正在成形

💬 信任是基礎。當你的 IDE 對你隱瞞它背後用什麼模型,那個 200 美元的月費買的不只是功能——還有誠實。


Claude Code 已無法使用?Anthropic 系統提示爭議#

Theo

158K views · 2 天前

Theo 揭露 Anthropic 限制系統提示中特定關鍵字導致 API 請求被拒。付費用戶工作流中斷,社群反彈。

  • 平台政策變更無預警影響付費用戶的日常開發
  • 開發者對 AI 工具供應商的信任正在被考驗

💬 Theo 的憤怒有道理。你付了錢,結果你的工作流因為供應商的商業決策被打斷——這不是 bug,是信任問題。


Bash 不夠用了?讓 AI Agent 執行 TypeScript#

Theo

15.5K views · 7 小時前

Theo 分析 AI agent 的執行層進化:從 bash 到 TypeScript,agent 的表達力和偵錯能力大幅提升。

  • GPT 5.4 已針對 JS 執行模式特化訓練
  • 從模擬點擊到直接操控——agent 能力邊界持續擴張

💬 Agent 要做事,給它更好的工具很合理。TypeScript 比 bash 更適合表達複雜邏輯——就像你不會用螺絲起子敲釘子。


OpenAI Sora 2 下架:錯誤產品的代價與轉型#

硅谷101

1.9K views · 9 小時前

Sora 2 上線六個月後被砍,每天燒掉百萬美元算力,留存率趨近零。OpenAI 轉向超級應用策略。

  • 技術能力和產品市場契合度是兩回事
  • 核心人才 Tim Brooks 被 Google DeepMind 挖走

💬 不是所有 AI 產品都能成功。Sora 的教訓:最酷的技術不等於最好的產品。


Lindy AI:住在 iMessage 裡的 AI 執行助理#

Greg Isenberg

11.8K views · 1 天前

Lindy Assistant 住在 iMessage,連接 100+ 工具,主動偵測機會。不需指令,它會主動發行程摘要、草擬回覆、重新安排約會。

  • 創辦人定位為 iPhone 級別的「零設定」AI 體驗
  • 起始定價 $49/月

💬 AI 助理不該是你要記得去問的東西——它應該主動告訴你。Lindy 的 iMessage 整合是對的方向。


BillionToOne:從血液中偵測癌症的生技革命#

Y Combinator

5.9K views · 1 天前

從兩個 PhD 學生起家,到美國使用最廣泛的產前基因檢測,每年 60 萬次測試。40 億美元估值上市,正轉向早期癌症偵測。

  • 核心技術:在數十億鹼基對中尋找單一差異
  • MRD 癌症偵測測試預計不到一年上市

💬 不是所有有意義的 AI 應用都在寫程式碼。生技結合 AI 的潛力才剛開始。

名人動態#

  • Ilya Sutskever: 密件內容在 New Yorker 調查中首次曝光——質疑 Sam Altman 是否值得掌控 AI 未來。詳見必讀 #2
  • Simon Willison: 本日產出密集——Google AI Edge Gallery 評測、ChatGPT 健保數據引用、datasette-ports、scan-for-secrets、Cleanup Claude Code Paste 等多個工具更新
  • Sam Altman: New Yorker 深度調查報導的主角,開發者社群超過 600 則留言
  • Jack Clark: Import AI 452 分析 AI 資安能力的 scaling law,指出 AI 是「everything machine」
  • Theo (t3.gg): 兩支影片——Claude Code 爭議(158K views)+ Bash vs TypeScript for agents(15.5K views)

今日觀察#

今天的科技圈出現了一個有趣的弔詭:AI 工具越來越強大,但開發者對這些工具背後的組織的信任卻在下降。Cursor 因為模型透明度問題道歉,Anthropic 因為限制政策流失付費用戶的好感,OpenAI 的創辦團隊內部矛盾被端上檯面。與此同時,開源和本地優先的方案——OpenClaude、Gemma 4、Ghost Pepper、MemPalace——正在吸收這些信任危機所釋放的需求。開發者似乎正在用下載數投票:與其信任一個公司的承諾,不如信任自己能跑的程式碼。


覺得有用嗎?分享給一個也在追蹤新知的朋友。

也歡迎中長期投資者體驗新工具 → Moniit banner

同期還有