信任
你用的 AI 工具,背後的人值得信任嗎?
每天花 1% 的時間,掌握科技脈動。
今日金句#
“I don’t think Sam is the guy who should have his finger on the button.” 「我不認為 Sam 是那個應該手握按鈕的人。」 — Ilya Sutskever, OpenAI 前首席科學家
“The reality is we can now all live in a little bit more chaos because the AI navigates all that information for us across systems.” 「現實是,我們現在可以容許更多混亂,因為 AI 替我們在系統之間導航所有資訊。」 — Claire Vo, How I AI 播客主持人
“When the model is capable enough, most failures stop being intelligence failures and start being context failures.” 「當模型夠強大時,大多數失敗不再是智慧的失敗,而是上下文的失敗。」 — ByteByteGo
今日主軸#
今天的科技圈有一個貫穿所有頭條的主題:信任。New Yorker 發表長篇調查報導,揭露 Ilya Sutskever 在 2023 年就寫密件給董事會,質疑 Sam Altman 是否值得掌控 AI 的未來。與此同時,Cursor 3.0 用 Rust 重寫拋棄 VS Code,Fireship 的影片衝到 49 萬觀看——但隨即爆出他們的 Composer 2 模型其實是 Moonshot 的 Kimi K2,因為資訊不透明公開道歉。反觀 Google,一週內不但讓 Gemma 4 衝到 200 萬下載,還推出官方 iPhone App 讓你本地跑模型——用行動證明開源的信任。Google Stitch 更在 14 秒內生成五個完整 App 畫面,讓 Figma 股價跌了 8.8%。從 AI 實驗室的治理到工具的透明度,今天的問題不是「AI 能做什麼」,而是「你信不信它背後的人」。
必讀#
- Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議 — YouTube/Fireship
Dev - Sam Altman 掌控我們的未來——他值得信任嗎? — New Yorker
AI - Claude Code 吃進整個程式庫,客戶有感 — Lenny’s Newsletter
AI - Claude Code 已無法使用?Anthropic 系統提示爭議 — YouTube/Theo
Dev - OpenClaude:支援 200+ 模型的開源 Coding Agent — GitHub
Tools - Gemma 4 首週下載突破 200 萬次 — Latent Space
AI - Google AI Edge Gallery:iPhone 本地跑 Gemma 4 — Simon Willison
AI - Google Stitch:免費 AI 設計工具,14 秒生成完整 App UI — Blog
Tools - Import AI 452:AI 資安能力每 5.7 個月翻倍 — Import AI
AI - LLM Context Engineering 完全指南 — ByteByteGo
Dev
Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議#

Cursor 3.0 完全以 Rust 重寫,不再是 VS Code 的 fork。新界面專注於管理 AI agent 群,開發者扮演「空中交通管制員」角色,同時調度多個 repo 和雲端機器。然而發布後立即爆出爭議——新推出的 Composer 2 模型被宣稱超越 Claude Opus,實際上是基於 Moonshot 的 Kimi K2 模型,Cursor 因資訊不透明公開道歉。
- 完全脫離 VS Code 生態,用 Rust 重寫整個 IDE
- Composer 2 模型實為 Kimi K2,被社群抓包後道歉
- 新界面讓開發者同時管理多個 AI agent 在不同 repo 工作
💡 為什麼重要:AI IDE 的競爭已從「誰的 AI 更聰明」轉向「誰的架構最適合 agent 時代」。但 Cursor 的模型透明度事件提醒我們——工具再強大,信任才是基礎。
🔗 觀看影片 | 來源: Fireship · 494K views · 1 天前
Sam Altman 掌控我們的未來——他值得信任嗎?#

New Yorker 發表由 Ronan Farrow 和 Andrew Marantz 撰寫的深度調查報導。揭露 Ilya Sutskever 在 2023 年秋天寫密件給 OpenAI 董事會,質疑 Sam Altman 是否值得在超智慧 AI 時代掌握決策權。報導重新檢視 2023 年的解雇與復職事件,指出安全團隊資源分配與公開承諾之間的落差。
- Sutskever 密件原文首次曝光——「我不認為 Sam 是那個應該手握按鈕的人」
- 超級對齊團隊被指資源不足,與 OpenAI 公開承諾存在落差
- 調查提出核心問題:當 AI 能力接近超智慧,實驗室的治理結構是否足夠
💡 為什麼重要:隨著 AI 能力加速成長,掌控前沿實驗室的人的可信度不再只是內部治理問題,而是影響整個產業和社會的公共議題。開發者社群超過 600 則留言的熱度說明了一切。
🔗 閱讀原文 | 來源: New Yorker
Claude Code 吃進整個程式庫,客戶有感#

Galileo 的現場工程師 Al Chen 分享如何用 Claude Code 同時查詢 15 個 repo,結合 Confluence 文件和 Slack 的 MCP 資料,直接回答企業客戶的高度技術問題。他用一支 16 行腳本每天拉取最新主線分支,讓客戶支援團隊幾乎不需要打擾工程師。
- Claude Code 跨 15 個 repo 查詢,回答多服務串接的部署問題
- 程式碼比文件更可靠——直接看 code 的答案比查 docs 更準確
- 單次解答可轉化為可擴充的知識庫,系統性降低工程師被打斷的頻率
💡 為什麼重要:這是 Claude Code 從「寫程式」到「理解整個系統」的典範轉移。對任何有複雜微服務架構的團隊,這個工作流直接削減了客服對工程團隊的依賴。
🔗 閱讀原文 | 來源: Lenny’s Newsletter
Claude Code 已無法使用?Anthropic 系統提示爭議#

Theo 指出 Anthropic 最近的行為讓 Claude Code 變得難以使用——在系統提示中提到特定關鍵字就會導致 API 請求被拒絕。他每月支付 200 美元,對無預警的限制感到憤怒。影片同時討論了 Anthropic 對系統提示的種種限制對依賴 Claude Code 進行日常開發的開發者造成的衝擊。
- 提到特定關鍵字就觸發 API 拒絕,付費用戶受波及
- Anthropic 的政策變更缺乏透明溝通
- 開發者社群反彈——信任成本比訂閱費用更高
💡 為什麼重要:當付費用戶因為平台的商業決策而工作流中斷,這不只是技術問題,而是信任危機。
🔗 觀看影片 | 來源: Theo · 158K views · 2 天前
OpenClaude:支援 200+ 模型的開源 Coding Agent#
OpenClaude 是開源版 Claude Code 替代品,支援 OpenAI、Gemini、GitHub Models、Ollama 等 200+ 模型的 CLI。核心功能包括 bash、file tools、grep、MCP、streaming output。支援 Agent routing——不同 agent 可使用不同模型和供應商以優化成本。一週內衝到 18.5K GitHub stars。
- 單一 CLI 支援雲端 API 和本地模型,provider-agnostic
- Agent routing 允許按任務分配模型(研究用便宜模型,規劃用強模型)
- Headless gRPC 模式可嵌入 CI/CD pipeline
💡 為什麼重要:解決了 AI coding tool 的 vendor lock-in 問題。當一個供應商的政策變更讓你無法工作,OpenClaude 提供了逃生出口。
🔗 查看專案 | 來源: GitHub · ⭐ 18.5K
Gemma 4 首週下載突破 200 萬次#

Google 的 Gemma 4 在發布首週達到 200 萬次下載。Gemma 4 E2B 在 iPhone 上透過 MLX 達到約 40 tokens/sec 的推理速度。HuggingFace、vLLM、Ollama、NVIDIA 等生態系同步支援。開源模型正在壓縮雲端訂閱模型的利潤空間。
- 首週 200 萬下載,遠超 Gemma 3 一年的 670 萬下載速度
- 消費級硬體(iPhone)上的推理速度已達實用水準
- 開源模型從「堪用」走向「首選」
💡 為什麼重要:當你可以在手機上免費跑一個夠好的模型,每月付 $20-$200 訂閱費的價值主張就需要重新定義了。
🔗 閱讀原文 | 來源: Latent Space
Google AI Edge Gallery:iPhone 本地跑 Gemma 4#

Google 推出官方 iPhone 應用,可在裝置上直接執行 Gemma 4 的 E2B(2.54GB)和 E4B 模型,支援圖片問答和 30 秒語音轉文字。App 提供 8 種工具呼叫展示(地圖、維基百科、QR Code 等)。這是首次大型 AI 實驗室為自家模型推出官方消費級 iOS App。
- 首家主要 AI 實驗室推出官方 iOS 本地推理 App
- E2B 模型僅 2.54GB,速度快且實用
- 支援工具呼叫的互動展示——本地 AI agent 的雛形
💡 為什麼重要:Google 官方背書本地推理,而非推動用戶使用雲端 API。這是 on-device AI 從概念到產品的里程碑。
🔗 閱讀原文 | 來源: Simon Willison
Google Stitch:免費 AI 設計工具,14 秒生成完整 App UI#

Google Stitch 是免費的 Labs 工具,用一句話描述就能在 14 秒內生成多個高保真 App 畫面。四種設計模型產生不同美學方向,具備刻意的排版、一致的配色系統和元件層級。測試者直呼「關掉 Figma」。Stitch 三月更新後,Figma 市值下跌 8.8%。
- 14 秒生成五個完整畫面——不是線框圖,是有設計系統的高保真 UI
- 免費(Google Labs),直接衝擊 v0/Lovable/Bolt/Figma 的市場
- 支援語音編輯和無限畫布,設計工作流從零開始變成從 80 分開始修
💡 為什麼重要:Vibe design 已經到來。就像 vibe coding 改變了寫程式的方式,Stitch 正在改變設計的起點。對獨立開發者和小團隊,這是設計民主化的關鍵一步。
🔗 閱讀原文 | 來源: Blog
Import AI 452:AI 資安能力每 5.7 個月翻倍#

Lyptus Research 發現 AI 網路攻擊能力存在明確的 scaling law——前沿模型的翻倍時間約 5.7 個月。最新的 GPT-5.3 Codex 和 Opus 4.6 在 50% 的情況下能完成需要人類專家 3 小時以上的攻擊任務。開源模型僅落後 5.7 個月,攻擊能力擴散極快。
- AI 資安攻擊能力每 5.7 個月翻倍,速度驚人
- 開源模型僅落後 5.7 個月,攻擊能力擴散極快
- MIT 研究預計 2029 年前 80-95% 文字型工作可被 AI 高度自動化
💡 為什麼重要:AI 是「everything machine」——能力提升同時放大了好與壞。防禦端必須維持至少 6 個月以上的領先。
🔗 閱讀原文 | 來源: Import AI
LLM Context Engineering 完全指南#

ByteByteGo 深度解析為何「更多上下文不等於更好」。Chroma 的研究發現所有 18 個前沿模型的準確率都會在輸入長度超過臨界值後下降。文章介紹四大策略:Write(外部記憶)、Select(RAG)、Compress(摘要)、Isolate(多 agent 分工)。Anthropic 的研究顯示多 agent 系統改善 90.2%。
- 更多 Token 不等於更好——LLM 注意力呈二次方成長,中間位置資訊容易被忽略
- 四大策略框架:Write / Select / Compress / Isolate
- 多 agent 系統比單 agent 改善 90.2%
💡 為什麼重要:當模型夠強時,大多數失敗不再是智慧的失敗,而是上下文的失敗。這篇是每個做 AI 應用的開發者都該讀的指南。
🔗 閱讀原文 | 來源: ByteByteGo
11. ChatGPT 每週處理 200 萬則健保諮詢 — 每週 200 萬健保諮詢,60 萬來自醫療沙漠地區,七成發生在非上班時間。AI 正在填補醫療可及性缺口。
12. Freestyle:Coding Agent 專用沙箱,700ms 啟動 — 完整 Linux VM 專為 AI agent 設計,700ms 啟動、Live forking、暫停時零成本。Agent 基礎設施正在成形。
13. 密碼學工程師觀點:量子運算威脅 33 個月內到來 — Google 論文將破解 256-bit ECC 的需求降至「分鐘內完成」。2029 年期限,從「也許十年後」壓縮到 33 個月。
14. Bash 不夠用了?讓 AI Agent 執行 TypeScript — Theo 提出 bash 不是 agent 最佳執行媒介,TypeScript 更具表達力。GPT 5.4 已針對 JS 執行模式訓練。
15. Ghost Pepper:macOS 完全本地語音轉文字 — 100% 本地,Whisper + Qwen 3.5 做智慧清理,免費。「其他 app 募了 8000 萬做的事,我們免費。」
16. MemPalace:96.6% 準確率的 AI 記憶系統 — 30 倍壓縮零資訊損失,喚醒僅 170 tokens,年成本 $0.70。完全本地。
17. Sora 2 下架:每天燒百萬美元,留存率趨近零 — Sora 2 上線六個月被砍,核心人才流向 Google DeepMind。OpenAI 轉向超級應用策略。
18. Caveman:Claude Code Skill 省 65% Token — 65% 輸出壓縮同時提升準確度 26 百分點。研究證實:簡潔不是妥協,是優化。
19. Vibe Coding in 2026:從寫程式到指揮程式 — 開發者角色從 code writer 轉為 code director。影響招聘、code review、團隊文化。
20. Graphify:把程式碼變成可查詢的知識圖譜 — 任何資料夾→知識圖譜,支援多個 AI coding assistant。一週 4.3K stars。
社群熱門#

- AI 產生的程式碼超載危機 — NYT 報導 AI 工具產生大量未審查程式碼,企業爭相建立審查機制
- Anthropic 封殺 OpenClaw 第三方工具存取 — Claude 計畫現需額外付費使用第三方 agent 工具
- Claude Code 原始碼洩露:Undercover AI Agent + 語音模式曝光 — 50 萬行原始碼揭露隱形 AI agent 和語音模式開發中
- 1.5M AI Agent 已被創建 — 自主 AI 正在重寫工作規則 — 到 2026 年 2 月,單一平台上已創建 150 萬個 AI agent
- Claude Opus 4.6 登頂 SWE-bench 80.8% — 超越 GPT-5.4 和 Gemini 3.1 Pro
推薦閱讀#

- Lindy AI:住在 iMessage 裡的 AI 執行助理 — 兩分鐘設定,連接 Gmail、行事曆、Slack 等 100+ 工具,主動偵測機會。$49/月起
- career-ops:AI 求職系統 — 14 種技能模式、Go dashboard、PDF 生成、批次處理。14.1K stars
- EmDash:TypeScript 全端 CMS — 基於 Astro 的 WordPress 精神繼承者。8K stars
- OpenHarness:開源 Agent 評測框架 — 標準化 AI agent 的評估流程。6.9K stars
- Bifrost CLI:一個介面使用 Claude Code + Gemini + Codex — 統一終端介面管理多個 AI coding 工具
中文技術圈#

- Claude Code 資料外洩事件追蹤 — iThome 持續追蹤 Claude Code 外洩事件的影響和後續發展
- Android Studio Agent 管理新功能 — Google 在 Android Studio 中加入 AI agent 管理介面
- 截圖管理工具推薦 — 少數派整理高效截圖管理工作流
開源精選 — GitHub Trending (本週)#
Gitlawb/openclaude — TypeScript | ⭐ 18.5K 開源 Claude Code 替代品,支援 200+ 模型
santifer/career-ops — JavaScript | ⭐ 14.1K AI 求職系統,14 種技能模式,Go dashboard
emdash-cms/emdash — TypeScript | ⭐ 8.0K 基於 Astro 的全端 CMS,WordPress 精神繼承者
HKUDS/OpenHarness — Python | ⭐ 6.9K 開源 Agent 評測框架
milla-jovovich/mempalace — Python | ⭐ 6.5K 96.6% 準確率的 AI 記憶系統,完全本地
JuliusBrussee/caveman — Python | ⭐ 5.1K Claude Code Skill,省 65% token
safishamsi/graphify — Python | ⭐ 4.3K 程式碼/文件/圖片轉可查詢知識圖譜
0xGF/boneyard — TypeScript | ⭐ 3.3K 自動生成 skeleton loading 框架
alchaincyf/nuwa-skill — ⭐ 2.3K 蒸馏任何人的思維方式和心智模型
maaslalani/sheets — Go | ⭐ 1.5K 終端機試算表工具
影音精選#
Cursor 3.0 拋棄 VS Code,用 Rust 重寫引爭議#
494K views · 1 天前
Cursor 完全以 Rust 重寫脫離 VS Code 生態,新界面專注管理 AI agent 群。但 Composer 2 模型被揭露實為 Moonshot 的 Kimi K2,引發信任爭議。
- 從 VS Code fork 到完全 Rust 重寫——AI IDE 的架構革命
- Kimi K2 模型冒名事件揭露 AI 工具供應鏈的透明度問題
- 新的「空中交通管制員」開發模式正在成形
💬 信任是基礎。當你的 IDE 對你隱瞞它背後用什麼模型,那個 200 美元的月費買的不只是功能——還有誠實。
Claude Code 已無法使用?Anthropic 系統提示爭議#
158K views · 2 天前
Theo 揭露 Anthropic 限制系統提示中特定關鍵字導致 API 請求被拒。付費用戶工作流中斷,社群反彈。
- 平台政策變更無預警影響付費用戶的日常開發
- 開發者對 AI 工具供應商的信任正在被考驗
💬 Theo 的憤怒有道理。你付了錢,結果你的工作流因為供應商的商業決策被打斷——這不是 bug,是信任問題。
Bash 不夠用了?讓 AI Agent 執行 TypeScript#
15.5K views · 7 小時前
Theo 分析 AI agent 的執行層進化:從 bash 到 TypeScript,agent 的表達力和偵錯能力大幅提升。
- GPT 5.4 已針對 JS 執行模式特化訓練
- 從模擬點擊到直接操控——agent 能力邊界持續擴張
💬 Agent 要做事,給它更好的工具很合理。TypeScript 比 bash 更適合表達複雜邏輯——就像你不會用螺絲起子敲釘子。
OpenAI Sora 2 下架:錯誤產品的代價與轉型#
1.9K views · 9 小時前
Sora 2 上線六個月後被砍,每天燒掉百萬美元算力,留存率趨近零。OpenAI 轉向超級應用策略。
- 技術能力和產品市場契合度是兩回事
- 核心人才 Tim Brooks 被 Google DeepMind 挖走
💬 不是所有 AI 產品都能成功。Sora 的教訓:最酷的技術不等於最好的產品。
Lindy AI:住在 iMessage 裡的 AI 執行助理#
11.8K views · 1 天前
Lindy Assistant 住在 iMessage,連接 100+ 工具,主動偵測機會。不需指令,它會主動發行程摘要、草擬回覆、重新安排約會。
- 創辦人定位為 iPhone 級別的「零設定」AI 體驗
- 起始定價 $49/月
💬 AI 助理不該是你要記得去問的東西——它應該主動告訴你。Lindy 的 iMessage 整合是對的方向。
BillionToOne:從血液中偵測癌症的生技革命#
5.9K views · 1 天前
從兩個 PhD 學生起家,到美國使用最廣泛的產前基因檢測,每年 60 萬次測試。40 億美元估值上市,正轉向早期癌症偵測。
- 核心技術:在數十億鹼基對中尋找單一差異
- MRD 癌症偵測測試預計不到一年上市
💬 不是所有有意義的 AI 應用都在寫程式碼。生技結合 AI 的潛力才剛開始。
名人動態#
- Ilya Sutskever: 密件內容在 New Yorker 調查中首次曝光——質疑 Sam Altman 是否值得掌控 AI 未來。詳見必讀 #2
- Simon Willison: 本日產出密集——Google AI Edge Gallery 評測、ChatGPT 健保數據引用、datasette-ports、scan-for-secrets、Cleanup Claude Code Paste 等多個工具更新
- Sam Altman: New Yorker 深度調查報導的主角,開發者社群超過 600 則留言
- Jack Clark: Import AI 452 分析 AI 資安能力的 scaling law,指出 AI 是「everything machine」
- Theo (t3.gg): 兩支影片——Claude Code 爭議(158K views)+ Bash vs TypeScript for agents(15.5K views)
今日觀察#
今天的科技圈出現了一個有趣的弔詭:AI 工具越來越強大,但開發者對這些工具背後的組織的信任卻在下降。Cursor 因為模型透明度問題道歉,Anthropic 因為限制政策流失付費用戶的好感,OpenAI 的創辦團隊內部矛盾被端上檯面。與此同時,開源和本地優先的方案——OpenClaude、Gemma 4、Ghost Pepper、MemPalace——正在吸收這些信任危機所釋放的需求。開發者似乎正在用下載數投票:與其信任一個公司的承諾,不如信任自己能跑的程式碼。
覺得有用嗎?分享給一個也在追蹤新知的朋友。
也歡迎中長期投資者體驗新工具 → Moniit



