2 則來自 2 位 builder
往期

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 2 分鐘。

今天的話題幾乎被一件事佔滿:OpenAI 披露了一起發生在模型評估過程中的安全事件,短短几個小時裡,開發者圈的討論就從驚愕轉向了「防禦到底該怎麼做」。除此之外,Google 釋出了更便宜也更快的 Flash 模型,OpenAI 的 Codex 加上 ChatGPT Work 則跨過了 1000 萬使用者的門檻。

Podcast

Training Data

Factory 的 Grinberg:與模型解耦的 harness,比跟模型一起設計出來的更強

這個反直覺的觀點直接衝著 OpenAI 和 Anthropic 的朋友們去:把模型和 harness 放在一起做,並不會讓兩者配合得更好。「資料之於模型,就相當於模型之於 harness。」讓一套 harness 見過足夠多的模型,它才不會過擬合到某一個模型的脾氣上。Factory 就發現,新版 Opus 和 GPT 在 Droid 裡跑 TerminalBench 的分數,比在 Claude Code 或 Codex 裡還要高。他還說,早了兩年其實就等於做錯了,並用一段親身經歷來佐證:因為產品沒能讓開發者滿意,他們退掉了將近 200 萬美元的企業收入。開源模型在他們客戶的 token 用量裡,年初還不到 1%,現在已經是兩位數,其中 GLM 5.2 表現最突出。他預計 12 到 24 個月內,90% 的 token 都會是非同步產生的。

  • #agents
  • #open-source
  • #evals
部落格

Claude Blog

Claude 透過全新的 Swift package 接入 Apple 的 Foundation Models 框架

藉助一個新的 Swift package,Apple 開發者現在可以在同一套 Foundation Models 流程裡,把任務從端側模型交接給 Claude。端側模型負責摘要、資訊抽取這類需要快速完成的本地活兒,然後把 @Generable 註解產出的帶型別 Swift 值傳給 Claude,由它來做多步推理、程式碼生成、web search 或程式碼執行,結果再以流式的方式回到同一個檢視裡。明天上線,支援 iOS 27、iPadOS 27、macOS 27、visionOS 27 和 watchOS 27,使用 Anthropic API key 鑑權。

  • #products
  • #developer-tools

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。