11 則來自 11 位 builder

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 5 分鐘。

OpenAI 讓免費版 ChatGPT 的文字對話基本不再限量,Anthropic 這邊也沒閒著:Fable 5 放寬了生物學方面的安全限制,Claude 則進入了 Apple 的 Foundation Models 框架。不過今天最犀利的思考都圍繞 agent 展開。Basis 開源了他們給 agent 執行過程打分的方法,Aaron Levie 則認為與 agent 協作更像是管理一個人,而不是向聊天機器人提問。

X

Thibault Sottiaux

OpenAI 取消免費版 ChatGPT 文字對話限額,由 GPT-5.6 Luna 驅動

OpenAI 取消了免費版 ChatGPT 文字對話的次數上限,現在由 GPT-5.6 Luna 驅動。Sottiaux 還描述了 Codex 搭配 GPT-5.6 Sol 之後的新標準:花五分鐘跟它聊一件看起來要幾周才能幹完的活,然後起身去翻翻冰箱、擼擼狗,回來發現活已經幹完了。

  • #products
  • #models
X

Sam Altman

Altman:GPT-5.6 Sol 現在聊天體驗好了很多

Altman 版本的當日釋出訊息:GPT-5.6 Sol 現在聊天體驗好了很多,免費使用者也能不限量地進行文字對話。值得注意的是,OpenAI 這次給前沿模型打的賣點是對話質量,而不只是寫程式碼。

  • #models
X

Claude

Anthropic 把 Fable 5 生物學相關的回退減少 85%,能答的健康問題更多了

Anthropic 更新了 Claude Fable 5 的生物學安全機制以減少誤判,測試中生物學相關的回退減少了約 85%,模型因此能處理範圍廣得多的日常健康和科普教育類問題。病毒學、毒理學、分子設計這類兩用性領域仍會回退到 Opus 5 處理,官方承諾會為專業研究人員和藥物研發提供可信訪問通道。

  • #safety
  • #models
部落格

Claude Blog

新 Swift package 讓 Claude 接入 Apple 的 Foundation Models 框架

一個新的 Swift package 讓 Apple 開發者可以透過 Apple 的 Foundation Models 框架呼叫 Claude:端側模型負責摘要、資訊抽取這類快速的本地任務,遇到多步推理、程式碼生成、網頁搜尋或資料分析就交給 Claude。由於框架會根據 @Generable 註解返回帶型別的 Swift 值,Claude 拿到的是乾淨的結構化輸入,而不是原始的使用者文字。它明天就會在 iOS、iPadOS、macOS、visionOS 和 watchOS 27 上釋出。

  • #products
Podcast

The MAD Podcast with Matt Turck

Basis 開源 behavior specs:給 agent 打分要看過程,不只看結果

透過 eval 不代表你的 agent 具備泛化能力:“就算一百次裡你答對了一百次,如果一個人只是靠去查 Wikipedia 才答對,會計師事務所不會僱他,那也不該僱我們。”Basis 的會計 agent 會自主執行數小時到數天,處理完整報稅這類工作,他們用 behavior specs 對 agent 的過程和結果一起打分:用純 markdown 檔案寫明 agent 應該如何行事,再由一個本身也是 agent 的裁判來檢查,現在已聯合 Braintrust 將其作為開放標準釋出。Troyanovsky 更大的一層觀點是,context 就是執行時的訓練資料,他認為大多數開發者把程式碼看得比 context 金貴,而實際恰恰相反,因為只有 context 會影響表現。

  • #agents
  • #evals
  • #open-source
X

Aaron Levie

Box CEO

Levie:給 agent 寫 prompt 是在寫 spec,工作流本身也得跟著變

Levie 引用了一篇他推薦的文章,認為“給 agent 寫 prompt 更像是在寫 spec,而不是在問一個問題”,而且真正的紅利要等到公司改造底層工作流時才會出現,而不是把 agent 硬套在現有流程上。他預測企業 token 消耗的絕大部分將來自部署在工作流裡執行任務的 agent,而不是聊天。他還把 Atlassian 大超預期的季度財報解讀為一個證據:agent 讓程式碼產量多出 100 倍,反而讓 system of record 變得更重要而不是更不重要,因為企業仍然需要治理、安全和對資料的安全訪問。

  • #agents
  • #enterprise
X

Amjad Masad

Replit CEO

Masad:no code 已死,因為正解從來都是解決程式碼本身

在 Masad 的敘述裡,no code 的興衰始於 Airtable,也終於 Airtable:他當年和投資人爭論了無數次,說 UI 永遠不可能讓你構建任意軟體,要讓軟體人人可及,就得解決程式碼本身,這話直到今天之前聽起來都像痴人說夢。他還分享了一段往事:2021 和 2022 年他找過 Google、Meta 和矽谷幾乎所有公司,希望和 Replit 一起訓練專門的程式碼模型,沒人覺得這事比 NLP 重要,於是 Replit 趕在整個行業意識到程式碼模型的價值之前,自己訓練了 Replit-code-3b。

  • #coding
  • #products
X

Guillermo Rauch

Vercel CEO

Rauch:Plugin 標準讓 AI coding agent 具備通用可擴充套件性

Rauch 的核心主張:開發者工具必須開源且具備通用可擴充套件性,而 AI coding agent 是這個行業歷史上最重要的開發者工具。Plugin 標準讓任何人都能以統一的方式擴充套件它們,所以只要做一個 plugin,就能在 CLI、IDE、雲端 agent 和個人助理掀起的這波軟體創作浪潮中拿到全渠道的分發。

  • #open-source
  • #agents
X

Peter Yang

Yang:消費級 AI 市場的主動權在 ChatGPT 和 Google 手裡

消費級 AI 市場的主動權握在 ChatGPT 和 Google 手裡:兩家都有大約十億使用者,真正的門檻在於主流使用者還不放心讓 AI 完全訪問自己的應用和資料,也沒意識到它現在能做什麼,這讓市場營銷和資訊傳達變得和產品本身一樣重要。他最尖銳的一個判斷是,對普通人來說,模型是不是最強幾乎無關緊要;他那些不搞 AI 的朋友根本不在乎 Sol 和 Fable 哪個好,只要價格公道、活兒能穩定幹完就行。

  • #products
  • #consumer
X

Madhu Guru

Meta Sr Director of AI

Madhu Guru:把自己講想法的過程錄下來,直接當文件發出去

人在口頭講一個新想法時,往往比寫成文件時清晰得多;從嘴巴到紙面的某個環節,核心想法就被背景鋪墊和潤色淹沒了。他給自己團隊的解法是:像跟朋友解釋那樣把想法錄下來,用 AI 做基礎的整理,但保留原本粗糙的結構和行文節奏,然後把它作為文件分享出去。

  • #productivity
X

Nikunj Kothari

FPV Ventures Partner

Kothari:VC 不會告訴你的融資技巧,先從 10% 的底線說起

一份創始人很少聽到的融資實操心得:要拿到能直達 GP 本人的熟人引薦,最好來自他們投過的創始人;要知道任何成熟的領投基金都不會接受低於 10% 的稀釋;永遠不要拿競爭對手的融資估值給自己錨定價格,他稱這是搞砸交易的頭號方式。也別在 term sheet 上撒謊,因為在這個人人互通訊息、每份 deck 都會外流的市場裡,發條簡訊就能核實。他說這是他近來見過共識最強的市場,所以熱門賽道之外的創始人應該帶著自己的逆共識論證和一份 default-alive 的活命計劃再來。

  • #funding

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。