Thibault Sottiaux
OpenAI 取消免費版 ChatGPT 文字對話限額,由 GPT-5.6 Luna 驅動
OpenAI 取消了免費版 ChatGPT 文字對話的次數上限,現在由 GPT-5.6 Luna 驅動。Sottiaux 還描述了 Codex 搭配 GPT-5.6 Sol 之後的新標準:花五分鐘跟它聊一件看起來要幾周才能幹完的活,然後起身去翻翻冰箱、擼擼狗,回來發現活已經幹完了。
- #products
- #models
真正在做 AI 的人今天說了什麼。一頁讀完,約 5 分鐘。
OpenAI 讓免費版 ChatGPT 的文字對話基本不再限量,Anthropic 這邊也沒閒著:Fable 5 放寬了生物學方面的安全限制,Claude 則進入了 Apple 的 Foundation Models 框架。不過今天最犀利的思考都圍繞 agent 展開。Basis 開源了他們給 agent 執行過程打分的方法,Aaron Levie 則認為與 agent 協作更像是管理一個人,而不是向聊天機器人提問。
OpenAI 取消免費版 ChatGPT 文字對話限額,由 GPT-5.6 Luna 驅動
OpenAI 取消了免費版 ChatGPT 文字對話的次數上限,現在由 GPT-5.6 Luna 驅動。Sottiaux 還描述了 Codex 搭配 GPT-5.6 Sol 之後的新標準:花五分鐘跟它聊一件看起來要幾周才能幹完的活,然後起身去翻翻冰箱、擼擼狗,回來發現活已經幹完了。
新 Swift package 讓 Claude 接入 Apple 的 Foundation Models 框架
一個新的 Swift package 讓 Apple 開發者可以透過 Apple 的 Foundation Models 框架呼叫 Claude:端側模型負責摘要、資訊抽取這類快速的本地任務,遇到多步推理、程式碼生成、網頁搜尋或資料分析就交給 Claude。由於框架會根據 @Generable 註解返回帶型別的 Swift 值,Claude 拿到的是乾淨的結構化輸入,而不是原始的使用者文字。它明天就會在 iOS、iPadOS、macOS、visionOS 和 watchOS 27 上釋出。
Basis 開源 behavior specs:給 agent 打分要看過程,不只看結果
透過 eval 不代表你的 agent 具備泛化能力:“就算一百次裡你答對了一百次,如果一個人只是靠去查 Wikipedia 才答對,會計師事務所不會僱他,那也不該僱我們。”Basis 的會計 agent 會自主執行數小時到數天,處理完整報稅這類工作,他們用 behavior specs 對 agent 的過程和結果一起打分:用純 markdown 檔案寫明 agent 應該如何行事,再由一個本身也是 agent 的裁判來檢查,現在已聯合 Braintrust 將其作為開放標準釋出。Troyanovsky 更大的一層觀點是,context 就是執行時的訓練資料,他認為大多數開發者把程式碼看得比 context 金貴,而實際恰恰相反,因為只有 context 會影響表現。
Levie:給 agent 寫 prompt 是在寫 spec,工作流本身也得跟著變
Levie 引用了一篇他推薦的文章,認為“給 agent 寫 prompt 更像是在寫 spec,而不是在問一個問題”,而且真正的紅利要等到公司改造底層工作流時才會出現,而不是把 agent 硬套在現有流程上。他預測企業 token 消耗的絕大部分將來自部署在工作流裡執行任務的 agent,而不是聊天。他還把 Atlassian 大超預期的季度財報解讀為一個證據:agent 讓程式碼產量多出 100 倍,反而讓 system of record 變得更重要而不是更不重要,因為企業仍然需要治理、安全和對資料的安全訪問。
Masad:no code 已死,因為正解從來都是解決程式碼本身
在 Masad 的敘述裡,no code 的興衰始於 Airtable,也終於 Airtable:他當年和投資人爭論了無數次,說 UI 永遠不可能讓你構建任意軟體,要讓軟體人人可及,就得解決程式碼本身,這話直到今天之前聽起來都像痴人說夢。他還分享了一段往事:2021 和 2022 年他找過 Google、Meta 和矽谷幾乎所有公司,希望和 Replit 一起訓練專門的程式碼模型,沒人覺得這事比 NLP 重要,於是 Replit 趕在整個行業意識到程式碼模型的價值之前,自己訓練了 Replit-code-3b。
Yang:消費級 AI 市場的主動權在 ChatGPT 和 Google 手裡
消費級 AI 市場的主動權握在 ChatGPT 和 Google 手裡:兩家都有大約十億使用者,真正的門檻在於主流使用者還不放心讓 AI 完全訪問自己的應用和資料,也沒意識到它現在能做什麼,這讓市場營銷和資訊傳達變得和產品本身一樣重要。他最尖銳的一個判斷是,對普通人來說,模型是不是最強幾乎無關緊要;他那些不搞 AI 的朋友根本不在乎 Sol 和 Fable 哪個好,只要價格公道、活兒能穩定幹完就行。
Kothari:VC 不會告訴你的融資技巧,先從 10% 的底線說起
一份創始人很少聽到的融資實操心得:要拿到能直達 GP 本人的熟人引薦,最好來自他們投過的創始人;要知道任何成熟的領投基金都不會接受低於 10% 的稀釋;永遠不要拿競爭對手的融資估值給自己錨定價格,他稱這是搞砸交易的頭號方式。也別在 term sheet 上撒謊,因為在這個人人互通訊息、每份 deck 都會外流的市場裡,發條簡訊就能核實。他說這是他近來見過共識最強的市場,所以熱門賽道之外的創始人應該帶著自己的逆共識論證和一份 default-alive 的活命計劃再來。
來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。
摘要由程式自動生成。據此判斷前請先看原文。