10 則來自 10 位 builder

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 4 分鐘。

Claude 現在可以在對話旁邊直接開啟 Google Docs、Sheets 和 Slides,並和你一起編輯。兩位做 Claude Code 的開發者分別聊了兩件事:寫 prompt 說到底就是把話說清楚;Claude 的“大腦”正在往雲端搬。Applied Compute 的 CEO 認為,贏下推理靠的是 post-training,而 eval 是一項需要嚴加守護的資產。安全方面,Aaron Levie 稱網路安全會是 AI 最具決定性的領域之一,Amjad Masad 則認為 AI 反編譯會讓所有軟體在事實上變成開源。

X

Claude

Claude 現在可以在對話旁開啟 Google Docs、Sheets 和 Slides 並協同編輯

貼上一個 Google 檔案連結,或者讓 Claude 新建文件、表格或簡報,檔案就會在對話旁邊開啟,你和 Claude 可以一起編輯。訪問許可權沿用你在 Google 裡已有的共享設定,目前以 beta 形式向所有付費套餐開放。Anthropic 還重點介紹了 Every:他們基於 Claude Managed Agents 搭了一個公司內部 agent,全團隊都在 Slack 裡用它,每逢新模型釋出就用它互相分享 skill。這個 agent 在內部火起來之後,Every 又把它開放給了訂閱使用者。

  • #products
  • #agents
Podcast

Unsupervised Learning

Applied Compute CEO:贏下推理靠 post-training,你的 eval 才是護城河

Applied Compute 的 CEO 在 OpenAI 時主要做 Codex。他認為 RL 真正難的是定義要最佳化什麼,所以企業應該像看重員工一樣守好自己的 eval,而不是把它交給 AI 實驗室或者公開 benchmark。他的核心觀點是 post-training 贏下推理:最大的那些 workload 會最先被定製訓練;想壓低 token 賬單,除了調優 serving,還可以在 eval 分數不變的前提下讓模型更省 token。在沒有唯一正確答案的領域,基於 rubric 的 RL 效果出奇地好,但 RL 的遷移能力遠不如 pretraining,continual learning 也仍然卡在如何從稀疏獎勵中高效學習這一步。“RL 給我們的,本質上是一臺爬山機器。最難的其實是定義要爬哪座山。”

  • #post-training
  • #evals
  • #inference
X

Boris Cherny

Boris Cherny:寫 prompt 沒有秘訣,像跟同事說話一樣跟 Claude 說就行

在 Anthropic 做 Claude Code 的 Boris Cherny 分享了一些真實的 prompt。他說大多數任務既不需要複雜的腳手架,也不需要事無鉅細的指令,給 Claude 一個目標,它自己會想辦法搞定。在 Sonnet 3.5 那個年代,prompt 怎麼措辭影響很大。現在真正值得交代清楚的只有三件事:你想做成什麼,要投入多少力氣,以及模型該怎麼驗證自己做對了。

  • #prompting
  • #coding
X

Thariq

Thariq:Claude 的大腦正搬去雲端,雙手留在你的電腦上

在 Anthropic 做 Claude Code 的 Thariq 說,趨勢越來越明顯:Claude 的“大腦”住在雲端,“本地的手”在你的電腦上幹活。麻煩在於可用性。如果 Claude 只能在你的電腦線上時訪問檔案,電腦一離線,工作就可能卡住,一直等到它重新上線。所以可能需要某種同步機制,而同步本身又有一堆邊界情況。Thariq 還反駁了“有了 coding agent 就能跳過底層”的說法,因為想在更高的抽象層上工作,從來都得先理解下面那幾層。

  • #agents
  • #coding
X

Aaron Levie

Box CEO

Aaron Levie:網路安全會是 AI 最具決定性的領域之一

Levie 預計 AI 會給安全團隊堆來大量新活兒:vibe coding 寫出來的 bug,agent 發起的攻擊,甚至還有意外形成、四處搜刮資料的 agent 叢集。在他看來,OpenAI + Hugging Face 只是個預告。安全團隊往往是企業裡資源最緊張的部門,所以 agent 同時也會是解藥,保護程式碼、企業系統、關鍵基礎設施和資料的 agentic 新產品會陸續出現。結論很簡單:真正會部署 agent 的安全人才,市場會非常火爆。

  • #security
  • #agents
X

Amjad Masad

Replit CEO

Amjad Masad:AI 反編譯會讓所有軟體在事實上變成開源

Masad 說,AI 驅動的逆向工程和反編譯領域正在發生的事情“簡直瘋狂”,並預測用不了多久,所有軟體都會在事實上變成開源。他的總結很直白:“AI 會衝著所有東西、所有人來。”

  • #security
  • #open-source
X

Peter Steinberger

Peter Steinberger 把團隊的 claw agent 接上了 X,用來分派工作

任何人都可以認領一個還沒人接的 session,agent 會查出最近是誰改過相關程式碼,然後在團隊伺服器上通知對方。整套配置只用了一個 prompt。而且因為外掛現在支援熱載入,團隊伺服器還自己給自己做了擴充套件。

  • #agents
  • #coding
X

Thibault Sottiaux

OpenAI 的 Thibault Sottiaux 執行了社群投票透過的重置,升級照樣保留

在 OpenAI 做 Codex 和 ChatGPT 的 Sottiaux 說,Day 2 上線了四項被評為還不錯到很棒的功能,外加一些數學證明,但社群投票的結果還是選了重置,現在已經執行完畢。Sottiaux 承認,按現在的規則,這個遊戲似乎天生偏向重置,同時表示已經做出的改進不會撤回。Day 3 明天開始。

  • #products
X

Nikunj Kothari

FPV Ventures Partner

Nikunj Kothari:VC 在 X 上拱火博流量,正在讓別人丟掉真交易

Kothari 說,太多 VC 在追逐多巴胺,或者為了流量故意拱火。X 上容不下細微差別,說出去的話基本收不回來。受傷最重的是他們“手下”的人:Kothari 就認識兩個人,因為 X 上的風波丟掉了原本已經談妥的交易。如今資本已經成了大宗商品,風投基金遍地都是,似乎沒幾個人在玩長期遊戲。

  • #funding
X

Guillermo Rauch

Vercel CEO

Guillermo Rauch 看好用置信度閾值來做大規模 AI 決策

Rauch 重點推薦了一個功能,他的概括是“依據置信度閾值,快速思考,或者稍微放慢一點思考”。他說這個功能非常簡單,但很可能會對大規模 AI 決策產生極大影響。

  • #products

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。