13 則來自 13 位 builder

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 5 分鐘。

今天 Anthropic 把 Cowork 和對話合成了一個 Claude,Docs、Slides 和 Design 現在都住進了任意一個會話裡,builder 圈子今天的討論基本都繞著這個決定轉。另一條線是又快又便宜的 inference:Vercel 把命令安全審查器換到一個更小的模型上,p95 快了 18 倍;企業圈的人也開始盤算,低成本的判斷力到底該放在哪些環節。此外還有幾條關於工具設計、agent skill 和 Claude 文風的犀利觀點。

部落格

Claude Blog

Claude Cowork 併入對話,Docs 和 Slides 以 beta 上線

Cowork 和對話現在合成了一個 Claude,接下來幾周先推給 Pro 和 Max,Team 和 Free 隨後跟上,Enterprise 的管理員會提前 30 天收到通知。Claude Docs 和 Claude Slides 是全新的,Claude Design 也搬進了對話裡,所以一份報告和與之配套的演示稿可以從同一個會話裡出來。你可以直接編輯、在 Claude 裡演示,或者匯出成 PowerPoint 和 PDF,最後全都落在同一個可分享的連結上。官方給的理由是:大家兩個產品都在用,而最煩人的恰恰是判斷某件事該放在哪邊,何況兩邊之間什麼都帶不過去。

  • #products
  • #agents
X

Cat Wu

快答還是深度 agent 幹活,現在 Claude 自己來判斷

這次合併押的是模型已經足夠好,好到可以替你做決定。Claude 會根據你的 prompt 判斷該甩回一個快答,還是去做時間更長的 agent 工作,以及什麼輸出格式合適,而不是讓你先選一個產品。使用者反覆在說的就是,他們不想選該開啟哪個 Claude。你照樣可以中途叫停它、給它改方向,或者把它的用力程度調高調低。

  • #products
  • #agents
X

Boris Cherny

合併的說法:一個把上下文帶到任何地方的 Claude

Claude Code 證明了開發者可以把一個功能交出去,回來時看到的是已經上線的程式碼;Cowork 證明了知識工作者可以把一份簡報交出去,回來時拿到的是做完的檔案。把對話和 Cowork 合起來,就是走向「一個 Claude」的那一步:你手頭在做的所有事,它都帶著上下文。Docs、Slides 和 Design 現在存在於每一個會話裡,所以你要一份演示稿,拿到的就是能開啟、能編輯、能匯出成 PowerPoint 或 PDF 的東西,不用再跳到另一個工具裡去。

  • #products
  • #agents
X

Guillermo Rauch

Vercel CEO

Vercel 的 fx 命令審查器換小模型,p95 快了 18 倍

fx 預設跑在 auto 模式下,每條命令執行前都有一個安全審查器先分析一遍,這個審查器目前跑在 GPT Luna 上。換成 Jev 之後,p95 最多快了 18 倍,同時準確率還更高,這是少見的不用拿質量換延遲的情況。它接下來會進 Vercel AI Gateway,大機率會成為新的預設選項。

  • #agents
  • #products
X

Aaron Levie

Box CEO

又快又便宜的 inference,開啟的是企業流程裡的那些關卡

有一整片 AI 創新的天地,大多數人壓根沒放在視野裡:用極低的成本、極快的速度、還帶著不錯的能力去處理資訊,這會改變企業裡什麼事情算划算。該瞄準的不是那些搶頭條的活兒,而是流程裡的一道道關卡:資料分類、工作流內部的路由決策、特定領域的判斷、快速的安全或合規判定。恰恰是這些卡點,決定了 agentic 工作流能不能在規模上跑得通。

  • #agents
  • #products
X

Thariq

想讓 tool calling 可靠,光靠 bash 已經不夠了

這是對去年那套想法的反轉:如果目標是可靠的 tool calling,把什麼都包進 bash 就是選錯了抽象層。不如按你真正想要的樣子,直接給 Claude 定義工具。比如存資料這件事,先問問自己你要的到底是一個檔案系統,還是一個資料庫的 API。沙箱加 bash 在涉及程式碼生成和執行的場景裡仍然值回票價,而 Claude Managed Agents 的平衡點在於把沙箱做成可選、並且能獨立於 agent loop 單獨啟停,把一個老的重度依賴 bash 的專案遷過來時,這套做法確實站得住。

  • #agents
  • #open-source
X

Peter Yang

八個 AI skill 做出一整期播客,品味那部分還是手工

一條完整的播客流水線跑在自定義 skill 上:/podcast-prep 研究嘉賓、起草訪談提綱;/podcast-edit 讀原始逐字稿,和主持人一起挑開場片段的金句和剪輯點;/podcast-production 再排程另外五個 skill,把一期節目變成六份素材。反直覺的一點在 skill 本身。有人認為最新的模型已經讓 skill 變得多餘,但正是 skill 讓 AI 去遵守具體的剪輯規則和瀏覽器操作指令,而不是給你一堆泛泛之談。

  • #agents
  • #products
X

Madhu Guru

Meta Sr Director, AI

safety 和 security 是產品特性,不是外面塞進來的護欄

把 safety 和 security 當成外部強加的約束,整個框架就搞反了。它們是 AI 產品和模型本身的特性,應該作為能力長在裡面,而不是作為合規要求焊在外面。

  • #policy
  • #products
X

Zara Zhang

Claude 的文風正在勸退人,至少勸退了一個 builder

最近越來越少用 Claude,因為它說話的方式已經讓人受不了了。抱怨很具體:讀起來像是在不停展示自己有多聰明、多有修養,而不是真的把要點說清楚。

  • #products
  • #evals
X

Nikunj Kothari

FPV Ventures Partner

折騰了幾個月的家用 agent,能成是因為兩個人一起在用

一個基於 Nous Research 的家用 agent,折騰幾個月之後終於好用了。這是家裡第一個群組 bot,兩個人每天都在用,有意思的行為大多是在它出錯的時候冒出來的。用 Grok Bot 之類的東西想復刻,怎麼都達不到同樣的顆粒度和控制力:只限定讀取某些郵件、把內嵌附件轉成結構化資料、透過已登入的瀏覽器會話幹活。

  • #agents
  • #products
X

Garry Tan

Y Combinator President and CEO

隨便換 harness,人格不變,記憶全在

可攜帶記憶的吸引力說白了就一句話:你想用哪個 harness 就用哪個,拿到的還是同一個人格,你那個 personal AGI 的完整記憶一點不少。一旦連續性由模型自己帶著,客戶端是哪個就不重要了。

  • #agents
  • #products
X

Claude

演示稿、文件、設計稿都能在會話裡改,也能匯出

在 Claude Docs 裡起草一頁紙,用 Claude Slides 把它變成一份演示稿,再用 Claude Design 配一張對應的視覺稿,全程不用離開對話。你可以自己動手改掉文件裡的一句話,在某頁幻燈片上給 Claude 留條評論,或者選中一個元素挪個位置;然後直接從 Claude 裡開始演示,把文件匯出成你慣用的格式,或者用一個連結把這一切分享出去。Design、Slides 和 Docs 目前在所有付費方案上處於 beta,之前放在 Cowork 裡的東西全部平移過來:聊天記錄、專案、artifact、聯結器和 skill。

  • #products

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。