14 則來自 13 位 builder

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 7 分鐘。

今天,模型能不能用變成了一個站隊問題:OpenAI 將在 11 月 12 日切斷 Cursor 對 GPT 模型的訪問,Anthropic 在同一天表態與 Cursor 的合作繼續,Replit 則直接掏錢請企業客戶搬家。Anthropic 還兩度公開了自己的工程細節,一次解釋了讓 Claude Code 被吐槽整整一個月的三處改動,一次講清了新的 Managed Agents 服務底下的架構。而在這些訊息之下,好幾位 builder 從不同角度說了同一件事:你現在堅信的任何一條 AI 判斷,幾個月後就會過期。

X

Thibault Sottiaux

OpenAI 將於 11 月 12 日切斷 Cursor 的 GPT 模型訪問

OpenAI 結束與 Cursor 的合作,11 月 12 日起不再透過它提供模型訪問,官方給出的理由是信任問題,而不是成本或算力。想繼續在 Cursor 裡用 GPT 模型的開發者可以自帶 OpenAI API key,OpenAI 的 IDE 擴充套件在 Cursor 裡也照常可用。這個表態針對的是一家公司,不是對第三方工具的收縮:OpenAI 說會繼續支援儘可能廣泛的 harness,開源閉源都算,也會繼續投入自己的開源工作。

  • #products
  • #developer-tools
X

Thariq

Anthropic 表示與 Cursor 的合作繼續

Claude Code 團隊的 Thariq 說自己長期以來一直欣賞 Cursor,認為在把 AI coding 推向大眾這件事上沒幾家做得比它更多,Anthropic 很期待繼續跟他們合作。這條正好發在 OpenAI 宣佈相反決定的同一天,所以對在 Cursor 裡做開發的人來說,實際含義很清楚:Claude 這條通道沒有倒計時。

  • #products
  • #developer-tools
X

Amjad Masad

Replit CEO

Replit 出錢資助企業從 Cursor 遷走

Amjad Masad 公開表態,任何想要一個獨立、多模型的 Cursor 替代方案的企業,Replit 都願意出錢資助遷移。他的賣點是:OpenAI 模型在 Replit 上免費,而 Replit 的 router 能讓高階模型用得起。這是對 OpenAI 斷供 Cursor 最快的一次競品回應,訊息出來幾小時內就發了。

  • #products
  • #developer-tools
部落格

Anthropic Engineering

Anthropic 覆盤:Claude Code 被吐槽一個月,源頭是三處互不相干的改動

讓大家覺得 Claude Code 變笨的,是三處互不相干的改動,而不是偷偷降級模型,API 自始至終沒有受影響。3 月 4 日,預設 reasoning effort 從 high 降到 medium,本意是解決長思考時介面看起來卡死的問題,使用者卻讀成了智力下降,4 月 7 日已回滾,現在 Opus 4.7 預設 xhigh,其餘一律 high。3 月 26 日的一處快取最佳化,本該只對閒置會話清理一次舊的思考內容,實際卻在該會話後續每一輪都清,於是 Claude 變得健忘又囉嗦,還因為反覆 cache miss 白白消耗用量額度,4 月 10 日隨 v2.1.101 修復。4 月 16 日加進 system prompt 的一行限制,把工具呼叫之間的文字壓到 25 詞、最終回覆壓到 100 詞,在一項評測上讓 Opus 4.6 和 4.7 都掉了約 3%,4 月 20 日回滾,Anthropic 會為所有訂閱使用者重置用量額度。

  • #products
  • #evals
部落格

Anthropic Engineering

Anthropic 把 agent 的大腦和手拆開,首 token p50 延遲降低 60%

Managed Agents 是 Claude Platform 上面向長週期 agent 的託管服務,它押的是這樣一個判斷:隨著模型變強,今天的 harness 一定會過時,所以把三樣東西虛擬化成可替換部件,會話日誌、harness、sandbox。把 harness 從容器裡拎出來之後,兩邊都從寵物變成了牲口,容器掛掉只會以一個工具呼叫報錯的形式出現,而不是整個會話丟失;harness 崩了就重啟,從日誌裡最後一個事件接著往下跑。因為會話存在 context window 之外,agent 可以按位置切片重讀自己的歷史,而不必對留什麼、丟什麼做出不可逆的壓縮決策。只在工具呼叫真正需要時才開容器,這一條把首 token 的 p50 延遲壓低了約 60%,p95 降了 90% 以上;憑據現在放在 vault 或預配置好的 git remote 裡,sandbox 能用,但讀不到。

  • #agents
  • #products
Podcast

No Priors

企業內鬼變成了你自己批准的那個 agent

企業資料的威脅模型翻轉了:危險的不再是拿著盜來憑據的外部人,而是公司自己批准的 agent,它許可權合法,能以機器速度刪掉一張生產表。Eon 的聯合創始人說,檢測方法論從勒索軟體時代可以沿用,但速度這一項沿用不了;半年前沒人願意跟他們聊這個話題,現在他們見到的高管幾乎人人要麼親歷過,要麼正在擔心。他們有個反直覺的判斷,agent 不會殺死 dashboard,反而會讓它變多:"我其實覺得 dashboard 會更多,因為這將是搞清楚外面到底在發生什麼的唯一辦法。"他們還把 Google 花 1000 萬美元買下破產的 Spirit Airlines 資料(不含飛機)看作一波破產資料收購的開端,因為行為上真的像一家公司的訓練資料幾乎找不到。

  • #agents
  • #security
X

Guillermo Rauch

Vercel CEO

網頁正在裂成兩半,一半取悅人,一半喂機器,而 agent 就是瀏覽器

Guillermo Rauch 認為網頁正在向兩個極端撕開:一端是為愉悅感、探索感和品牌服務的極致人類體驗,另一端是給機器看的、純粹無損的訊號,markdown 和 MCP 只是後者露出水面的部分。中間那一大片會被 agent 吞掉,由它在你需要時即時生成 UI,於是 agent 成了新的瀏覽器。他拿 mcp-handler 的 npm 下載量作證據,說明 MCP 的採用早已超出 Vercel 自家 server 的範圍。與之配套的是他在推的 eve:agent 從一個 Git repo 起步,整套智慧棧都歸你所有,執行時、模型選擇、skills、工具、連線能力、sandbox。

  • #agents
  • #products
X

Aaron Levie

Box CEO

任何一條堅信的 AI 觀點,半衰期都是六個月

Aaron Levie 列了一序列業已經輪過一遍、如今再無共識的判斷:開源差太遠追不上、大模型公司規模化後不可能盈利、所有軟體都會被 agent 取代、在模型之上建不起護城河、模型變便宜意味著算力需求下降、不需要做 evals、RAG 已死、訓練已經撞牆。他的意思不是說哪一條錯了,而是說一條被廣泛堅信的 AI 判斷,平均撐不過六個月。給出的實操建議只有一條:保持靈活,因為在相當一段時間裡,持續變化本身就是穩態。

  • #industry
X

Madhu Guru

Meta Senior Director of AI

AI 產品的打法現在三個月就作廢一次

傳統產品團隊的構造是找到一套打法,然後吃五年。Madhu Guru 說,在 AI 實驗室內部,團隊每隔幾個月就主動把打法扔掉,一看到邊際收益遞減就扔。他的處方是別再圍著打法做最佳化,轉而為兩件事定下元原則:怎樣持續搞清楚市場今天要什麼、三個月後又會要什麼;以及怎樣以極端的緊迫感執行。老牌團隊是為吃老本最佳化的,AI 團隊必須為不斷髮明最佳化。

  • #products
  • #industry
X

Peter Yang

agent 該長成的樣子是 Grok Bot,不是 ChatGPT Work 或 Claude Cowork

Peter Yang 認為 Claude Cowork 和 ChatGPT Work 都只是半截方案,面向非技術使用者的 agent 產品,Grok Bot 更接近該有的終態。理由不在能力,而在可理解性:一臺跑在雲上的電腦,普通人一聽就懂。讓一個普通使用者解釋 ChatGPT Work 和 Codex 有什麼區別,或者 Claude Cowork 到底怎麼運作,他賭幾乎沒人說得清。

  • #agents
  • #products
X

Zara Zhang

判斷 slop 看的是有沒有視角,而不是誰寫的

Zara Zhang 判斷 slop 的標準跟是不是機器寫的完全無關。關鍵在於這東西背後有沒有具體而獨特的人的經歷和視角,按這個標準,人寫的 slop 也多得是。她還提了一個 builder 們都在悄悄迴避的現實問題:如果你在 Grok Bot 的虛擬電腦裡登入自己的真實 X 賬號,讓它去處理你的時間線、書籤或關注列表,賬號會不會被標記甚至封禁。她說正是這份擔心,讓她在把賬號許可權交給任何 agent 這件事上極其謹慎。

  • #agents
  • #security
X

Aditya Agarwal

SPC general partner

H-1B 確實被濫用,但把高技能人才擋在門外同樣有代價

Aditya Agarwal 一路走過 F1、OPT、CPT、H-1B 和 EB-3 綠卡才拿到公民身份,他說有四件事可以同時成立。H-1B 體系確實存在濫用,擠佔了正當用途,他樂見政府出手整治。同時這個國家讓真正的高技能人才留下來太難了,而他認為這些人才是美國實力的巨大來源,其中高技能印度人的處境最艱難。第四點是任何國家的法律都應當優先考慮本國公民。他這番話是說給那些自己沒走過簽證流程卻在對簽證問題指點江山的人聽的。

  • #policy
X

Dan Shipper

Every CEO

沒有壞的 AI 點子,只有還不夠強的模型

Dan Shipper 給所有產品做砸了的人換了個說法:在 AI 裡沒有壞點子,只有還不夠強的模型,指數曲線繼續往上走,每個點子終會等到屬於它的那一天。這是在說失敗的嘗試應該封存,而不是砍掉。他還宣佈 Every 現在有了一位 head of evals,具體在做什麼暫時保密。

  • #products
  • #evals
X

Nikunj Kothari

FPV Ventures partner

最好的 pitch 根本用不著提 AI

Nikunj Kothari 希望創始人在下一輪融資前先記住兩條:最強的 pitch 從來不需要用到 AI 這個詞,而且 AI 不能是"為什麼是現在"的唯一答案。他強調這只是自己的主觀看法,不代表 VC 的通行標準,但話裡的意思是,一個只靠技術轉折點撐著的 pitch,讀起來就像這家公司沒有別的存在理由。

  • #funding

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。