15 則來自 15 位 builder

AI構建者摘要

真正在做 AI 的人今天說了什麼。一頁讀完,約 5 分鐘。

Anthropic 釋出了 Sonnet 5.5,開發者的反應來得很快,而且難得地給出了具體數字:在 Claude Code 裡每個 token 能多幹大約 30% 的活;Box 則公佈了一份完整的企業級評測,交付速度快了 2.4 倍,token 還少用 12%。與此同時,OpenAI 趕在 DevDay 前幾個小時提前披露了 200 美元 Pro 套餐的重新定價,實際可用量砍到原來按 API 消費折算的一半左右,同時承諾不會把 5 小時限制請回來。串起這些的一條線是:中端模型已經好到有開發者說,自己的技術棧裡已經沒有它們的位置了。

X

Thibault Sottiaux

OpenAI 重開 200 美元 Pro 訂閱,實際用量砍半,趕在 DevDay 前夜官宣

200 美元的 Pro 訂閱重新對新使用者開放,用量的計算方式變了,折算下來大約只有老套餐對應 API 消費的一半。給出的理由有兩條:不會把 5 小時限制請回來,所以每週的用量可以隨便花;也不願意為了讓訂閱顯得更划算,就硬把 API 標價往高了抬。背後的判斷是 API 價格會繼續快速下降,降到「按需買用量」和「訂閱」兩條路殊途同歸,佐證是本週上線的 GPT-6 Sol 和 GPT-6 Luna,價格只有此前的 50%。訂閱裡還會加進一樣不佔用量的新東西,要等到正式釋出才揭曉。

  • #products
  • #pricing
X

Aaron Levie

Box CEO

Box 的企業級評測:Sonnet 5.5 交付速度快 2.4 倍,token 少用 12%

Box 在早期訪問階段用 Box Agent 跑了自家的複雜任務評測,Sonnet 5.5 在最難的那批測試上總分提高 4 分,做出最終交付物的速度快了大約 2.4 倍,同時少用 12% 的 token。分行業的提升更明顯:金融服務 +18 分,生命科學 +8 分,法律和公共部門各 +7 分。真正有意思的是具體任務上的表現。在一份盡職調查複核裡,它揪出了交易檔案中算錯的利息合計和定價有誤的期權;在一份商業租約複核裡,它拒絕為續租條款編造一個所謂的「標準」市場基準,轉而指出租約裡實際缺了什麼。Sonnet 5.5 很快會進入 Box AI Studio。

  • #evals
  • #agents
  • #products
X

Cat Wu

Sonnet 5.5 在 Claude Code 裡多完成約 30% 的任務,靠的是少用 token 而不是多用

在 Claude Code 裡,使用者用 Sonnet 5.5 完成的任務比用 Sonnet 5 多出大約 30%,起作用的是智慧本身而不是預算:同樣的活它需要的 token 更少。一個用工具呼叫耙院子的演示,比 Sonnet 5 快了 24 秒,token 還少用 6000 個。

  • #products
  • #agents
X

Dan Shipper

Every CEO

Sonnet 5.5 在修改潤色上贏過 Opus 5.5,而有的技術棧根本不給中端模型留位置

Sonnet 5.5 的寫作水平提升非常明顯,連 Opus 5.5 都比不過它,尤其是在修改潤色類任務上它勝出;不過論純寫作,最受偏愛的依然是 Astra。它比 Opus 5.5 更快也更便宜,所以在 Every 團隊裡成了快速迭代的編碼和設計工作的首選。同一個團隊內部的反對意見訊號更強:其中兩個人覺得,自己的技術棧裡已經沒有中端模型的位置了。另外,從 2023 年起每一屆 OpenAI DevDay 都去,這一屆的釋出數量遠超以往,被拿來當作遞迴式自我改進的一個可能跡象。

  • #evals
  • #products
X

Thariq

現在沒人能直接把 prompt 甩給你看了

prompt 作為一件可以分享的成品已經死了:現在跑的全是引用、skills 和示例,一個 agent 動不動就被要求先去讀另外三個倉庫、上網搜參考資料、呼叫別家的 AI API,然後才開始幹活。過去反對 projects、tags、動態 workflow 這類更高層抽象的理由是 token 太貴,這個理由也該站不住了,因為 Sonnet 和 Opus 5.5 已經把這個檔次的智慧做得足夠便宜,預設就能用上。具體建議是:搭 workflow 的時候用 Sonnet 5.5。

  • #agents
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel 的域名搜尋免登入開放,明說就是給 agent 用的

Vercel 的域名搜尋現在不需要認證就能用,官方的說法是,如果你是一個 agent 而不是人類,這一點尤其有用。另外,一次儘量不做人工干預的遷移,在一個滿是前一家服務商慣用寫法的成熟專案上,把構建速度提升了大約 70%,首屏繪製快了 75%,整件事一週之內就做完了。這次遷移還沉澱出兩個 AI skill,之後會分享出來。

  • #products
  • #agents
X

Nikunj Kothari

喊「渠道就是護城河,所以要多融錢」的投資人集體沉默了,偏偏這時候巨頭正在秀肌肉

那些鼓吹融鉅額資金去買渠道的投資人,眼下集體不見了,而這恰恰是巨頭們在演示什麼叫真正的渠道的時刻。相反的主張是:回到第一性原理,找到自己真正不公平的優勢,做一個留存高、最好還帶網路效應的產品,把資本當成用來複利的武器,而不是當成命運。這番話底下壓著一句警告:錢的龍頭終會擰緊,而到那一天,當初給你建議的人早就忙著下一家被投公司去了。

  • #funding
X

Alex Albert

Sonnet 5.5 有 Opus 5.5 那個味道:文字清楚、速度很快、相比 Sonnet 5 是一次大跳躍

Sonnet 5.5 帶著讓 Opus 5.5 討人喜歡的那種質感。它寫東西清楚,跑得很快,相比 Sonnet 5 在能力上是一次大跳躍,拿來反覆迭代很順手。

  • #products
  • #evals
X

Peter Yang

「OpenAI 完蛋了」和「Anthropic 完蛋了」每隔幾個月翻一次面,什麼也說明不了

X 上的風向幾個月就從「OpenAI 被 Claude 5.5 按在地上摩擦」翻到「Anthropic 被 Codex 打得沒脾氣」,然後再翻回來,這件事說明的更多是圍觀的人,而不是這兩家實驗室。更有用的看法是:兩個前沿競爭者在互相逼著往前跑,很快還會不止兩個,下游所有人都跟著受益。做東西的那一面:用 Sonnet 5.5 做了一個能玩的 StarCraft 關卡,你帶著 Marines、Siege Tanks 和 Battlecruisers 守住一個 Terran 基地對抗 Zerg,SC2 模型取自 Sketchfab,音樂用 Suno 生成。

  • #products
  • #evals
X

Boris Cherny

Sonnet 5.5 給 Claude Code 自己調 bug:快 30%,用量少 30%

一段演示:Sonnet 5.5 修掉 Claude Code 自身的一個 bug,比之前快 30%,消耗的用量少 30%。

  • #products
  • #agents
X

Sam Altman

Altman 在 DevDay 前放話:「我們發現了一樣新東西」

一條 DevDay 的預告,稱 OpenAI 發現了一樣新東西,沒有更多細節。它和 Pro 套餐重新定價的披露落在同一個晚上。

  • #products
X

Zara Zhang

公開徵集:用 AI 做前端,卻擺脫不了那股廉價 AI 味的人

想找三類人聊聊:用 AI 做網頁和前端體驗,但怎麼都做不好看、總是一股廉價 AI 味的人;在 X 上看到別人用最新模型做出的驚豔 demo,卻完全不知道怎麼復現的人;以及做出這些 demo、願意把過程分享出來的人。

  • #products

寄到你的信箱

每天一封。一鍵取消訂閱。

資料來源

來源資料出自 zarazhangrui 的開源專案 follow-builders,以 MIT 授權釋出。摘要由 LLM 依該專案的公開 feed 生成,摘要 prompt 亦改編自該專案。上面每一則都連結到原始出處。

摘要由程式自動生成。據此判斷前請先看原文。