15 条来自 15 位 builder

AI构建者摘要

真正在做 AI 的人今天说了什么。一页读完,约 5 分钟。

Anthropic 发布了 Sonnet 5.5,开发者的反应来得很快,而且难得地给出了具体数字:在 Claude Code 里每个 token 能多干大约 30% 的活;Box 则公布了一份完整的企业级评测,交付速度快了 2.4 倍,token 还少用 12%。与此同时,OpenAI 赶在 DevDay 前几个小时提前披露了 200 美元 Pro 套餐的重新定价,实际可用量砍到原来按 API 消费折算的一半左右,同时承诺不会把 5 小时限制请回来。串起这些的一条线是:中端模型已经好到有开发者说,自己的技术栈里已经没有它们的位置了。

X

Thibault Sottiaux

OpenAI 重开 200 美元 Pro 订阅,实际用量砍半,赶在 DevDay 前夜官宣

200 美元的 Pro 订阅重新对新用户开放,用量的计算方式变了,折算下来大约只有老套餐对应 API 消费的一半。给出的理由有两条:不会把 5 小时限制请回来,所以每周的用量可以随便花;也不愿意为了让订阅显得更划算,就硬把 API 标价往高了抬。背后的判断是 API 价格会继续快速下降,降到「按需买用量」和「订阅」两条路殊途同归,佐证是本周上线的 GPT-6 Sol 和 GPT-6 Luna,价格只有此前的 50%。订阅里还会加进一样不占用量的新东西,要等到正式发布才揭晓。

  • #products
  • #pricing
X

Aaron Levie

Box CEO

Box 的企业级评测:Sonnet 5.5 交付速度快 2.4 倍,token 少用 12%

Box 在早期访问阶段用 Box Agent 跑了自家的复杂任务评测,Sonnet 5.5 在最难的那批测试上总分提高 4 分,做出最终交付物的速度快了大约 2.4 倍,同时少用 12% 的 token。分行业的提升更明显:金融服务 +18 分,生命科学 +8 分,法律和公共部门各 +7 分。真正有意思的是具体任务上的表现。在一份尽职调查复核里,它揪出了交易文件中算错的利息合计和定价有误的期权;在一份商业租约复核里,它拒绝为续租条款编造一个所谓的「标准」市场基准,转而指出租约里实际缺了什么。Sonnet 5.5 很快会进入 Box AI Studio。

  • #evals
  • #agents
  • #products
X

Cat Wu

Sonnet 5.5 在 Claude Code 里多完成约 30% 的任务,靠的是少用 token 而不是多用

在 Claude Code 里,用户用 Sonnet 5.5 完成的任务比用 Sonnet 5 多出大约 30%,起作用的是智能本身而不是预算:同样的活它需要的 token 更少。一个用工具调用耙院子的演示,比 Sonnet 5 快了 24 秒,token 还少用 6000 个。

  • #products
  • #agents
X

Dan Shipper

Every CEO

Sonnet 5.5 在修改润色上赢过 Opus 5.5,而有的技术栈根本不给中端模型留位置

Sonnet 5.5 的写作水平提升非常明显,连 Opus 5.5 都比不过它,尤其是在修改润色类任务上它胜出;不过论纯写作,最受偏爱的依然是 Astra。它比 Opus 5.5 更快也更便宜,所以在 Every 团队里成了快速迭代的编码和设计工作的首选。同一个团队内部的反对意见信号更强:其中两个人觉得,自己的技术栈里已经没有中端模型的位置了。另外,从 2023 年起每一届 OpenAI DevDay 都去,这一届的发布数量远超以往,被拿来当作递归式自我改进的一个可能迹象。

  • #evals
  • #products
X

Thariq

现在没人能直接把 prompt 甩给你看了

prompt 作为一件可以分享的成品已经死了:现在跑的全是引用、skills 和示例,一个 agent 动不动就被要求先去读另外三个仓库、上网搜参考资料、调用别家的 AI API,然后才开始干活。过去反对 projects、tags、动态 workflow 这类更高层抽象的理由是 token 太贵,这个理由也该站不住了,因为 Sonnet 和 Opus 5.5 已经把这个档次的智能做得足够便宜,默认就能用上。具体建议是:搭 workflow 的时候用 Sonnet 5.5。

  • #agents
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel 的域名搜索免登录开放,明说就是给 agent 用的

Vercel 的域名搜索现在不需要认证就能用,官方的说法是,如果你是一个 agent 而不是人类,这一点尤其有用。另外,一次尽量不做人工干预的迁移,在一个满是前一家服务商惯用写法的成熟项目上,把构建速度提升了大约 70%,首屏绘制快了 75%,整件事一周之内就做完了。这次迁移还沉淀出两个 AI skill,之后会分享出来。

  • #products
  • #agents
X

Nikunj Kothari

喊「渠道就是护城河,所以要多融钱」的投资人集体沉默了,偏偏这时候巨头正在秀肌肉

那些鼓吹融巨额资金去买渠道的投资人,眼下集体不见了,而这恰恰是巨头们在演示什么叫真正的渠道的时刻。相反的主张是:回到第一性原理,找到自己真正不公平的优势,做一个留存高、最好还带网络效应的产品,把资本当成用来复利的武器,而不是当成命运。这番话底下压着一句警告:钱的龙头终会拧紧,而到那一天,当初给你建议的人早就忙着下一家被投公司去了。

  • #funding
X

Alex Albert

Sonnet 5.5 有 Opus 5.5 那个味道:文字清楚、速度很快、相比 Sonnet 5 是一次大跳跃

Sonnet 5.5 带着让 Opus 5.5 讨人喜欢的那种质感。它写东西清楚,跑得很快,相比 Sonnet 5 在能力上是一次大跳跃,拿来反复迭代很顺手。

  • #products
  • #evals
X

Peter Yang

「OpenAI 完蛋了」和「Anthropic 完蛋了」每隔几个月翻一次面,什么也说明不了

X 上的风向几个月就从「OpenAI 被 Claude 5.5 按在地上摩擦」翻到「Anthropic 被 Codex 打得没脾气」,然后再翻回来,这件事说明的更多是围观的人,而不是这两家实验室。更有用的看法是:两个前沿竞争者在互相逼着往前跑,很快还会不止两个,下游所有人都跟着受益。做东西的那一面:用 Sonnet 5.5 做了一个能玩的 StarCraft 关卡,你带着 Marines、Siege Tanks 和 Battlecruisers 守住一个 Terran 基地对抗 Zerg,SC2 模型取自 Sketchfab,音乐用 Suno 生成。

  • #products
  • #evals
X

Boris Cherny

Sonnet 5.5 给 Claude Code 自己调 bug:快 30%,用量少 30%

一段演示:Sonnet 5.5 修掉 Claude Code 自身的一个 bug,比之前快 30%,消耗的用量少 30%。

  • #products
  • #agents
X

Sam Altman

Altman 在 DevDay 前放话:「我们发现了一样新东西」

一条 DevDay 的预告,称 OpenAI 发现了一样新东西,没有更多细节。它和 Pro 套餐重新定价的披露落在同一个晚上。

  • #products
X

Zara Zhang

公开征集:用 AI 做前端,却摆脱不了那股廉价 AI 味的人

想找三类人聊聊:用 AI 做网页和前端体验,但怎么都做不好看、总是一股廉价 AI 味的人;在 X 上看到别人用最新模型做出的惊艳 demo,却完全不知道怎么复现的人;以及做出这些 demo、愿意把过程分享出来的人。

  • #products

发到你的邮箱

每天一封。一键退订。

数据来源

源数据来自 zarazhangrui 的开源项目 follow-builders,以 MIT 许可发布。摘要由 LLM 基于该项目的公开 feed 生成,摘要 prompt 亦改编自该项目。上面每一条都链接到原始出处。

摘要由程序自动生成。据此做判断前请先看原文。