14 条来自 13 位 builder

AI构建者摘要

真正在做 AI 的人今天说了什么。一页读完,约 7 分钟。

今天,模型能不能用变成了一个站队问题:OpenAI 将在 11 月 12 日切断 Cursor 对 GPT 模型的访问,Anthropic 在同一天表态与 Cursor 的合作继续,Replit 则直接掏钱请企业客户搬家。Anthropic 还两度公开了自己的工程细节,一次解释了让 Claude Code 被吐槽整整一个月的三处改动,一次讲清了新的 Managed Agents 服务底下的架构。而在这些消息之下,好几位 builder 从不同角度说了同一件事:你现在坚信的任何一条 AI 判断,几个月后就会过期。

X

Thibault Sottiaux

OpenAI 将于 11 月 12 日切断 Cursor 的 GPT 模型访问

OpenAI 结束与 Cursor 的合作,11 月 12 日起不再通过它提供模型访问,官方给出的理由是信任问题,而不是成本或算力。想继续在 Cursor 里用 GPT 模型的开发者可以自带 OpenAI API key,OpenAI 的 IDE 扩展在 Cursor 里也照常可用。这个表态针对的是一家公司,不是对第三方工具的收缩:OpenAI 说会继续支持尽可能广泛的 harness,开源闭源都算,也会继续投入自己的开源工作。

  • #products
  • #developer-tools
X

Thariq

Anthropic 表示与 Cursor 的合作继续

Claude Code 团队的 Thariq 说自己长期以来一直欣赏 Cursor,认为在把 AI coding 推向大众这件事上没几家做得比它更多,Anthropic 很期待继续跟他们合作。这条正好发在 OpenAI 宣布相反决定的同一天,所以对在 Cursor 里做开发的人来说,实际含义很清楚:Claude 这条通道没有倒计时。

  • #products
  • #developer-tools
X

Amjad Masad

Replit CEO

Replit 出钱资助企业从 Cursor 迁走

Amjad Masad 公开表态,任何想要一个独立、多模型的 Cursor 替代方案的企业,Replit 都愿意出钱资助迁移。他的卖点是:OpenAI 模型在 Replit 上免费,而 Replit 的 router 能让高端模型用得起。这是对 OpenAI 断供 Cursor 最快的一次竞品回应,消息出来几小时内就发了。

  • #products
  • #developer-tools
博客

Anthropic Engineering

Anthropic 复盘:Claude Code 被吐槽一个月,源头是三处互不相干的改动

让大家觉得 Claude Code 变笨的,是三处互不相干的改动,而不是偷偷降级模型,API 自始至终没有受影响。3 月 4 日,默认 reasoning effort 从 high 降到 medium,本意是解决长思考时界面看起来卡死的问题,用户却读成了智力下降,4 月 7 日已回滚,现在 Opus 4.7 默认 xhigh,其余一律 high。3 月 26 日的一处缓存优化,本该只对闲置会话清理一次旧的思考内容,实际却在该会话后续每一轮都清,于是 Claude 变得健忘又啰嗦,还因为反复 cache miss 白白消耗用量额度,4 月 10 日随 v2.1.101 修复。4 月 16 日加进 system prompt 的一行限制,把工具调用之间的文字压到 25 词、最终回复压到 100 词,在一项评测上让 Opus 4.6 和 4.7 都掉了约 3%,4 月 20 日回滚,Anthropic 会为所有订阅用户重置用量额度。

  • #products
  • #evals
博客

Anthropic Engineering

Anthropic 把 agent 的大脑和手拆开,首 token p50 延迟降低 60%

Managed Agents 是 Claude Platform 上面向长周期 agent 的托管服务,它押的是这样一个判断:随着模型变强,今天的 harness 一定会过时,所以把三样东西虚拟化成可替换部件,会话日志、harness、sandbox。把 harness 从容器里拎出来之后,两边都从宠物变成了牲口,容器挂掉只会以一个工具调用报错的形式出现,而不是整个会话丢失;harness 崩了就重启,从日志里最后一个事件接着往下跑。因为会话存在 context window 之外,agent 可以按位置切片重读自己的历史,而不必对留什么、丢什么做出不可逆的压缩决策。只在工具调用真正需要时才开容器,这一条把首 token 的 p50 延迟压低了约 60%,p95 降了 90% 以上;凭据现在放在 vault 或预配置好的 git remote 里,sandbox 能用,但读不到。

  • #agents
  • #products
播客

No Priors

企业内鬼变成了你自己批准的那个 agent

企业数据的威胁模型翻转了:危险的不再是拿着盗来凭据的外部人,而是公司自己批准的 agent,它权限合法,能以机器速度删掉一张生产表。Eon 的联合创始人说,检测方法论从勒索软件时代可以沿用,但速度这一项沿用不了;半年前没人愿意跟他们聊这个话题,现在他们见到的高管几乎人人要么亲历过,要么正在担心。他们有个反直觉的判断,agent 不会杀死 dashboard,反而会让它变多:"我其实觉得 dashboard 会更多,因为这将是搞清楚外面到底在发生什么的唯一办法。"他们还把 Google 花 1000 万美元买下破产的 Spirit Airlines 数据(不含飞机)看作一波破产数据收购的开端,因为行为上真的像一家公司的训练数据几乎找不到。

  • #agents
  • #security
X

Guillermo Rauch

Vercel CEO

网页正在裂成两半,一半取悦人,一半喂机器,而 agent 就是浏览器

Guillermo Rauch 认为网页正在向两个极端撕开:一端是为愉悦感、探索感和品牌服务的极致人类体验,另一端是给机器看的、纯粹无损的信号,markdown 和 MCP 只是后者露出水面的部分。中间那一大片会被 agent 吞掉,由它在你需要时即时生成 UI,于是 agent 成了新的浏览器。他拿 mcp-handler 的 npm 下载量作证据,说明 MCP 的采用早已超出 Vercel 自家 server 的范围。与之配套的是他在推的 eve:agent 从一个 Git repo 起步,整套智能栈都归你所有,运行时、模型选择、skills、工具、连接能力、sandbox。

  • #agents
  • #products
X

Aaron Levie

Box CEO

任何一条坚信的 AI 观点,半衰期都是六个月

Aaron Levie 列了一串行业已经轮过一遍、如今再无共识的判断:开源差太远追不上、大模型公司规模化后不可能盈利、所有软件都会被 agent 取代、在模型之上建不起护城河、模型变便宜意味着算力需求下降、不需要做 evals、RAG 已死、训练已经撞墙。他的意思不是说哪一条错了,而是说一条被广泛坚信的 AI 判断,平均撑不过六个月。给出的实操建议只有一条:保持灵活,因为在相当一段时间里,持续变化本身就是稳态。

  • #industry
X

Madhu Guru

Meta Senior Director of AI

AI 产品的打法现在三个月就作废一次

传统产品团队的构造是找到一套打法,然后吃五年。Madhu Guru 说,在 AI 实验室内部,团队每隔几个月就主动把打法扔掉,一看到边际收益递减就扔。他的处方是别再围着打法做优化,转而为两件事定下元原则:怎样持续搞清楚市场今天要什么、三个月后又会要什么;以及怎样以极端的紧迫感执行。老牌团队是为吃老本优化的,AI 团队必须为不断发明优化。

  • #products
  • #industry
X

Peter Yang

agent 该长成的样子是 Grok Bot,不是 ChatGPT Work 或 Claude Cowork

Peter Yang 认为 Claude Cowork 和 ChatGPT Work 都只是半截方案,面向非技术用户的 agent 产品,Grok Bot 更接近该有的终态。理由不在能力,而在可理解性:一台跑在云上的电脑,普通人一听就懂。让一个普通用户解释 ChatGPT Work 和 Codex 有什么区别,或者 Claude Cowork 到底怎么运作,他赌几乎没人说得清。

  • #agents
  • #products
X

Zara Zhang

判断 slop 看的是有没有视角,而不是谁写的

Zara Zhang 判断 slop 的标准跟是不是机器写的完全无关。关键在于这东西背后有没有具体而独特的人的经历和视角,按这个标准,人写的 slop 也多得是。她还提了一个 builder 们都在悄悄回避的现实问题:如果你在 Grok Bot 的虚拟电脑里登录自己的真实 X 账号,让它去处理你的时间线、书签或关注列表,账号会不会被标记甚至封禁。她说正是这份担心,让她在把账号权限交给任何 agent 这件事上极其谨慎。

  • #agents
  • #security
X

Aditya Agarwal

SPC general partner

H-1B 确实被滥用,但把高技能人才挡在门外同样有代价

Aditya Agarwal 一路走过 F1、OPT、CPT、H-1B 和 EB-3 绿卡才拿到公民身份,他说有四件事可以同时成立。H-1B 体系确实存在滥用,挤占了正当用途,他乐见政府出手整治。同时这个国家让真正的高技能人才留下来太难了,而他认为这些人才是美国实力的巨大来源,其中高技能印度人的处境最艰难。第四点是任何国家的法律都应当优先考虑本国公民。他这番话是说给那些自己没走过签证流程却在对签证问题指点江山的人听的。

  • #policy
X

Dan Shipper

Every CEO

没有坏的 AI 点子,只有还不够强的模型

Dan Shipper 给所有产品做砸了的人换了个说法:在 AI 里没有坏点子,只有还不够强的模型,指数曲线继续往上走,每个点子终会等到属于它的那一天。这是在说失败的尝试应该封存,而不是砍掉。他还宣布 Every 现在有了一位 head of evals,具体在做什么暂时保密。

  • #products
  • #evals
X

Nikunj Kothari

FPV Ventures partner

最好的 pitch 根本用不着提 AI

Nikunj Kothari 希望创始人在下一轮融资前先记住两条:最强的 pitch 从来不需要用到 AI 这个词,而且 AI 不能是"为什么是现在"的唯一答案。他强调这只是自己的主观看法,不代表 VC 的通行标准,但话里的意思是,一个只靠技术转折点撑着的 pitch,读起来就像这家公司没有别的存在理由。

  • #funding

发到你的邮箱

每天一封。一键退订。

数据来源

源数据来自 zarazhangrui 的开源项目 follow-builders,以 MIT 许可发布。摘要由 LLM 基于该项目的公开 feed 生成,摘要 prompt 亦改编自该项目。上面每一条都链接到原始出处。

摘要由程序自动生成。据此做判断前请先看原文。