7 条来自 7 位 builder

AI构建者摘要

真正在做 AI 的人今天说了什么。一页读完,约 4 分钟。

Anthropic 把 Claude in Chrome 推到了正式可用,同时公开了支撑这个决定的 prompt injection 数据。这是第一次有浏览器 agent 厂商在发布 GA 的同时,把分模型的攻击成功率一并摆出来。这一天剩下的内容,是一群 builder 从不同角度得出了同一个判断:agent 很快会成为软件的主要使用者,也会成为交易的主要通道,而那些围绕「人盯着屏幕看」建起来的生意,还没把这件事算进账里。工具那一侧,最有意思的争论反倒是反对给 agent 灌更多 context,而不是更少。

博客

Claude Blog

Claude in Chrome 正式可用,在浏览器里动手不用再逐次点确认

Claude in Chrome 现在对所有付费方案开放,默认会自己批准安全操作,不再每一步都问你一次,用的是和 Claude Code 里 auto 模式相同的机制。它瞄准的是那些根本没有集成可用的长尾场景:内部 dashboard、老系统、供应商门户,全都靠你已经登录的账号进去。Anthropic 把支撑这个决定的红队数据也一并公开了:在当前这套评测里,真正触达模型的攻击,在加防护之前对 Opus 4.5 的成功率是 17.6%,对 Opus 5 是 3.8%;加上探针和动作分类器之后,Sonnet 5 和 Opus 5 上没有一次攻击成功,Fable 5 是 0.3%。本地文件仍然要用桌面端,其他 Chromium 浏览器和手机上都还不能用。

  • #agents
  • #products
  • #security
X

Aaron Levie

Box CEO

替你下单的 agent,本身就变成了交易层

Levie 认为,个人 agent 的赚钱故事比「助手订阅」要大得多:一旦 agent 能端到端搞定任意复杂的任务,相当一部分交易就必然会从它这里走,而摩擦变小意味着人们花的钱比以前更多。这会同时在两层产生价值,一层是 agent 的提供方,另一层是 agent 在电商、本地生活和 b2b 服务里对接的那些东西。他的第二个判断是企业侧的镜像:agent 使用软件的量会是人类的 100 倍,而当一个 agent 可能执行破坏性操作、或者拿着错误的 context 干活时,那些最基础的能力不是变得不重要,而是更重要。机会在于谁能成为 agent 的安全层、数据管理方和工作流编排者。

  • #agents
  • #products
X

Peter Yang

agent 替你浏览网页,可能把定向展示广告这门生意掏空

Yang 的预测是:广告市场会迎来一次猛醒。如果你的生意是把定向展示广告放到人眼前,那么 agent 替人浏览你的站点、把事办完、全程没有一个人看过那个页面,这套模式就直接不成立了。他把自己的行为当作领先指标,说自己已经不住在邮箱和短信里,而是住在和 agent 的对话里。他还转述了一个来自 ChatGPT Finances 产品负责人 Ethan 的用例:Ethan 用积分订的酒店却被扣了款,之所以能发现,是因为 ChatGPT 标出了这笔支出,还帮他和客服沟通把钱要了回来。

  • #agents
  • #products
X

Nikunj Kothari

FPV Ventures Partner

tokenmaxxing 对应的是更差的产品,不是更好的产品

Kothari 说,除了少数例外,那些把 tokenmaxxing 挂在嘴边的公司,做出来的产品体验是最差的。好产品来自筛选和打理,而不是把所有东西一股脑塞给 agent,指望它自己理清楚。「少即是多」从没像现在这么贴切。他另外给出的判断是,Mac 上的 Codex 在 Computer Use 这类活上无人能敌,建议你挑一个平时手工做的流程,让它一次性全做完;同时他提到,真正让大众体会到「好 agent 是什么感觉」而且零配置的,是 Instinct 和 Muse。

  • #agents
  • #products
X

Garry Tan

Y Combinator President and CEO

在多步骤的大型 PR 上,Capy 跑赢了 Codex 和 Claude Code

Tan 把 capy.ai 称作他过去一周最喜欢的 agentic coding 利器,说它能跟住多步骤的工作流,交付大型 PR 的速度比单用 Codex 或 Claude Code 都快,不过他也承认自己不知道它是怎么做到的。他举的例子是在 GBrain 上一轮野心不小的批量修 bug:任务切分清楚、自动并行、GitHub PR 和 CI 流程干净。他还为 Cluely 做了一次就事论事的辩护,认为一个实时的思路助手、一个带着持续 context 的半对抗式助理,仍然是个好主意。

  • #agents
  • #products
X

Peter Steinberger

Meta 是受 OpenClaw 启发自己做了一个 agent,不是建在它上面

针对流传的「Meta 在用 OpenClaw」这个说法,Steinberger 做了更正:Nat 和他的团队是受它启发做了自己的 agent,这份功劳该记在他们头上。他还提到有一份针对 OpenClaw 的安全审查,没有查出严重问题,评价是他们功课做到位了。第三点是自托管 agent 的结构性理由:claw 跑在你自己手上,谁也封不了你。

  • #open-source
  • #agents
  • #security

发到你的邮箱

每天一封。一键退订。

数据来源

源数据来自 zarazhangrui 的开源项目 follow-builders,以 MIT 许可发布。摘要由 LLM 基于该项目的公开 feed 生成,摘要 prompt 亦改编自该项目。上面每一条都链接到原始出处。

摘要由程序自动生成。据此做判断前请先看原文。