12 条来自 11 位 builder

AI构建者摘要

真正在做 AI 的人今天说了什么。一页读完,约 5 分钟。

OpenAI 今天提前把 GPT-6 Astra 推给了所有人,几个小时内整条时间线就围着它重排了。Anthropic 在「让 agent 进你的浏览器」这条线上正面回应:Claude in Chrome 正式全量开放,并且能自主执行操作,同时给 Cowork 配了一个自己的浏览器。在模型新闻之下,Arm 的 CEO 提出了另一个判断:算力的瓶颈正在从芯片转移到数据中心本身。

X

Thibault Sottiaux

内部用 Astra 用出了效果,OpenAI 把路线图整整提前了半年

Astra 还在内部使用的阶段,就已经是 OpenAI 最大的竞争优势,生产力提升幅度大到团队把计划提前了六个月,从明年年中改成在 DevDay 发布。这次上线比原定时间还要早,OpenAI 同时给所有 Plus、Pro 和 Business 用户配了一次完整的额度重置,当天生效。下周还会有更多东西发出来。

  • #products
博客

Claude Blog

Claude in Chrome 正式全量,不用再一步一确认

Claude in Chrome 已对所有付费方案全量开放,Claude 现在会自动放行它判断为安全的操作,而不是每一步都来问你,用的是和 Claude Code 里 auto 模式相同的机制。一个分类器会拿每个待执行操作去比对你实际提出的要求,不匹配就拦下来;这一层之上还有探测器,会在 Claude 动作之前扫描网页内容里是否被注入了指令。看数据:在当前的红队评测中,触达模型的攻击在无任何防护时,对 Opus 4.5 成功率 17.6%,对 Opus 5 为 3.8%;加上探测器和分类器之后,Sonnet 5、Opus 5、Mythos 5 上无一得手,Fable 5 为 0.3%。它会用你已有的登录态去读页面、点击、输入和填表单,而这正是关键所在:那些永远不会有 connector 的内部看板和供应商门户,终于有办法接进来了。

  • #agents
  • #products
  • #security
博客

Claude Blog

Cowork 有了自己的浏览器,Claude 不用再借你的

桌面端的 Claude Cowork 现在内置了一个浏览器,任务需要上网时会在侧边栏打开,和你自己的浏览器相互独立,看不到你的标签页、书签和密码。你可以按站点从 Chrome、Edge 或 Firefox 逐个把登录态迁过来,银行、邮箱和 SSO 类站点默认排除,除非你主动放行。这个切分是有意为之:内置浏览器用来把活交出去、让它自己做,你继续忙别的;而眼前这个页面上的事,仍然交给 Claude in Chrome。本周向 Pro、Max 和 Team 陆续开放,Enterprise 管理员今天即可使用。

  • #agents
  • #products
播客

No Priors

Arm CEO:天花板不是芯片供应,是数据中心的建设

Rene Haas 认为 AI 的供给紧张至少还要持续三到五年,而下一个瓶颈是实体施工,不是晶圆或内存。几乎没有哪个数据中心项目跑在进度前面,或者用工低于预算;本地对新建项目的反对又加了一道刹车。他反倒觉得这近乎是件幸事,因为否则真正卡住的会是晶圆和内存产能。谈到供给过剩与需求的关系,他的原话是:「差得远呢。」在 Arm 内部,80% 到 90% 的工程师每天都在用 AI,主要用在验证、确认和 debug 上,而这几件事在一个 24 到 36 个月的芯片周期里占掉的时间远超架构设计。他最犀利的一点是解释 AI 为什么还写不好 RTL:专有 IP 交付时往往既没有文档也没有 test bench,「不可用、不可测,其实就是不可训练」。他还反驳了「加速器让 CPU 变得无关紧要」的说法,理由是总得有东西来调度这些生成出来的 token 去哪儿,而这份活至今仍然是微处理器的。

  • #hardware
  • #policy
X

Guillermo Rauch

Vercel CEO

Rauch 谈 WebMCP:agent 应该跑在我们已经建好的 web 上

Guillermo Rauch 押注 WebMCP,他用了一个 Tesla FSD 的类比:agent 得去适应现实中的 web,街道、红绿灯、坑洼都得照单接受,而不是要求另建一套平行的基础设施。他举的具体收益是,Next.js 的 dev 页面可以把调试工具直接暴露给正在测试这个标签页的 agent,还带着页面特有的上下文,省得它去翻服务端日志。不需要另外找一个 MCP server 再配置,因为页面自己就带着 agent 工具。在那样的世界里,他认为一个驱动浏览器的 agent 加一个 dev server 就是一套完整的 web stack,调试深度一点不打折。

  • #agents
  • #products
X

Garry Tan

Y Combinator President & CEO

Garry Tan:OpenClaw 折腾两小时的配置,换成 Aside 只花三分钟

把 OpenClaw 接到 Slack 花了 Tan 两个小时;同样的活放在 Aside 的 harness 上,带完整集成和浏览器访问,三分钟不到就搞定,开箱就是合理的访问控制默认值。他已经把 Aside 的浏览器设为 GStack 的首选远程会话浏览器,并称这是他找到的、以你自己身份给 agent 提供网页访问和凭据的最好方式。他的判断是,Aside 不只是一个浏览器,而是凭据管理器、集成层、harness 和记忆系统的合体。

  • #agents
  • #products
X

Madhu Guru

Meta Sr Director, AI

学 AI 产品开发最快的路:把一个你已经吃透的流程自动化掉

Madhu Guru 给的周末练习是,挑一个你闭着眼都清楚的流程,工作上的或生活里的都行,用任何你顺手的 AI 产品把它端到端全自动化。做完一遍会逼出四个光靠读读不出来的问题:真正优秀的端到端体验长什么样、怎么用 MCP 和工具、哪些环节必须留人在回路里、以及结果该怎么评估。然后再不断抬高目标。他的说法是,走一遍这个过程,胜过花一个月读 AI 产品开发的文章。

  • #agents
  • #products
X

Swyx

前沿模型在 AI 媒体里已经开始偏心了

Swyx 正在做一份覆盖多个前沿模型的大型 AEO 报告,他发现问 Claude 最好的 AI newsletter 或播客是哪个,Claude 会点名 Latent Space。这个结果让他意外到先去查了一遍 harness 里有没有记忆泄漏,然后才敢信。

  • #evals
X

Zara Zhang

人们对 AI 写作的评价,高于它的实际水平

Zara Zhang 认为真正值得注意的落差在感知层面:大多数人觉得 AI 写得比它实际写得好。言下之意是,读者给机器写的东西定的标准,比给人定的要低。

  • #evals

发到你的邮箱

每天一封。一键退订。

数据来源

源数据来自 zarazhangrui 的开源项目 follow-builders,以 MIT 许可发布。摘要由 LLM 基于该项目的公开 feed 生成,摘要 prompt 亦改编自该项目。上面每一条都链接到原始出处。

摘要由程序自动生成。据此做判断前请先看原文。