13 条来自 13 位 builder

AI构建者摘要

真正在做 AI 的人今天说了什么。一页读完,约 5 分钟。

今天 Anthropic 把 Cowork 和对话合成了一个 Claude,Docs、Slides 和 Design 现在都住进了任意一个会话里,builder 圈子今天的讨论基本都绕着这个决定转。另一条线是又快又便宜的 inference:Vercel 把命令安全审查器换到一个更小的模型上,p95 快了 18 倍;企业圈的人也开始盘算,低成本的判断力到底该放在哪些环节。此外还有几条关于工具设计、agent skill 和 Claude 文风的犀利观点。

博客

Claude Blog

Claude Cowork 并入对话,Docs 和 Slides 以 beta 上线

Cowork 和对话现在合成了一个 Claude,接下来几周先推给 Pro 和 Max,Team 和 Free 随后跟上,Enterprise 的管理员会提前 30 天收到通知。Claude Docs 和 Claude Slides 是全新的,Claude Design 也搬进了对话里,所以一份报告和与之配套的演示稿可以从同一个会话里出来。你可以直接编辑、在 Claude 里演示,或者导出成 PowerPoint 和 PDF,最后全都落在同一个可分享的链接上。官方给的理由是:大家两个产品都在用,而最烦人的恰恰是判断某件事该放在哪边,何况两边之间什么都带不过去。

  • #products
  • #agents
X

Cat Wu

快答还是深度 agent 干活,现在 Claude 自己来判断

这次合并押的是模型已经足够好,好到可以替你做决定。Claude 会根据你的 prompt 判断该甩回一个快答,还是去做时间更长的 agent 工作,以及什么输出格式合适,而不是让你先选一个产品。用户反复在说的就是,他们不想选该打开哪个 Claude。你照样可以中途叫停它、给它改方向,或者把它的用力程度调高调低。

  • #products
  • #agents
X

Boris Cherny

合并的说法:一个把上下文带到任何地方的 Claude

Claude Code 证明了开发者可以把一个功能交出去,回来时看到的是已经上线的代码;Cowork 证明了知识工作者可以把一份简报交出去,回来时拿到的是做完的文件。把对话和 Cowork 合起来,就是走向「一个 Claude」的那一步:你手头在做的所有事,它都带着上下文。Docs、Slides 和 Design 现在存在于每一个会话里,所以你要一份演示稿,拿到的就是能打开、能编辑、能导出成 PowerPoint 或 PDF 的东西,不用再跳到另一个工具里去。

  • #products
  • #agents
X

Guillermo Rauch

Vercel CEO

Vercel 的 fx 命令审查器换小模型,p95 快了 18 倍

fx 默认跑在 auto 模式下,每条命令执行前都有一个安全审查器先分析一遍,这个审查器目前跑在 GPT Luna 上。换成 Jev 之后,p95 最多快了 18 倍,同时准确率还更高,这是少见的不用拿质量换延迟的情况。它接下来会进 Vercel AI Gateway,大概率会成为新的默认选项。

  • #agents
  • #products
X

Aaron Levie

Box CEO

又快又便宜的 inference,打开的是企业流程里的那些关卡

有一整片 AI 创新的天地,大多数人压根没放在视野里:用极低的成本、极快的速度、还带着不错的能力去处理信息,这会改变企业里什么事情算划算。该瞄准的不是那些抢头条的活儿,而是流程里的一道道关卡:数据分类、工作流内部的路由决策、特定领域的判断、快速的安全或合规判定。恰恰是这些卡点,决定了 agentic 工作流能不能在规模上跑得通。

  • #agents
  • #products
X

Thariq

想让 tool calling 可靠,光靠 bash 已经不够了

这是对去年那套想法的反转:如果目标是可靠的 tool calling,把什么都包进 bash 就是选错了抽象层。不如按你真正想要的样子,直接给 Claude 定义工具。比如存数据这件事,先问问自己你要的到底是一个文件系统,还是一个数据库的 API。沙箱加 bash 在涉及代码生成和执行的场景里仍然值回票价,而 Claude Managed Agents 的平衡点在于把沙箱做成可选、并且能独立于 agent loop 单独启停,把一个老的重度依赖 bash 的项目迁过来时,这套做法确实站得住。

  • #agents
  • #open-source
X

Peter Yang

八个 AI skill 做出一整期播客,品味那部分还是手工

一条完整的播客流水线跑在自定义 skill 上:/podcast-prep 研究嘉宾、起草访谈提纲;/podcast-edit 读原始逐字稿,和主持人一起挑开场片段的金句和剪辑点;/podcast-production 再调度另外五个 skill,把一期节目变成六份素材。反直觉的一点在 skill 本身。有人认为最新的模型已经让 skill 变得多余,但正是 skill 让 AI 去遵守具体的剪辑规则和浏览器操作指令,而不是给你一堆泛泛之谈。

  • #agents
  • #products
X

Madhu Guru

Meta Sr Director, AI

safety 和 security 是产品特性,不是外面塞进来的护栏

把 safety 和 security 当成外部强加的约束,整个框架就搞反了。它们是 AI 产品和模型本身的特性,应该作为能力长在里面,而不是作为合规要求焊在外面。

  • #policy
  • #products
X

Zara Zhang

Claude 的文风正在劝退人,至少劝退了一个 builder

最近越来越少用 Claude,因为它说话的方式已经让人受不了了。抱怨很具体:读起来像是在不停展示自己有多聪明、多有修养,而不是真的把要点说清楚。

  • #products
  • #evals
X

Nikunj Kothari

FPV Ventures Partner

折腾了几个月的家用 agent,能成是因为两个人一起在用

一个基于 Nous Research 的家用 agent,折腾几个月之后终于好用了。这是家里第一个群组 bot,两个人每天都在用,有意思的行为大多是在它出错的时候冒出来的。用 Grok Bot 之类的东西想复刻,怎么都达不到同样的颗粒度和控制力:只限定读取某些邮件、把内嵌附件转成结构化数据、通过已登录的浏览器会话干活。

  • #agents
  • #products
X

Garry Tan

Y Combinator President and CEO

随便换 harness,人格不变,记忆全在

可携带记忆的吸引力说白了就一句话:你想用哪个 harness 就用哪个,拿到的还是同一个人格,你那个 personal AGI 的完整记忆一点不少。一旦连续性由模型自己带着,客户端是哪个就不重要了。

  • #agents
  • #products
X

Claude

演示稿、文档、设计稿都能在会话里改,也能导出

在 Claude Docs 里起草一页纸,用 Claude Slides 把它变成一份演示稿,再用 Claude Design 配一张对应的视觉稿,全程不用离开对话。你可以自己动手改掉文档里的一句话,在某页幻灯片上给 Claude 留条评论,或者选中一个元素挪个位置;然后直接从 Claude 里开始演示,把文档导出成你惯用的格式,或者用一个链接把这一切分享出去。Design、Slides 和 Docs 目前在所有付费方案上处于 beta,之前放在 Cowork 里的东西全部平移过来:聊天记录、项目、artifact、连接器和 skill。

  • #products

发到你的邮箱

每天一封。一键退订。

数据来源

源数据来自 zarazhangrui 的开源项目 follow-builders,以 MIT 许可发布。摘要由 LLM 基于该项目的公开 feed 生成,摘要 prompt 亦改编自该项目。上面每一条都链接到原始出处。

摘要由程序自动生成。据此做判断前请先看原文。