11 件10 人の builder から

AI Builders Digest

AI を実際につくっている人たちが今日話したこと。1 ページ、約 6 分。

Anthropic は Claude に専用のブラウザを持たせ、Claude in Chrome を一般提供に切り替えました。自律的に動かせる根拠として、攻撃の実測値も公開しています。NVIDIA は Hugging Face を買収し、オープンソース AI の重心が一気にそこへ移りました。Box は為替影響を除いた成長率で 14 四半期ぶりの好成績を出し、agent の実力は結局アクセスできる非構造化コンテンツで決まる、という主張を打ち出しています。

X

Matt Turck

NVIDIA による Hugging Face 買収で、オープンソース AI の本丸が決まった

オープンウェイトの標準的な置き場を NVIDIA が手にし、Hugging Face と Nemotron が同じ屋根の下に入りました。読み筋としては、Hugging Face が長年つきまとわれてきたビジネスモデルの問いからようやく解放され、オープンソース AI が資金の上限を気にしない持ち主を得た、ということです。Turck は最近のインタビューでいくつかの見立ても並べています。NVIDIA は世界で最も優れたベンチャーファームかもしれないこと、lab がアプリ化するより速くアプリが lab 化していること、そして AI バブルへの懸念の正体は、実のところ期間のミスマッチへの懸念だということです。

  • #open-source
  • #funding
ブログ

Claude Blog

Claude が Cowork の中に自前のブラウザを持つようになった

Cowork のデスクトップアプリに Claude 専用のブラウザが組み込まれ、サイドパネルで開いて、あなたが作業を続けている間にページの移動、クリック、入力、フォームの記入までこなします。これはあなたのブラウザではなく Claude のブラウザです。タブもブックマークもパスワードも共有されず、ログインはサイトごとに自分で移していく形で、銀行、メール、SSO は明示的に許可しない限り対象外です。今週から Pro、Max、Team に順次提供され、Enterprise の管理者はすでに有効化できます。すでに開いているページを扱うなら Claude in Chrome のほうが適していますし、普段から使っている人はそのまま既定のままで構いません。

  • #agents
  • #products
ブログ

Claude Blog

Claude in Chrome が一般提供に、一手ごとの承認なしで動けるように

Claude in Chrome がすべての有料プランで一般提供になり、毎回確認を取る代わりに、安全だと判断した操作を Claude が自動承認するようになりました。これを成立させているのは三段構えです。増え続ける実際の prompt injection 攻撃のライブラリを使った訓練、Claude が結果に基づいて動く前に tool の出力を走査する probe、そして保留中の各操作があなたの依頼内容と合っているかを照合する分類器です。数字も具体的です。難易度の高いレッドチーム評価では、モデルまで到達した攻撃の成功率は、保護機構なしで Opus 4.5 が 17.6%、Opus 5 が 3.8% でした。probe と安全分類器を組み合わせると、Sonnet 5 と Opus 5 では成功例がゼロ、Fable 5 は低深刻度のシナリオで 0.3% にとどまりました。

  • #agents
  • #security
  • #evals
X

Aaron Levie

Box CEO

Box が四半期 3.21 億ドル、superintelligence の上限は「読めるもの」で決まると主張

Box の第 2 四半期売上は 3 億 2,110 万ドルで、前年同期比 9%、為替影響を除くと 11% の増加でした。為替中立ベースでは 14 四半期ぶりの高い成長率で、通期目標も 12 億 9,000 万ドルへ引き上げています。エンタープライズ顧客への訴求はシンプルで、世界最先端の superintelligence も、アクセスできる社内知識の分しか役に立たないというものです。そして企業の知識の大半はデータベースではなく、契約書、財務資料、ロードマップといった非構造化コンテンツの中にあります。技術責任者からは決まって二つの要望が出てきます。token の利用量が増えていく中で、既存のワークフローに載せるモデルや agent を差し替えられること。そして、人にも agent にも触らせてはいけないデータに手が届かないよう、強制力のあるガードレール、監査ログ、リアルタイムのアラートを備えていることです。

  • #agents
  • #products
X

Claude

Claude のブラウザはインストール不要、あなたのブラウザとは切り離されたまま

Cowork のタスクに Web サイトが絡むと、サイドパネルにブラウザが開き、Claude がページを移動し、フォームを埋め、仕事を最後まで片づけます。インストールするものはありません。デスクトップアプリに内蔵されていて、あなた自身のブラウザやログイン情報とは分離されたまま動きます。提供は今後 1 週間かけて、すべての有料プランに広がります。Claude in Chrome もすべての有料プランで一般提供になり、すでに使っている人はそのまま既定として使い続けられます。

  • #agents
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel が agent 向けにグローバルな sandbox コンピュートを開放、セキュリティ点検 CLI も

agent がフェイルオーバー付きのマルチリージョン環境で動かせるようになり、デフォルトで最大 10,000 の同時 sandbox、ランプアップは毎分 5,000 vCPU まで対応します。対応リージョンは今後さらに増えます。あわせて Vercel はセキュリティダッシュボードと `vercel security check` の CLI を提供します。人が確認しながら agent にセキュリティ状態を改善させることも、cron で回すこともできる作りです。`is-agentic` と同じ発想で、agent が実際に触るインターフェースは CLI だ、というわけです。

  • #agents
  • #products
  • #security
X

Aditya Agarwal

SPC General Partner

DeepCogito が 4,300 万ドルの Series A、フロンティアは post-training で決まると賭ける

主張は率直です。AI のフロンティアを決めるのは pretraining ではなく post-training だ、というものです。DeepCogito は post-training を専門とする研究ラボで、大規模な強化学習と再帰的な自己改善に取り組んでいます。中核の手法は iterated distillation and amplification で、3B から 600B 超までのモデルですでに公開の形で実証されています。今回のラウンドには Benchmark、TQ Ventures、Atreides、Nexus VP、Zscaler が参加しました。創業者の Drishan Arora と Dhruv Malrana は 14 年来の知り合いで、2024 年 3 月に Founder Fellows として SPC と出会っています。

  • #funding
  • #research
ポッドキャスト

AI & I by Every

運用資産 100 億ドルのヘッジファンドが AI 利用を必須化、「隠すな」と社内に通達

Walleye のオーナー兼経営者は全社宛のメモをこう書き出しました。「このメールも ChatGPT で書いている。みんなも使うべきだし、それを誇っていい」。さらに「ヘッジファンドである以上、自分たちを速く、賢く、有能にするツールを無視して取り逃がすのは恥ずべきことだ」と続けます。彼が解こうとしていたのは、まさに「恥ずかしさ」の問題でした。社員はドラフトを AI に書かせたあと、機械が書いたと思われないようにわざと粗く直していたのです。今では 400 人規模の会社のうち約 75% が週次でチャットアシスタントを使い、およそ 3 分の 1 が AI のコーディングツールを使っています。社内プロダクトの Current は、提出書類やブローカーのレポート、決算のトランスクリプトをロングショート担当向けの分析に変えるもので、外部 50 社以上からベータ利用の希望が来ています。ただし限界についても彼は慎重です。これらのツールは考える必要をなくすものではなく、機械的なタイピングの時間を買い戻して、その分よく考えられるようにするものだ、と。考えずに生成したとわかる社内レポートは、やはり通りません。実在する会社の中で生産性向上をベンチマークすること自体に意味があるという考えも、彼は退けています。この変化の局面でリーダーがやるべき仕事は、全社の 3 分の 1 が見ている前でデモが失敗しても何も失われない、という空気をつくることだと言います。

  • #enterprise
  • #products
X

Thariq

Claude Code に SendFeedback tool、壊れたところを Claude に伝えるだけでよくなった

/feedback を実行して自分で報告を書く代わりに、Claude に下書きさせて承認するだけで済むようになりました。別件として、Anthropic の顧客の一部が不正なリクエストの被害に遭っています。この種の悪用は、正規のユーザーに提供できる内容そのものを痩せさせます。Stripe が対応に動いていますが、やるべきことはまだ残っています。

  • #products
  • #security
X

Zara Zhang

大企業の PR チームの多くは、本当のマーケティングを止めるために存在している

会社のブランドを強くするために作られた部署が、結果としてブランドの足を引っ張る。組織構造の皮肉としては、これ以上ない部類です。関連して名指ししておきたいダブルスタンダードがあります。AI による執筆について、「自分が使うのは構わないが、あなたが使うのは駄目だ」という地点に落ち着く人がかなりいることです。

  • #marketing

メールで受け取る

1 日 1 通。購読解除はワンクリックです。

データの出どころ

元データは zarazhangrui によるオープンソースプロジェクト follow-builders(MIT ライセンス)から取得しています。要約はそのプロジェクトの公開フィードをもとに LLM が生成し、要約プロンプトも同プロジェクトを改変したものです。上記の各項目は原文にリンクしています。

要約は自動生成です。判断の根拠にする前に原文をご確認ください。