7 件7 人の builder から

AI Builders Digest

AI を実際につくっている人たちが今日話したこと。1 ページ、約 3 分。

今日いちばん盛り上がったのは「スピード」をめぐる話でした。Aaron Levie は、superintelligence が実現しても結局は許認可や change management、返信に3週間かかる顧客に足を引っ張られると論じ、Dan Shipper は自動化予測のほとんどが暗黙に置いている前提そのものに切り込みました。リリース面では、Anthropic が Claude Marketplace を公開し、企業はコミット済みの予算をサードパーティ製の agent に使えるようになりました。Vercel はこの半年の値下げ実績をまとめています。

X

Aaron Levie

Box CEO

今後10年のボトルネックはモデルの能力ではなく、AI の普及そのもの

モデルがこれだけ賢いのに GDP にはほとんど表れない。そのギャップの正体は、企業という組織の物理法則です。データを整え、業務プロセスを作り直し、そもそも新しいワークフローとは何なのかを関係者で合意する。そこを抜けても、今度は現実世界の速度が待っています。提案書に対する顧客の返事、許認可、何年もかかる創薬パイプライン。Levie はさらに、coding agent が誰の想定よりもはるかに広い領域へ入り込むと見ています。サイバー防御、ライフサイエンス研究、レガシーシステムの刷新、これまでソフトウェアに手が届かなかった企業向けの開発まで。直感に反する結論はこうです。コードが安くなるとエンジニアリングのレバレッジが上がりすぎて、必要なエンジニアは減るどころかむしろ増える。

  • #agents
  • #products
X

Claude

Claude Marketplace が公開、CrowdStrike、Cursor、Factory、Gamma、Vercel が参加

企業は Anthropic との既存の支出コミットメントを、サードパーティが提供する Claude ベースのプロダクトや agent の購入に充てられるようになりました。Claude Platform 上で開発している企業は掲載を申請でき、顧客は別途の調達プロセスを踏まずに購入までたどり着けます。

  • #products
  • #agents
X

Dan Shipper

Every CEO

自動化を「タスク分解」で捉えるモデルには、항抜けている項がある

AI と雇用についてよくできたレポートでも、2つの前提が黙って全部の仕事をしています。仕事はタスクに分解できるという前提と、自動化は人間の労働を減らすか、よくても横ばいに留めるという前提です。Shipper の実感では後者は端的に間違いで、自動化はしばしば人間の仕事を何倍にも増やします。誠実な経済分析なら、仕事が生まれる側もモデルに入れなければいけない。前者についても、タスクのリストは有用なレンズではあるものの全体像ではありません。そのモデルでは、新しいタスクがどこから来るのかを説明できないからです。Wittgenstein と Heidegger を借りながら、彼は職業を「世界の見え方と、何を大事に思うか」の様式として捉えます。編集者が気づくことに看護師は気づかない。そして道具が変われば、同じ関心から丸ごと新しいタスクが生まれてくる。

  • #policy
  • #evals
X

Peter Steinberger

OpenClaw のクラウドセッションが高速化、remote terminal と WebVNC も登場

OpenClaw のクラウドセッションがようやく実用的な速度に達し、remote terminal、WebVNC、computer use 向けの CUA も同時に提供されました。2か月前に進めたダッシュボードと mini-app の取り組みは、その後チームが OpenClaw まわりで自作していたツールの大半を置き換え、いまではすべてがサイドバーの項目か、ダッシュボードか、チームサーバー上の plugin に集約されています。

  • #agents
  • #open-source
X

Guillermo Rauch

Vercel CEO

Vercel、この半年で値下げ8件とモデル料金の引き下げ16件

半年分の料金改定を数えると、値下げ、手数料の撤廃、体系の改善が合わせて8件、モデルの割引が16件。まだ続くと予告しています。Rauch は Benchmark と共同で AI ベンチマークのイベントも準備中で、モデルを測る企業こそが業界を skill、truth、efficiency の方向へ導いているのだと訴えています。

  • #products
  • #evals
X

Thibault Sottiaux

今朝、ChatGPT Work と Codex で banked reset が適用されない不具合

今朝の一定時間に発生した不具合で、ChatGPT Work と Codex で banked reset を使っていた人に、その適用が完全には反映されませんでした。影響を受けた全員に reset がもう1回付与され、お詫びのメールも届きます。サポートへの問い合わせは不要です。

  • #products
X

Peter Yang

新しいモデルを試すなら、自分の blind spot を挙げさせてみる

Yang がモデルの推論力を確かめるときの定番は、自分の足を引っ張っている blind spot について容赦なく正直なフィードバックをくれ、というプロンプトを貼り付けて、返ってくる答えの鋭さを見ることです。Astra の回答はとりわけ手厳しかったそうですが、まさにそれがこのテストの狙いです。

  • #evals

メールで受け取る

1 日 1 通。購読解除はワンクリックです。

データの出どころ

元データは zarazhangrui によるオープンソースプロジェクト follow-builders(MIT ライセンス)から取得しています。要約はそのプロジェクトの公開フィードをもとに LLM が生成し、要約プロンプトも同プロジェクトを改変したものです。上記の各項目は原文にリンクしています。

要約は自動生成です。判断の根拠にする前に原文をご確認ください。