15 件15 人の builder から

AI Builders Digest

AI を実際につくっている人たちが今日話したこと。1 ページ、約 6 分。

Cursor の結末は、この日の applied AI をめぐるロールシャッハテストのようになった。創業者たちはそれを、model と workflow のあいだのレイヤーにこそ価値が宿ることの証拠として読んだ。そうした論評の下で、もっと役に立つ思考は long-horizon な agent を実際に世に出している人たちから出てきている。compiler の効かない仕事をどう検証するのか、そしてなぜ context に書く英語はコードより丁寧に扱われるべきなのか。Google は Gemini アプリに 3.7 Flash を投入し、Anthropic は Claude を Apple の Foundation Models framework から使えるようにした。

X

Aaron Levie

Box CEO

Cursor は「開発ツールの出口はせいぜい数十億ドル」という前提を打ち砕いた

agentic coding の市場規模は、ほぼ誰の想定よりもはるかに大きかった。しかも Cursor が動き出したちょうどその頃、この領域はもう飽和したと思われていた。真似する価値のある型はこうだ。agentic な仕事に合うプロダクトの形を見つけること、model と workflow のあいだに立つ中立的なレイヤーとして振る舞うこと、コスト低減か性能向上につながるところだけで model を post-train すること、その workflow に固有の infra を作ること、そしてカテゴリに合った go-to-market を組み合わせること。ユーザーと基盤 model のあいだには、みんなが思っていたよりずっと大きな革新の余地があった。

  • #agents
  • #products
ポッドキャスト

The MAD Podcast with Matt Turck

eval に100回通ったところで、その agent が汎化するかどうかは何もわからない

Basis は税務申告を最初から最後まで丸ごと仕上げる agent を作っている。推論ステップは数千に及ぶ。そこから得られた核心的な教訓は、結果ベースの eval だけでは足りないということだ。「100回中100回正解していたとしても、その人が Wikipedia を見て当てているだけなら、会計事務所はその人を雇わない。だったら我々も雇われるべきではない」。解決策は behavior spec だ。agent には決して見せない markdown ファイルを用意し、agent-judge がそれに照らして trajectory を採点する。答えだけでなくプロセスに報酬を与える仕組みになる。いちばん刺さる一言は、context がぐちゃぐちゃなのに抽象化にこだわるエンジニアに向けられている。実行時に性能を左右するのは英語のほうで、コードの整理のされ方ではない。

  • #agents
  • #evals
  • #open-source
ブログ

Claude Blog

Claude が Swift package 経由で Apple の Foundation Models framework につながった

Apple のデベロッパーは、軽くて速い処理を on-device model でこなし、multi-step の推論やコード生成、web 検索、コード実行が必要なリクエストだけ Claude に引き渡して、そのレスポンスを同じ SwiftUI の view にストリーミングで戻せる。framework は @Generable アノテーションから型付きの Swift の値を返すので、Claude に渡るのは生のユーザーテキストではなく、きれいに構造化された入力になる。iOS 27、iPadOS 27、macOS 27、visionOS 27、watchOS 27 で明日から利用可能で、認証には Anthropic の API key を使う。

  • #products
  • #agents
X

Josh Woodward

Google VP

3.7 Flash が Gemini アプリに登場、Pomelli は商品写真を動画に変える

Gemini 3.7 Flash が Gemini アプリで使えるようになった。中小企業向けの Google Labs の実験である Pomelli には、商品撮影の写真を短い動画や gif に変える機能が加わった。静止画で人気を集めたワンクリックの仕上がりの良さが、そのまま動画にも広がった形だ。

  • #products
X

Madhu Guru

Meta Sr Director, AI

蒸気機関の教訓に従えば、ソフトウェアは安くなるほど減らずに増える

蒸気機関の効率が上がると石炭の需要は増えた。高水準言語が登場するとコードの量ははるかに増えた。表計算ソフトが安くなると財務分析の量もはるかに増えた。AI とソフトウェアエンジニアリングの組み合わせも同じ曲線を描くはずだ。ソフトウェアははるかに増え、これまで解く価値がないとされてきた問題へ向かっていく。あわせて、Cursor の文化的なインパクトは過小評価されているとも言う。「cursor for x」という言い方が、chatbot 段階から抜け出すためのプロダクトの型を業界に与えたからだ。そして誰もが AI で作れるようになれば、差別化の要因はプロダクトセンス、ドメイン知識、ディストリビューション、実行力に収束する。

  • #agents
  • #products
X

Nan Yu

Linear Head of Product

AI は jagged なのではなく、ただ AI という形をしているだけだ

AI を「jagged」と呼ぶのは、特定のタスクで人間より上手かったり下手だったりするからといって犬を jagged と呼ぶようなものだ。そもそも人間を基準にすること自体が適切な枠組みではなかったのに、まったく別の種類のものをその物差しで測っている。別の話として、同僚が賢いと信じているなら、彼らのアイデアもどこか本物の場所から来ているはずだ。Linear がこれまで出したもののうち最良の仕事のいくつかは、複数のアイデアの融合だったり、元の発想からかなり下流にある派生物だったりする。そして、テック業界で PM の昇進資料ほど破壊的な力はない。

  • #products
  • #agents
X

Peter Yang

X の anti-spam モデルは投稿本文を読まない。だから AI コンテンツ工場は素通りする

X のオープンソース化されたアルゴリズムを読むと TweetSpamBot が出てくる。これは行動ベースのモデルで、アカウントの直近の操作を最大512件まで分析し、投稿のバースト、引用投稿の振る舞い、タイミング、操作と操作のあいだの間隔といったシグナルから、TWEET_CREATE_BURST、QUOTE_TWEET_SPAMMER、CONTENT_AMPLIFIER といったパターンにフラグを立てる。スコアが高いとアカウントに認証チャレンジが出ることはあるが、スロップそのものの表示順位を下げてはいないようだ。穴は、このモデルが投稿の中身をまったく見ないところにある。だからコンテンツ工場は、バズった投稿を見つけて一日十数回引用し、無関係なトピックにも同じ「フック・数字・身の上話・学び」テンプレートを当てはめながら、きれいなままでいられる。

  • #products
  • #policy
X

Peter Steinberger

OpenClaw チームは OpenClaw を OpenClaw で作る体制に移った

agent のセッションを URL として共有できることが決め手だった。ドキュメントのリンクを渡すのと同じ感覚で、進行中の agent の作業を引き継げる。あわせて、共有している AGENTS.md に、UI の状態を変える PR には必ずその動画をアップロードするというルールを加えた。ビジュアルのレビューを、レビュアーの想像に委ねるのではなく diff の中に押し込む狙いだ。

  • #agents
  • #open-source
X

Thibault Sottiaux

ChatGPT でレストランの予約が取れるようになった

ちょっとしたレストランの予約が ChatGPT の中で直接できるようになり、他の複数のアップデートと同時に出荷された。Codex ユーザーへの問いかけもある。今週 Codex はあなたのどんな難問を解いたのか、そしてフロンティアを押し広げる方法を、実際どこで他の人から学んでいるのか。

  • #products
  • #agents
X

Garry Tan

Y Combinator President & CEO

Fable 5 になって、「推奨をすべて採用」が one-way door への安全な答えになった

Fable 5 の前後で GStack を使ってみて意外だったのは、Claude Code が投げてくる one-way door 的な問いの多くに、いまや「推奨をすべて採用」と答えるだけで済み、それで結果に満足できるようになったことだ。別件の住宅政策について。反対派は事実上、YIMBY が廃止させたいカリフォルニア州法の網羅的なリストを作ってくれている。

  • #agents
  • #policy
X

Dan Shipper

Every CEO

資金調達を続けなくても、AI ネイティブな急成長企業にはなれる

急成長する AI 企業は顧客をめぐる終わりのないデスマッチの中で生き、粗利を犠牲にし、資金のために常に市場に出続けるしかない、という前提を否定する。その道もあるが、もう一方の道もある。そして二つ目のタイプの会社を作るためのルールは、まったくの別物だ。

  • #funding
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel、世界最速の AI Gateway インフラだと主張

Vercel の AI Gateway をめぐるストレートな性能の主張。アプリと model プロバイダーのあいだに位置するレイヤーにおいて、ルーティングのレイテンシを競争軸に据えている。

  • #products
X

Amjad Masad

Replit CEO

App Store は要らない。TestFlight で自分用の iOS アプリを作る

公開するつもりのないアプリにとって、TestFlight は過小評価された配布経路だ。自分だけ、あるいはごく少数のためのアプリなら、App Store の審査に一切触れずに、本物のインストール済み iOS アプリが手に入る。

  • #products
X

Swyx

AI Engineer NYC の CFP 第1波、採択は本日締め切り

AI Engineer NYC の CFP 第1波の最終案内。採択は本日確定し、メインステージの金融系 keynote には特別な要件が付く。昨年の NYC は、このシリーズで最も成功した summit だった。Databricks の資金調達について。1880億ドルの series M の M は「これからとんでもない数の会議を殺す」の M だ。

  • #funding
  • #products
X

Matt Turck

AI は一日の仕事を純粋な意思決定に圧縮する。それはひどく消耗する

AI の前は、一日の仕事は一つの判断とその後に続く長いプロセスの尾で、それを夜10時まで繰り返していた。AI があると、判断、判断、また判断と続き、午後3時には頭が空っぽになる。あいだにあった処理作業は、誰も勘定に入れていなかったほど回復の役目を果たしていた。

  • #agents
  • #products

メールで受け取る

1 日 1 通。購読解除はワンクリックです。

データの出どころ

元データは zarazhangrui によるオープンソースプロジェクト follow-builders(MIT ライセンス)から取得しています。要約はそのプロジェクトの公開フィードをもとに LLM が生成し、要約プロンプトも同プロジェクトを改変したものです。上記の各項目は原文にリンクしています。

要約は自動生成です。判断の根拠にする前に原文をご確認ください。