12 entradas11 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 5 min de lectura.

OpenAI lanzó GPT-6 Astra para todo el mundo hoy, antes de lo previsto, y toda la conversación se reorganizó a su alrededor en cuestión de horas. Anthropic respondió en el frente del agente dentro del navegador: llevó Claude in Chrome a disponibilidad general con acciones autónomas y le dio a Cowork un navegador propio. Por debajo de las noticias de modelos, el CEO de Arm defendió que el cuello de botella de cómputo se está desplazando de los chips a los propios centros de datos.

X

Thibault Sottiaux

OpenAI adelantó seis meses su hoja de ruta gracias al uso interno de Astra

Astra fue la mayor ventaja competitiva de OpenAI mientras siguió siendo interno, y el salto de productividad fue tan grande que el equipo adelantó sus planes seis meses para lanzarlo en el DevDay en lugar de a mediados del año que viene. El despliegue llegó antes de lo previsto, y OpenAI lo acompañó de un reinicio completo de los saldos acumulados para todos los usuarios Plus, Pro y Business, efectivo al final del día. Prometen más lanzamientos la semana que viene.

  • #products
Blog

Claude Blog

Claude in Chrome llega a GA y ya puede actuar sin pedir permiso cada vez

Claude in Chrome está disponible de forma general en todos los planes de pago, y ahora Claude aprueba automáticamente las acciones que considera seguras en lugar de preguntar por cada una, usando el mismo mecanismo que el modo auto de Claude Code. Un clasificador contrasta cada acción pendiente con lo que realmente pediste y bloquea lo que no encaja, todo ello por encima de unas sondas que revisan el contenido web en busca de instrucciones inyectadas antes de que Claude actúe. Los números: en la evaluación de red team actual, los ataques que llegaron al modelo tuvieron éxito el 17,6% de las veces contra Opus 4.5 y el 3,8% contra Opus 5 sin ninguna protección; con las sondas más el clasificador, no pasó nada contra Sonnet 5, Opus 5 ni Mythos 5, y Fable 5 se quedó en el 0,3%. Lee páginas, hace clic, escribe y rellena formularios usando tus sesiones ya iniciadas, que es justo lo que hace falta para dashboards internos y portales de proveedores que nunca van a tener un connector.

  • #agents
  • #products
  • #security
Blog

Claude Blog

Cowork estrena navegador propio para que Claude deje de usar el tuyo

Claude Cowork en la aplicación de escritorio ahora incorpora un navegador propio que se abre en un panel lateral cuando una tarea necesita la web, separado de tu navegador y sin acceso a tus pestañas, marcadores ni contraseñas. Puedes trasladar sesiones sitio por sitio desde Chrome, Edge o Firefox, con los sitios de banca, correo y SSO excluidos salvo que los actives tú. La separación es deliberada: el navegador integrado sirve para delegar trabajo que quieres que se haga mientras tú sigues a lo tuyo, y Claude in Chrome sigue siendo la respuesta para la página que ya tienes delante. Se despliega esta semana en Pro, Max y Team, y ya está disponible hoy para los administradores de Enterprise.

  • #agents
  • #products
Pódcast

No Priors

El CEO de Arm: el techo no es el suministro de chips, es la construcción de centros de datos

Rene Haas afirma que el panorama de suministro de AI seguirá tensionado durante al menos tres a cinco años, y que el próximo cuello de botella es la construcción física, no las obleas ni la memoria. Casi ningún proyecto de centro de datos va por delante del calendario o por debajo de su estimación de mano de obra, y el rechazo local a las nuevas instalaciones añade un segundo freno, que él casi agradece porque de lo contrario la capacidad de obleas y memoria sería la restricción determinante. Sobre el exceso de oferta frente a la demanda: "Ni de lejos". Dentro de Arm, entre el 80 y el 90% de los ingenieros usan AI a diario, sobre todo para verificación, validación y debug, que consumen mucho más de un ciclo de chip de 24 a 36 meses que el diseño de la arquitectura. Su observación más afilada tiene que ver con por qué la AI todavía no sabe escribir buen RTL: la IP propietaria suele entregarse sin documentación ni test benches, y "si no se puede usar ni testear, en realidad no se puede entrenar con ello". También rebate la idea de que los aceleradores hayan dejado a las CPU sin sentido, y sostiene que algo tiene que orquestar adónde van todos esos tokens generados, y ese trabajo sigue siendo del microprocesador.

  • #hardware
  • #policy
X

Guillermo Rauch

Vercel CEO

Rauch sobre WebMCP: los agentes deberían circular por la web que ya construimos

Guillermo Rauch apuesta por WebMCP con una analogía del FSD de Tesla: los agentes tienen que adaptarse a la web tal y como existe, con sus calles, semáforos y baches, en lugar de exigir una infraestructura paralela. La ventaja concreta que señala es que las páginas de desarrollo de Next.js expongan herramientas de debugging directamente a un agent en la misma pestaña que está probando, con contexto específico de esa página, en vez de obligarlo a rebuscar entre logs del servidor. No hay que localizar ni configurar un servidor MCP aparte, porque la página lleva consigo sus propias herramientas para el agent. En ese escenario sostiene que un agent que maneja el navegador más un dev server forman un stack web completo, sin perder ni un ápice de profundidad en el debugging.

  • #agents
  • #products
X

Garry Tan

Y Combinator President & CEO

Garry Tan: dos horas de configuración de OpenClaw se convirtieron en tres minutos con Aside

Conectar OpenClaw a Slack le llevó a Tan dos horas; el mismo trabajo sobre el harness de Aside, con integraciones completas y acceso al navegador, le llevó menos de tres minutos y con valores por defecto de control de acceso razonables desde el primer momento. Ha convertido el navegador de Aside en el navegador preferido para sesiones remotas en GStack y lo describe como la mejor forma que ha encontrado de dar a un agent acceso web y credenciales bajo tu propia identidad. Su lectura es que Aside no es solo un navegador, sino a la vez un gestor de credenciales, una capa de integración, un harness y un sistema de memoria.

  • #agents
  • #products
X

Madhu Guru

Meta Sr Director, AI

La forma más rápida de aprender a construir productos de AI: automatiza un flujo de trabajo que ya conozcas

El ejercicio de fin de semana de Madhu Guru consiste en tomar un flujo de trabajo que domines, del trabajo o de tu vida personal, y automatizarlo entero de principio a fin con el producto de AI con el que te sientas cómodo. Hacerlo una vez te obliga a responder cuatro preguntas que la lectura no plantea: cómo es de verdad una buena experiencia de principio a fin, cómo usar MCPs y tools, dónde hace falta que las personas sigan en el bucle y cómo evalúas el resultado. Y después, sube la ambición. Su tesis es que una pasada por este ejercicio vale más que un mes leyendo sobre cómo construir productos de AI.

  • #agents
  • #products
X

Swyx

Los modelos frontier ya tienen favoritos en los medios de AI

Swyx está preparando un informe extenso de AEO sobre varios modelos frontier y descubrió que Claude menciona Latent Space cuando se le pregunta por la mejor newsletter o el mejor podcast de AI. El resultado le sorprendió lo bastante como para revisar si había fugas de memoria en el harness antes de creérselo.

  • #evals
X

Zara Zhang

La gente valora la escritura de la AI por encima de lo que realmente vale

Zara Zhang sostiene que la brecha a la que hay que prestar atención es perceptiva: la mayoría cree que la AI escribe mejor de lo que escribe. La implicación es que el listón que los lectores aplican a la prosa escrita por máquinas es más bajo que el que aplican a la de las personas.

  • #evals
X

Peter Yang

La interfaz que le falta a Codex es un reloj con el que hablar

Peter Yang quiere una app para el Apple Watch que le permita dictar por voz en sus hilos de Codex y escuchar las respuestas, para poder dejar el móvil en casa. Su motivación es la adicción a las pantallas más que la comodidad, y se pregunta en voz alta si no será eso el rumoreado dispositivo de OpenAI.

  • #products
  • #hardware

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.