10 entradas10 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 4 min de lectura.

El DevDay de OpenAI acabó convertido en un día de lanzamientos: Dots ya está en marcha, Sol 6.1 llegó a una quinta parte del precio de Astra y Ultrafast es el modo que nadie quiere devolver. Anthropic respondió con la disponibilidad general de Claude in Chrome, que ahora hace clic y escribe en tu nombre sin pararse a pedir permiso cada vez. Por debajo de los lanzamientos, builders e inversores pasaron el día rondando la misma pregunta desde dos ángulos distintos: si el harness que rodea al modelo es donde vive de verdad el moat que queda.

X

Sam Altman

Dots ya se lanza, y Sol 6.1 aterriza a una quinta parte del precio de Astra

Dots ya está aquí, presentado como AI que trabaja 24/7 para ti, de forma que recuperas tiempo y atención y trabajas a un nivel más alto. El precio es la señal más ruidosa: Sol 6.1 cuesta una quinta parte de Astra y viene con un 95% de descuento en lectura de caché, y lo describen como un modelo extremadamente capaz. El nuevo modo Ultrafast se lleva la frase más contundente del día: es tan rápido que ya no hay vuelta atrás.

  • #products
  • #pricing
  • #agents
X

Thibault Sottiaux

Unos millones de Dots en línea en cuestión de días, y los equipos de Dots todavía retenidos

Habrá unos millones de Dots en línea en cuestión de días, trabajando dentro de una comunidad grande y diversa. El detalle que conviene saber antes de probar uno: el salto de utilidad llegó después de 2-3 días enseñándole preferencias y preocupaciones del momento, y a partir de ahí asumió por su cuenta tareas sorprendentemente ambiciosas. OpenAI está reteniendo a propósito la posibilidad de crear un equipo entero de Dots hasta entender cómo usa la gente su Dot principal.

  • #agents
  • #products
Blog

Claude Blog

Claude in Chrome llega a GA y ya puede actuar sin pedir permiso antes

Claude in Chrome está disponible de forma general en todos los planes de pago, y ahora ejecuta acciones de manera autónoma en lugar de pedir aprobación para cada clic, cada pulsación de tecla y cada formulario que rellena, aprovechando tus sesiones ya iniciadas para llegar a dashboards internos, sistemas legacy y portales de proveedores. Los números que respaldan esa confianza: en una evaluación actual construida por red-teamers profesionales, los ataques que llegaron al modelo tuvieron éxito el 17,6% de las veces contra Opus 4.5 y el 3,8% contra Opus 5 sin ninguna salvaguarda, mientras que los probes junto a un classifier que compara cada acción pendiente con tu petición original llevaron esa cifra a cero en Sonnet 5 y Opus 5, y al 0,3% en Fable 5. La evaluación de injection de la época del piloto se saturó con una tasa de éxito del 0% y ya ha sido retirada. Los archivos de tu ordenador siguen requiriendo la app de escritorio, y no funciona en otros navegadores basados en Chromium ni en móvil.

  • #agents
  • #security
  • #products
X

Nikunj Kothari

FPV Ventures Partner

Escasean los misioneros y el moat son mil cosas invisibles

Nunca ha sido tan difícil encontrar misioneros. Hay cofundadores que dejan las empresas que ellos mismos fundaron para irse con los ganadores obvios, CEOs de compañías cotizadas que aceptan puestos en laboratorios, empresas a las que les hacen un Windsurf para que solo los elegidos pasen a la entidad futura, y fundadores que levantan valoraciones por tramos sin pensar en el 409A que va a hacer imposible el ejercicio anticipado para su siguiente contratación. Sobre defensibilidad, el moat ya no es una sola cosa: en la capa de aplicación, el harness son mil cosas pequeñas bien hechas, la mayoría invisibles, y por eso juzgar hoy una ventaja implica meterse en el detalle combinado de producto, tecnología y GTM. Todo eso acaba volviendo a los fundadores, cuya ventaja real es la velocidad de ejecución y de adaptación, porque ya no quedan mercados de océano azul y cualquier cosa que desprenda algo de calor atrae competidores de un día para otro.

  • #funding
  • #agents
X

Aaron Levie

Box CEO

La industria de la AI todavía puede autorregular la seguridad, por ahora

Unos estándares y prácticas compartidos por toda la industria pueden encargarse razonablemente de la safety y la seguridad de la AI en el futuro previsible. Más supervisión, más testing, más responsabilidad legal y más regulación son inevitables en algún punto del avance de las capacidades, pero la fase actual todavía permite que las empresas se alineen por sí mismas y de forma colectiva. Lo que se señala como alentador es que esto cuajó rápido y con apoyo de toda la industria, sin reducir la competencia.

  • #policy
  • #safety
X

Guillermo Rauch

Vercel CEO

AI SDK supera los 30M de descargas semanales

AI SDK ha alcanzado los 30 millones de descargas semanales. El vídeo del anuncio salió en un solo intento en fframes con Opus, pidiéndole a la herramienta que encontrara por su cuenta los hitos de 5M, 10M, 20M y 30M; luego se escribió en Rust y se renderizó en la GPU. También compartió una gráfica de la correlación inversa entre defectos del producto y descargas.

  • #open-source
  • #developer-tools
X

Garry Tan

Y Combinator President & CEO

El test bloat es real, así que GStack absorbió una skill de auditoría de tests

Una versión de la skill de auditoría de tests de OpenClaw ya está integrada en GStack, con el argumento de que el test bloat es un problema real y no algo cosmético. El planteamiento es que hoy la inteligencia se sirve a demanda, así que auditar tu propia suite ya no es la parte cara de limpiarla.

  • #developer-tools
  • #open-source
X

Zara Zhang

Una web de marketing para una botella de agua, seis prompts, cuatro herramientas de AI

Un sitio de marketing completo para una botella de agua, construido enteramente por Opus 5.5 en seis prompts. Nada de lo que hay ahí se hizo a mano: ElevenLabs generó la música, Meshy generó los assets 3D y la API de OpenAI generó las imágenes.

  • #products
  • #agents
X

Amjad Masad

Replit CEO

Un harness barato puede alcanzar rendimiento de frontera

Una referencia sobre cómo diseñar y construir un harness que alcance rendimiento de frontera a una fracción del coste. Llega justo el mismo día en que el argumento en la capa de aplicación es que la diferenciación está ahora en el harness, no en el modelo que hay debajo.

  • #agents
  • #developer-tools

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.