15 entradas15 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 5 min de lectura.

Anthropic lanzó Sonnet 5.5 y la reacción de los builders fue inmediata y poco habitualmente concreta: alrededor de un 30% más de trabajo por token en Claude Code, y Box publicó una evaluación empresarial completa que muestra una mejora de 2,4x en velocidad con un 12% menos de tokens. Mientras tanto, OpenAI preanunció un cambio de precios del plan Pro de 200 dólares horas antes del DevDay, recortando el uso efectivo a cerca de la mitad del equivalente anterior en gasto de API y prometiendo que no volverá el límite de 5 horas. El hilo conductor: los modelos de gama media se volvieron lo bastante buenos como para que algunos builders digan que ya no les queda sitio para ellos en su stack.

X

Thibault Sottiaux

OpenAI reabre el plan Pro de 200 dólares y reduce a la mitad su uso efectivo, anunciado la noche antes del DevDay

Las suscripciones Pro de 200 dólares vuelven a abrirse a nuevos suscriptores con un cálculo de uso distinto que acaba equivaliendo a cerca de la mitad del gasto de API del plan anterior. Las razones que se dan: no se reintroduce el límite de 5 horas, así que el uso semanal se puede gastar con libertad, y hay una negativa a inflar los precios de lista de la API solo para que el valor de la suscripción parezca mayor. La apuesta es que los precios de la API seguirán bajando lo bastante rápido como para que comprar uso según haga falta acabe convergiendo con suscribirse, citando GPT-6 Sol y GPT-6 Luna, que se lanzan esta semana al 50% de su precio anterior. También se añade algo nuevo a la suscripción que no consumirá uso, y que no se revelará hasta los anuncios.

  • #products
  • #pricing
X

Aaron Levie

Box CEO

La evaluación empresarial de Box: Sonnet 5.5 llega al entregable 2,4x más rápido con un 12% menos de tokens

Box probó Sonnet 5.5 en acceso anticipado contra su evaluación de trabajo complejo con el Box Agent y vio una ganancia global de 4 puntos en sus pruebas más difíciles, llegando al entregable terminado unas 2,4x más rápido y usando un 12% menos de tokens. Las ganancias por vertical fueron mayores: +18 puntos en Financial Services, +8 en Life Sciences y +7 tanto en Legal como en Public Sector. Lo interesante está en el detalle por tarea. En una revisión de due diligence detectó totales de intereses mal calculados y opciones mal valoradas en un deal book, y en la revisión de un contrato de arrendamiento comercial se negó a inventarse un benchmark de mercado 'estándar' para las condiciones de renovación y señaló en su lugar lo que al contrato le faltaba de verdad. Sonnet 5.5 llega a Box AI Studio en breve.

  • #evals
  • #agents
  • #products
X

Cat Wu

Sonnet 5.5 completa ~30% más tareas en Claude Code porque necesita menos tokens, no más

En Claude Code, los usuarios completan alrededor de un 30% más de tareas con Sonnet 5.5 que con Sonnet 5, y el mecanismo es la inteligencia, no el presupuesto: necesita menos tokens para el mismo trabajo. Una demo de rastrillar un jardín usando tool calls terminó 24 segundos antes que Sonnet 5 con 6.000 tokens menos.

  • #products
  • #agents
X

Dan Shipper

Every CEO

Sonnet 5.5 le gana a Opus 5.5 en revisión, y en algunos stacks ya no cabe la gama media

La escritura de Sonnet 5.5 ha mejorado muchísimo, incluso frente a Opus 5.5, y gana en concreto en tareas de revisión, aunque Astra sigue siendo el favorito para escribir sin más. Ser más rápido y más barato que Opus 5.5 lo convierte en la opción para coding iterativo rápido y trabajo de diseño dentro del equipo de Every. La discrepancia dentro de ese mismo equipo es la señal más afilada: dos de sus miembros sienten que ya no les queda sitio en su stack para modelos de gama media. Aparte, tras asistir a todos los DevDay de OpenAI desde 2023, este es con diferencia el que más lanzamientos trae, algo que se apunta como posible recursive self-improvement.

  • #evals
  • #products
X

Thariq

Ya nadie puede limitarse a enseñarte su prompt

El prompt como artefacto compartible está muerto: ahora todo funciona a base de referencias, skills y ejemplos, y es habitual decirle a un agent que lea otros tres repos, busque referencias en la web y llame a otras APIs de AI antes de empezar. La objeción del coste en tokens a abstracciones de más alto nivel como proyectos, tags y workflows dinámicos también debería estar desapareciendo, porque Sonnet y Opus 5.5 hacen que ese nivel de inteligencia sea lo bastante barato como para estar disponible por defecto. La recomendación concreta: usa Sonnet 5.5 cuando construyas workflows.

  • #agents
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel abre la búsqueda de dominios sin autenticación, explícitamente para agents

La búsqueda de dominios de Vercel ya funciona sin autenticación, presentada como especialmente útil si eres un agent y no una persona. Aparte, una migración hecha con la menor intervención posible produjo builds un 70% más rápidos y paints un 75% más rápidos en una carga de trabajo madura llena de los modismos del proveedor anterior, y se terminó en menos de una semana. De esa migración salieron dos AI skills que se compartirán de vuelta.

  • #products
  • #agents
X

Nikunj Kothari

Los inversores del 'la distribución es un moat, así que levanta mucho' se han quedado callados mientras los incumbentes exhiben músculo

Los inversores que predicaban levantar rondas enormes para comprar distribución están ausentes justo ahora, precisamente cuando los incumbentes están demostrando qué aspecto tiene la distribución de verdad. La posición contraria: quédate en los primeros principios, encuentra tus ventajas injustas auténticas, construye un producto con alta retención e idealmente con efectos de red, y trata el capital como un arma para componer, no como un destino. Debajo hay una advertencia: el grifo del dinero se va a secar, y para cuando lo haga, quienes daban esos consejos ya habrán pasado a la siguiente empresa de su portfolio.

  • #funding
X

Alex Albert

Sonnet 5.5 tiene el toque de Opus 5.5: escribe claro, va muy rápido y da un salto grande sobre Sonnet 5

Sonnet 5.5 lleva la misma calidad que hacía atractivo a Opus 5.5. Escribe con claridad, corre muy rápido y representa un salto importante de capacidades sobre Sonnet 5, lo que lo convierte en un modelo estupendo para iterar.

  • #products
  • #evals
X

Peter Yang

El ciclo de 'OpenAI está acabada' / 'Anthropic está acabada' se da la vuelta cada pocos meses y no significa nada

X pasa de 'a OpenAI se la está comiendo Claude 5.5' a 'Anthropic está acabadísima por culpa de Codex' y vuelta atrás en cuestión de meses, lo cual dice más del público que de los labs. El marco útil es que dos competidores de frontera, y pronto más, se están empujando entre sí y todo el mundo aguas abajo sale ganando. En el lado de construir: un nivel jugable de StarCraft hecho con Sonnet 5.5 en el que defiendes una base Terran de los Zerg con Marines, Siege Tanks y Battlecruisers, usando modelos de SC2 de Sketchfab y música generada con Suno.

  • #products
  • #evals
X

Boris Cherny

Sonnet 5.5 depurando Claude Code: 30% más rápido con un 30% menos de uso

Una demo de Sonnet 5.5 arreglando un bug en el propio Claude Code, que llega 30% más rápido consumiendo un 30% menos de uso que antes.

  • #products
  • #agents
X

Claude

Demos de Sonnet 5 vs 5.5 en paralelo: física de pelotas que rebotan y pixel art dibujado en código

Dos construcciones de la comunidad que muestran el salto generacional a partir del mismo prompt: pruebas de física con pelotas rebotando ejecutadas en Sonnet 5 frente a Sonnet 5.5, y criaturas del bosque en pixel art donde cada frame se dibuja en código en lugar de generarse como imagen.

  • #products
X

Ryo Lu

Una app de YouBike ya cubre todas las ciudades de Taiwán con navegación por voz paso a paso en tiempo real

El proyecto de YouBike ya funciona en todas las ciudades de Taiwán que tienen bike share, y cubre la ubicación de las estaciones, la navegación y las indicaciones paso a paso en tiempo real con voz.

  • #products
X

Sam Altman

Altman antes del DevDay: 'Hemos encontrado algo nuevo'

Un adelanto del DevDay que afirma que OpenAI ha encontrado algo nuevo, sin más detalle. Cae la misma noche que la revelación del cambio de precios del plan Pro.

  • #products
X

Zara Zhang

Convocatoria abierta: builders a quienes los frontends generados con AI les siguen saliendo con pinta de slop

Busca hablar con gente en tres situaciones: quienes construyen experiencias web y de frontend con AI pero les cuesta que queden bien en lugar de parecer AI slop, quienes ven en X demos impresionantes hechas con los últimos modelos y no tienen ni idea de cómo reproducirlas, y quienes construyen esas demos y están dispuestos a compartir el proceso.

  • #products

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.