15 entradas15 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 5 min de lectura.

El desenlace de Cursor se convirtió en el test de Rorschach del día para la AI aplicada, con fundadores leyéndolo como prueba de que la capa entre el modelo y el workflow es donde está el valor. Por debajo de las opiniones, el pensamiento más útil vino de quienes están construyendo agents de horizonte largo: cómo verificar un trabajo que no tiene compilador, y por qué el inglés de tu contexto merece más cuidado que tu código. Google metió 3.7 Flash en la app de Gemini y Anthropic abrió Claude al framework Foundation Models de Apple.

X

Aaron Levie

Box CEO

Cursor hizo añicos la idea de que las dev tools tocan techo en salidas de pocos miles de millones

El tamaño de mercado del agentic coding era muchísimo mayor de lo que casi nadie modeló, y se daba por saturado justo cuando Cursor arrancaba. El playbook que vale la pena copiar: encontrar la forma de producto adecuada para el trabajo agentic, actuar como capa neutral entre modelos y workflows, hacer post-training de modelos solo donde eso baje el coste o suba el rendimiento, construir infraestructura específica para ese workflow, y acompañarlo de un go-to-market alineado con la categoría. Había mucho más espacio para innovar entre el usuario y el modelo subyacente de lo que la gente creía.

  • #agents
  • #products
Pódcast

The MAD Podcast with Matt Turck

Cien evals en verde no te dicen nada sobre si un agent generaliza

Basis construye agents que preparan declaraciones de impuestos completas de principio a fin, con miles de pasos de inference, y la lección central es que las evals basadas en resultados no bastan. "Aunque acertara 100 de cada 100 veces, si una persona acierta solo porque se va a mirarlo a Wikipedia, la firma contable no la contrataría, así que tampoco debería contratarnos a nosotros." La solución son las behavior specs: archivos markdown que nunca se le muestran al agent y contra los que un agent-judge califica las trayectorias, de modo que premias el proceso y no solo la respuesta. El golpe más afilado va para los ingenieros que se obsesionan con la abstracción mientras su contexto es un desastre, porque en runtime lo que afecta al rendimiento es el inglés, no la organización del código.

  • #agents
  • #evals
  • #open-source
Blog

Claude Blog

Claude ya se conecta al framework Foundation Models de Apple mediante un paquete de Swift

Los desarrolladores de Apple pueden ejecutar tareas rápidas en local con el modelo on-device y pasarle la petición a Claude cuando hace falta razonamiento multipaso, generación de código, búsqueda web o ejecución de código, devolviendo la respuesta en streaming a la misma vista de SwiftUI. Como el framework devuelve valores tipados de Swift a partir de las anotaciones @Generable, la llamada a Claude recibe input estructurado y limpio en vez de texto crudo del usuario. Disponible mañana en iOS 27, iPadOS 27, macOS 27, visionOS 27 y watchOS 27, con autenticación mediante una API key de Anthropic.

  • #products
  • #agents
X

Josh Woodward

Google VP

3.7 Flash llega a la app de Gemini, y Pomelli convierte fotos de producto en vídeo

Gemini 3.7 Flash ya está disponible en la app de Gemini. Pomelli, el experimento de Google Labs dirigido a pequeños negocios, sumó la posibilidad de convertir sesiones de fotos de producto en vídeos cortos y gifs, extendiendo el mismo acabado en un clic que lo hizo popular con imágenes fijas.

  • #products
X

Madhu Guru

Meta Sr Director, AI

Software más barato significará más software, no menos, según la máquina de vapor

Las máquinas de vapor más eficientes aumentaron la demanda de carbón, los lenguajes de más alto nivel produjeron muchísimo más código, y las hojas de cálculo más baratas produjeron muchísimo más análisis financiero. La AI aplicada a la ingeniería de software debería seguir la misma curva: mucho más software, apuntando a problemas que antes no compensaba resolver. También sostiene que el impacto cultural de Cursor está infravalorado, porque "cursor for x" le dio a la industria un patrón de producto con el que salir de la fase chatbot, y que cuando todo el mundo puede construir con AI los diferenciales se reducen a criterio de producto, conocimiento del dominio, distribución y ejecución.

  • #agents
  • #products
X

Nan Yu

Linear Head of Product

La AI no es irregular, simplemente tiene forma de AI

Llamar "jagged" a la AI es como decir que los perros son irregulares porque son mejores o peores que los humanos en tareas concretas. Mide un tipo distinto de cosa contra una referencia humana que nunca fue el marco adecuado. Por otro lado, si crees que tus colegas son inteligentes, sus ideas vienen de algún sitio real, y parte del mejor trabajo que ha lanzado Linear han sido fusiones de varias ideas o derivados bastante alejados del concepto original. Y no hay fuerza en tech tan destructiva como el dossier de ascenso de un PM.

  • #products
  • #agents
X

Peter Yang

El modelo antispam de X nunca lee el post, así que las granjas de contenido con AI pasan sin problema

Leer el algoritmo open-source de X saca a la luz TweetSpamBot, un modelo de comportamiento que analiza hasta 512 acciones recientes de una cuenta buscando señales como ráfagas de publicación, comportamiento de quote-post, timing y tiempo transcurrido entre acciones, y marca patrones como TWEET_CREATE_BURST, QUOTE_TWEET_SPAMMER y CONTENT_AMPLIFIER. Una puntuación alta puede disparar un challenge de cuenta, pero no parece bajar el ranking del contenido basura en sí. El hueco es que el modelo nunca mira el contenido del post, así que una granja puede buscar posts virales y citarlos diez o más veces al día con la misma plantilla de gancho, cifras, historia personal y conclusión sobre temas sin relación entre sí, y seguir limpia.

  • #products
  • #policy
X

Peter Steinberger

El equipo de OpenClaw pasó a construir OpenClaw con OpenClaw

Compartir sesiones de agents como URLs resulta ser la clave, porque permite al equipo pasarse trabajo de agent en curso igual que se pasarían el link de un documento. También añadieron al AGENTS.md compartido una instrucción que exige que toda PR que cambie el estado de la UI suba un vídeo mostrándolo, lo que mete la revisión visual dentro del diff en lugar de dejar que los revisores se la imaginen.

  • #agents
  • #open-source
X

Thibault Sottiaux

ChatGPT ya puede reservar mesa en restaurantes

Las reservas rápidas de restaurante ya funcionan directamente en ChatGPT, lanzadas junto con un lote de otras novedades. Pregunta abierta para los usuarios de Codex: ¿qué problema difícil te resolvió esta semana, y dónde aprendes de verdad de otros sobre cómo empujar la frontera?

  • #products
  • #agents
X

Garry Tan

Y Combinator President & CEO

Con Fable 5, "acepta todas las recomendaciones" pasó a ser una respuesta segura ante las puertas de un solo sentido

Usando GStack antes y después de Fable 5, el cambio sorprendente es que muchas preguntas de puerta de un solo sentido que plantea Claude Code ahora se pueden contestar simplemente con "acepta todas las recomendaciones" y acabas contento con el resultado. Por separado, sobre vivienda: los opositores están, en la práctica, montando una lista exhaustiva de las leyes de California que los YIMBY necesitan derogar.

  • #agents
  • #policy
X

Dan Shipper

Every CEO

Se puede ser un cohete AI-native sin estar levantando capital de forma permanente

Rechaza la premisa de que las empresas de AI que crecen rápido tengan que vivir en una pelea a muerte constante por clientes, sacrificando margen bruto y estando siempre en el mercado buscando capital. Ese camino existe, pero el otro también, y las reglas para construir el segundo tipo de empresa son muy distintas.

  • #funding
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel dice tener la infraestructura de AI Gateway más rápida del mundo

Afirmación de rendimiento sin rodeos sobre el AI Gateway de Vercel, que sitúa la latencia de routing como el eje competitivo de la capa que se interpone entre las apps y los proveedores de modelos.

  • #products
X

Amjad Masad

Replit CEO

Crea apps de iOS personales con TestFlight, sin pasar por la App Store

TestFlight es una vía de distribución infravalorada para apps que nunca piensas publicar. Si la app es solo para ti o para un puñado de personas, obtienes una app de iOS instalada de verdad sin tocar la revisión de la App Store.

  • #products
X

Swyx

Las aceptaciones del CFP de la primera tanda de AI Engineer NYC cierran hoy

Último aviso para la wave 1 del CFP de AI Engineer NYC: las aceptaciones se cierran hoy, y las keynotes de finanzas del escenario principal llevan requisitos especiales. La edición de NYC del año pasado fue el summit más exitoso de toda la serie. Sobre la ronda de Databricks: la M de la serie M de 188.000 millones de dólares viene de "vamos a matar un montón de reuniones".

  • #funding
  • #products
X

Matt Turck

La AI comprime la jornada laboral en decisiones puras, y eso agota

Antes de la AI, un día de trabajo era una decisión seguida de una larga cola de proceso, repetido hasta las diez de la noche. Con AI es decisión tras decisión tras decisión, y a las tres de la tarde el cerebro está vacío. Ese procesamiento hacía un trabajo reparador mucho mayor de lo que nadie contabilizaba.

  • #agents
  • #products

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.