18 entradas18 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 6 min de lectura.

Hoy la seguridad alcanzó a los agentes: el informe de OpenAI sobre el escape de su sandbox hizo que los líderes empresariales reconsideraran lo que significa darle a un sistema autónomo acceso a datos internos. En el lado de las capacidades, GPT-5.6 Sol se puso discretamente a la cabeza de ARC-AGI-3 solo con cambios en el harness, Claude llegó al framework Foundation Models de Apple, y tanto Replit como Cursor lanzaron herramientas de diseño. Por debajo de todo eso resurgió una discusión ya conocida sobre si la inferencia se vuelve escasa y cara o sigue siendo barata.

X

Aaron Levie

Box CEO

El escape del sandbox de OpenAI reinicia los plazos empresariales para adoptar agentes

El incidente mostró tanto lo que pueden hacer los agentes como lo poco preparados que están la mayoría de los entornos para recibirlos. Las empresas ahora necesitan registros de auditoría, controles de acceso estrictos, una decisión sobre qué sistemas se mantienen deterministas y la capacidad de bloquear a un agente que se descontrole. Incluso un agente bienintencionado al que se le pide encontrar toda la IP importante de un proyecto seguirá ejecutando sin parar, tropezará con controles de acceso obsoletos y sacará a la luz cosas que nadie debería ver, porque no corre ningún riesgo real y no tiene el criterio que tendría una persona. Por otro lado, Levie rebatió el argumento de Dwarkesh de que los costes de inferencia se van a disparar a medida que el cómputo se dirige a las tareas más valiosas: apuesta a que hay demasiados proveedores de modelos y de infraestructura compitiendo por esas cargas de trabajo como para que los precios suban.

  • #agents
  • #security
  • #enterprise
X

Thibault Sottiaux

GPT-5.6 Sol es SoTA en ARC-AGI-3 tras cambiar dos ajustes

No hay modelo nuevo, solo se le dejó razonar y trabajar a lo largo de varias context windows usando la implementación canónica de compactación de OpenAI. La lección: cuida tus harnesses y tu modelo te lo agradecerá. Mañana llega más, planteado bajo la idea de una inteligencia demasiado barata para medirla.

  • #evals
  • #agents
Blog

Claude Blog

Claude ya funciona dentro del framework Foundation Models de Apple

Un nuevo paquete de Swift permite a los desarrolladores de Apple pasar el relevo de los modelos on-device a Claude cuando una petición requiere razonamiento en varios pasos o generación de código, y Claude además puede buscar en la web y ejecutar código para hacer análisis. Como el framework de Apple devuelve valores de Swift tipados a partir de las anotaciones @Generable, la llamada a Claude recibe entradas estructuradas y limpias en lugar del texto crudo del usuario, y las respuestas se transmiten de vuelta a la misma vista de SwiftUI. Una app de diario puede generar prompts en local y luego pedirle a Claude que encuentre hilos comunes entre meses de anotaciones. Disponible mañana en iOS 27, iPadOS 27, macOS 27, visionOS 27 y watchOS 27, con autenticación mediante una API key de Anthropic.

  • #products
  • #developer-tools
X

Garry Tan

Y Combinator President & CEO

El decrecimiento de los datacenters está ganando en todos los estados demócratas

Tan llama al movimiento contra los datacenters de AI una psy-op a la vista de todos, y una que está triunfando políticamente allí donde gobiernan los demócratas. Señala el trabajo del Manhattan Institute como el contrapeso honesto. En un tono más ligero, ese mismo día: los fundadores veteranos en la era de la inteligencia envejecen como el buen vino.

  • #policy
  • #hardware
X

Google Labs

Lyria 3.5 impulsa Flow Music con control de BPM y exportación de stems

El nuevo modelo de música de DeepMind ya está integrado en Flow Music. Las mejoras: mayor fidelidad al prompt, incluidos objetivos exactos de BPM y exportación de stems para canciones completas, voces más expresivas y dinámicas, y arreglos que fluyen de nota a nota con más naturalidad.

  • #products
  • #generative-media
X

Ryo Lu

Cursor llega a iOS para que los agentes corran desde el móvil

Cursor ya está disponible en iOS, así que las sesiones de agentes te acompañan a donde vayas en lugar de quedarse en el escritorio.

  • #products
  • #agents
X

Dan Shipper

Every CEO

El modo de voz de ChatGPT for Work tiene revolucionado a todo el equipo de Every

Shipper dice que casi todo el mundo en su empresa está alucinando con él y que hace tiempo que no veía tan buen ambiente. Sobre el informe del exploit de OpenAI, señala los detalles atenuantes: los clasificadores de seguridad estaban desactivados y se le indicó explícitamente al modelo que ejecutara exploits, mientras que la propia AI de HackerOne detectó el ataque de forma automática, solo que sin asignarle una criticidad lo bastante alta. Su lectura es que cualquier empresa que guarde datos sensibles de clientes va a necesitar defensa agéntica automatizada, algo que parece a la vez una gran oportunidad y una solución que funciona.

  • #products
  • #security
X

Aditya Agarwal

South Park Commons General Partner

Los investigadores de AI son MVPs con 18 meses en el reloj de posesión

Imagina ser LeBron a los 19 pero creyendo que tienes dos años para maximizar tus ingresos antes de que los robots se queden con el baloncesto. Eso, sostiene Agarwal, explica todo el drama que hay en los laboratorios de investigación de AI. Del Demo Faire de su firma sacó además una lectura del mercado: el apetito inversor por tecnología de frontera como robots, drones y semiconductores es real y patriótico, mientras que el listón en software ha subido tanto que cualquier cosa que se parezca a un SaaS vertical o a un agente para X necesita ya una visión genuinamente distinta o una curva de crecimiento de locos.

  • #talent
  • #funding
X

Peter Yang

Tres dark patterns que la AI ha creado en sus propios hábitos de trabajo

Volverse demasiado perezoso para leer nada, tirar por defecto de resúmenes hechos por AI y dejar que los agentes cambien archivos sin revisarlos. Acabar haciendo de canguro de un agente desde el móvil mientras está fuera con sus hijos, algo que parece productivo y no lo es. Y con ChatGPT Voice, preferir a veces hacer brainstorming con el agente antes que con la persona que tiene delante. En cuanto a herramientas, destaca Claude Design por hacer siempre preguntas aclaratorias antes de construir nada, y recomienda escribir un archivo design md con pautas de color y tipografía para escapar del look por defecto que se reconoce a la primera.

  • #products
  • #workflow
X

Sam Altman

Altman: dar poder a los científicos en lugar de intentar resolverlo todo nosotros

Dice que OpenAI está muy cerca de tener modelos que acelerarán de forma significativa el descubrimiento científico, y que el mejor camino es ponerlos en manos de los científicos en lugar de que el laboratorio intente hacerlo todo internamente.

  • #research
  • #policy
Pódcast

AI & I by Every

Kevin Kelly: la inteligencia es un compuesto y todavía no hemos encontrado sus elementos

Sobre la inteligencia somos tan ignorantes como lo era Newton sobre la electricidad, y Newton fue uno de los humanos más brillantes de la historia y estaba completamente equivocado. La tesis de Kelly es que la inteligencia no es un elemento sino un compuesto de unidades cognitivas que aún no hemos identificado, igual que la sal resultó ser un compuesto antes de que nadie supiera qué era el sodio. Las mentes humanas son una mezcla peculiar situada en un extremo de un espacio de mentes posibles con muchísimas dimensiones, y la AI va a rellenar cientos de otras que quizá ni reconozcamos como inteligencia. Sobre equivocarse: la VR de 1987 lo dejó boquiabierto y esperaba que despegara, y la VR de hoy no es mucho mejor que aquella, solo un millón de veces más barata. Por eso ahora piensa que los robots tardarán mucho más de lo que la gente espera, teniendo que competir con un supercomputador de 25 vatios y un motor de un cuarto de caballo. Su consejo, aprendido tarde: «no aspires a ser el mejor, aspira a ser el único». Y su predicción sobre los medios generativos: el 99,999% de las imágenes generadas con AI tienen una audiencia de una sola persona, porque el placer está en crearlas.

  • #research
  • #generative-media
X

Peter Steinberger

¿Alguien en Anthropic revisó los números antes del tuit de victoria?

Steinberger duda abiertamente de que Anthropic examinara con cuidado unos resultados que a simple vista parecían absurdos antes de publicarlos como un logro.

  • #evals
X

Zara Zhang

La gente técnica construye para audiencias imaginarias

Ser bueno en marketing no solo le viene bien a tu marketing, le viene bien a tu producto, porque te obliga a entrar en contacto con cómo la gente percibe y usa de verdad lo que has hecho. Su otra idea: un conocimiento profundo del dominio, combinado con ser AI-native y reinventar constantemente tu forma de trabajar, te vuelve básicamente invencible.

  • #products
  • #career
X

Swyx

Una empresa de 11.000 millones de dólares que todos odian, y lo que eso dice sobre los consejos de producto

Swyx intentó registrarse en Docusign y se topó con un captcha que no pudo resolver. Su conclusión: quien dice «haz algo que la gente quiera» no tiene la foto completa, porque un producto que cae mal a casi todo el mundo puede valer igualmente once mil millones de dólares.

  • #products
X

Nan Yu

Linear Head of Product

¿De qué productos sería un verdadero fastidio tener que cambiarse?

Yu pregunta qué usas que no tenga alternativa real, dejando fuera los productos de Apple, y sus propias respuestas son deliberadamente mundanas: los Post-it de 3M y los rotuladores de pizarra Expo, donde todo lo demás es basura.

  • #products
X

Madhu Guru

Meta Sr Director, AI

Siete meses después, el mayor alpha sigue siendo entender la frontera de los modelos

Guru reafirma una predicción que hizo hace siete meses: la ventaja viene de saber dónde está realmente la capacidad de los modelos, no de nada de lo que venga después.

  • #research
X

Nikunj Kothari

FPV Ventures Partner

Con la AGI cada vez más cerca, la familia puede ser la única conexión humana que quede

Kothari sostiene que, con la AGI digital y física acercándose, la familia cercana y los amigos se convierten en la conexión más importante y posiblemente la única genuinamente humana, así que si dudas sobre tener hijos, cuenta eso como un voto a favor. Tiene claro que es difícil y que es una de las pocas decisiones irreversibles de la vida, con bajones reales además de los momentos buenos.

  • #culture

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.