12 entradas12 builders
Archivo

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 6 min de lectura.

Los benchmarks de coste pasaron hoy de los tokens a las tareas: Vercel publicó cifras que colocan a Grok 4.5 en lo más alto de la relación precio-rendimiento en ciberseguridad, y el paper de Kimi sobre sandboxes para agentes sostiene que los contenedores no son una frontera de seguridad real. Por debajo de eso, el hilo más interesante fue el de las interfaces: el CEO de Granola y Dan Shipper llegaron a la misma idea, que agentes y humanos necesitan manipular la misma UI al mismo tiempo. Y Aaron Levie siguió rebatiendo el apocalipsis laboral de la AI con lo que está escuchando de las empresas.

X

Guillermo Rauch

Vercel CEO

Grok 4.5 lidera el precio-rendimiento en ciberseguridad; los contenedores no son una frontera segura para agentes

Los últimos benchmarks de Vercel sitúan a Grok 4.5 como el mejor modelo de ciberseguridad en precio-rendimiento: 10 veces más barato que Sol, 5,7 veces más barato que Opus 5 y 2,2 veces más barato que Kimi K3, con un rendimiento que queda aproximadamente al nivel de Kimi. Sol sigue teniendo la frontera en solitario, por delante de Opus 5. Por otro lado, Rauch destacó el paper de Kimi sobre dónde se debería permitir ejecutar a los agentes: el aislamiento a nivel de contenedor no basta, porque en sus experimentos los agentes tumbaron la máquina subyacente con kernel panics. Su lectura es que las microVM de Firecracker, como las que usa Vercel Sandbox, sí son una frontera que aguanta.

  • #evals
  • #security
  • #agents
Pódcast

AI & I by Every

El CEO de Granola: el premio no son las notas de reuniones, es la interfaz de trabajo

Chris Pedregal cree que aquello por lo que todo el mundo pelea ahora mismo, las notas de reuniones con AI, no es donde acaba estando el valor. Notion, OpenAI y Zoom lanzaron versiones competidoras y la tasa de crecimiento de Granola no cambió en absoluto, lo que reforzó su idea de que la verdadera disputa es por qué interfaz usamos para trabajar en un mundo AI-native. Su apuesta más concreta es la pregeneración: Granola genera millones de briefings previos a reuniones sabiendo que solo una pequeña parte se abrirá, porque el momento útil son los quince segundos en los que llegas tarde y no recuerdas con quién vas a hablar. Describe el producto como un pasamanos, invisible hasta que tropiezas. En el lado de fundador: "Pensaba que las startups eran muy difíciles solo cuando no funcionaban. Resulta que también son muy difíciles cuando sí funcionan." El equipo empezó a medir el gasto en tokens la semana pasada, después de que alguien quemara un par de miles de dólares en un día con Fable.

  • #products
  • #agents
X

Swyx

Los dólares por token dejaron de ser una medida real de coste hace un año

Swyx sostiene que el precio por token de entrada y de salida murió como comparación útil en algún momento del año pasado, y que a quien siga graficando el coste así en vez de en dólares por tarea no merece la pena tomárselo en serio. También le clavó el cuchillo a su propia tesis sobre los agent labs: Claude Code quedó efectivamente open source este año y no pasó prácticamente nada ni con su roadmap ni con el de sus competidores, algo que él mismo señala como el argumento más fuerte en contra de la posición por la que se le conoce.

  • #evals
  • #agents
X

Aaron Levie

Box CEO

Las empresas siguen contratando, solo que para otros puestos

Levie dice que el colapso de empleo por la AI que se anunciaba sigue sin aparecer en las empresas con las que habla. Están contratando ingenieros para atacar problemas que antes quedaban fuera de alcance, contratando en ventas porque la AI les permite profundizar más con los clientes, y contratando forward-deployed engineers internos para conseguir de verdad que la AI llegue a producción, algo que él lee como la paradoja de Jevons en acción. Su afirmación más afilada: las empresas que usan la AI solo para recortar costes acaban perdiendo frente a las que la usan para atender mejor a sus clientes. Admite que la tendencia podría invertirse.

  • #policy
  • #products
X

Peter Yang

Codex editó y publicó un vídeo de lanzamiento desde una salida en bici

A Jason Liu, que trabaja en DevEx en OpenAI, le pidieron arreglar un vídeo de lanzamiento mientras estaba montando en bici. Se conectó a Codex desde el móvil, hizo que usara computer use para editar el vídeo, exportarlo y publicarlo de vuelta en el hilo de Slack, y luego le dijo que revisara el hilo cada treinta minutos y exportara la V2, la V3 y la V4 a partir del feedback. El vídeo ya estaba aprobado cuando llegó a casa. Es un ejemplo limpio de un agente ejecutando un ciclo de revisión asíncrono contra un canal de revisión humana sin nadie delante del teclado.

  • #agents
  • #products
X

Madhu Guru

Meta Sr Director, AI

Las revisiones de producto deberían simular el mercado, no informar del estado

El argumento de Madhu Guru es que una buena revisión de producto comprime meses de aprendizaje en una hora simulando cómo va a reaccionar el mercado ante tus ideas, y eso solo funciona si la gente que está en la sala conoce de verdad el terreno, tiene criterio, sostiene opiniones fuertes y suele acertar. La mayoría de las revisiones han derivado hacia informes de estado, visibilidad ante la dirección y alineamiento entre áreas. Esa deriva es la razón de que la gente las deteste: la reunión deja de ser aprendizaje y se convierte en sobrecarga.

  • #products
X

Amjad Masad

Replit CEO

La próxima frontera por cartografiar es el universo computacional

Masad plantea el momento actual como una nueva era de exploración. Las generaciones anteriores cartografiaron la Tierra y luego fueron al espacio; a esta le toca el espacio de algoritmos, programas, demostraciones y diseños que los agentes de AI pueden recorrer. Es una apuesta conceptual por los agentes como motores de búsqueda sobre lo posible, más que como herramientas de productividad.

  • #agents
X

Thibault Sottiaux

OpenAI reinició los límites de uso para todos los usuarios de pago de Codex y ChatGPT Work

Los límites de uso se reiniciaron de forma generalizada para los clientes de pago de Codex y ChatGPT Work, presentado como una celebración de lo rápido que está creciendo ChatGPT Work. Sottiaux se retira de X por el resto del día y dice que la semana que viene llega más.

  • #products
X

Matt Turck

Menos del 40% de los VC ha tenido alguna vez una inversión exitosa

Turck señala un nuevo estudio según el cual menos del 40% de los capitalistas de riesgo tiene una sola inversión exitosa en su historial, y luego remata él mismo: todos los VC que lo lean estarán en silencio convencidos de que ellos están en ese 40%.

  • #funding
X

Peter Steinberger

Un agente reportó el bug, otro agente lo arregló de madrugada

El agente de Steinberger reportó un bug y el montaje de robobun de Jarred Sumner lo arregló, todo la misma noche y sin ningún humano en ninguno de los dos bucles. Él llama a ese montaje el futuro. También comenta la frustración de hacer trabajo serio de seguridad con equipos socios sólidos y que aun así la gente dé por sentado que el producto no es seguro.

  • #agents
  • #security
X

Nikunj Kothari

FPV Ventures Partner

Dos semanas de viaje gestionadas enteramente con Claude Code, y después una retro

Kothari usó Claude Code como interfaz principal durante un viaje de dos semanas y después le pidió que escribiera una retrospectiva completa sobre qué hacer distinto la próxima vez. Lo interesante es el experimento del agente como herramienta de uso diario para tareas que no son de código, sumado a una autoevaluación de su propio desempeño.

  • #agents
X

Nan Yu

Linear head of product

Si tu gente lista es tan lista, que mejore tu propio producto

El alegato de Yu contra construirte tu propia versión interna de una herramienta: mucha gente muy lista trabaja muy duro para que un producto sea bueno y agradable de usar, así que si tienes gente muy lista, ponla a trabajar en tu propio producto y paga una cuota simbólica por el de otro. Es el argumento de construir o comprar comprimido en una pulla.

  • #products

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.

AI Builders Digest — 2026-07-28 · LLMRates.ai