12 entradas12 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 5 min de lectura.

La infraestructura para agents fue el hilo conductor del día: Parag Agrawal, de Parallel, explicó por qué una búsqueda construida sobre clics humanos es el sustrato equivocado para los agents, y Vercel sacó dos piezas de plomería para el mismo problema. Anthropic unificó la memoria entre el chat de Claude y Cowork, OpenAI añadió un plan para equipos en ChatGPT y Codex, y Sam Altman dijo que OpenAI fabricó un chip. Por debajo de todo eso, una discusión más silenciosa sobre quién paga: por los publishers de la web, por los datacenters, por los tokens.

Pódcast

Training Data

Parag Agrawal: los datos de clics humanos son un bug, y la búsqueda para agents necesita su propia economía

Parallel está construyendo búsqueda web para agents apostando a que los agents buscarán mil veces más de lo que jamás buscaron los humanos, y a que la señal de ranking sobre la que se construyó Google es la equivocada. «En Parallel creemos que los datos de clics humanos son un bug, y que un agent que trabaja con búsqueda debería apoyarse en feedback de agents, no en feedback humano.» La empresa se saltó el índice completo desde el día uno: lanzó un search agent que rastrea en el momento de la consulta, cambiando latencia por cobertura mientras el índice crecía, y dejó la latencia para el final, hasta sacar un producto que recorta un presupuesto de tres segundos a 200 milisegundos. Agrawal también intenta arreglar los pagos a publishers con valores de Shapley, estimando cuánto vale una fuente según cuánto cómputo extra haría falta para recuperar la calidad que se pierde sin ella, y sitúa los pagos significativos a un abanico amplio de dueños de contenido a doce o veinticuatro meses vista. Parallel es ahora proveedor de búsqueda y grounding para las APIs de agents empresariales de Google Cloud, disponible como opción junto a la búsqueda de Google.

  • #agents
  • #search
  • #products
X

Guillermo Rauch

Vercel CEO

Vercel lanza el Run SDK y pasa Connect a GA, los dos apuntando a la ejecución de código por agents

El Run SDK es un eval seguro para ejecución dinámica en Code Mode: cuando un agent escribe código, lo corres en un contexto seguro y ligero de QuickJS en vez de levantar un sandbox completo, algo que Rauch vende como más rápido y más eficiente en costo. Vercel Connect también llegó a GA, y te da un cliente MCP que puedes consultar en nombre de un usuario autenticado después de correr algo como `vercel connect create notion`. Su encuadre para ambos: «El problema más difícil al construir agents es la conectividad segura a servicios y datos.»

  • #agents
  • #products
  • #developer-tools
X

Claude

Claude ya tiene una sola memoria compartida entre el chat y Cowork

Le pasas una tarea a Cowork y arranca desde lo que Claude ya sabe por tus chats: el proyecto que le explicaste, las preferencias de tu manager o el cliente del trimestre pasado. Todo lo recordado se guarda como una lista de temas en Ajustes que puedes leer, editar o borrar, y la memoria se actualiza sola mientras chateas o cuando pides explícitamente «recuerda esto». Los temas que algunas personas consideran sensibles, como salud o creencias religiosas, quedan fuera de la memoria salvo que los actives. La memoria viene activada por defecto en Free, Pro y Max.

  • #products
  • #memory
X

Thibault Sottiaux

OpenAI añade un plan para equipos en ChatGPT y Codex, sin límites de 5 horas

Sottiaux dice que la demanda de este venía fuerte: funciona como el plan Pro de 100 dólares pero está pensado para equipos y empresas pequeñas. Incluye todas las funciones de ChatGPT, ChatGPT Work y Codex, conectores para Google Workspace, Slack, GitHub y Microsoft 365, SAML, SSO y MFA, facturación centralizada, analítica de uso con controles de gasto, y nada de límites de 5 horas.

  • #products
  • #pricing
X

Sam Altman

Sam Altman: «hicimos un chip y es rápido»

Eso es el post entero. Sin specs, sin proveedor, sin fecha de disponibilidad, pero es lo primero que dice sobre silicio en este formato.

  • #hardware
X

Madhu Guru

Meta Sr Director, AI

La mayoría de los evals falla porque los equipos los congelan mientras el comportamiento de los usuarios sigue moviéndose

La parte 9 de la serie sobre evals de Madhu Guru sostiene que los evals necesitan un roadmap, no ser un artefacto fijo. Piensa en un agent de research financiero: la primera semana los usuarios quieren el resumen de un informe de resultados de 5 páginas, tres semanas después quieren comparar cinco informes en una historia de crecimiento, dos meses más tarde te entregan 15 filings y transcripciones y esperan una tesis de inversión, y al final quieren monitoreo de portafolio con alertas. Cada etapa pide evals distintos: de contexto corto a contexto largo, de un turno a multi turno, de citas por pasaje a citas por línea, de QA simple a síntesis, de chat reactivo a agent proactivo. Su versión práctica: mapea las dimensiones por las que va a evolucionar el uso, mina las trazas de producción buscando esos cambios, y construye los evals P0 de la siguiente etapa antes de que los usuarios lleguen ahí. Si tus evals se quedaron en la semana uno mientras los usuarios van por la semana tres, eso termina apareciendo en el churn.

  • #evals
  • #agents
X

Aaron Levie

Box CEO

Levie: el valor está en la brecha entre los modelos y los workflows empresariales

A partir de un post sobre estrategia de AI aplicada a gran escala, Levie sostiene que el mundo no quiere modelos y agents en crudo, quiere resultados, y que la prima se la lleva quien convierta tokens en resultados del mundo real dentro de industrias concretas. Lo que eso exige de verdad no tiene nada de glamoroso: entender el contexto, empujar la gestión del cambio, un harness que enrute entre modelos, conexiones a los sistemas críticos de negocio de cada vertical, la UX de sentar al usuario junto a los agents dentro de un workflow, y evals específicos del dominio. Lo plantea como una ventana que está abierta justo ahora para construir las empresas que van a definir cada dominio empresarial.

  • #agents
  • #enterprise
X

Aditya Agarwal

SPC General Partner

Por qué el público odia la construcción de datacenters, contado desde dentro de la industria

Agarwal dice que la reacción en contra no sorprende en absoluto, porque hoy la AI ayuda sobre todo a los knowledge workers y al segmento mejor pagado del país. Espera que la cosa cambie cuando la AI empiece a encontrar curas para enfermedades que afectan a todo el mundo, y dice que hay luz al final de ese túnel, que es también por lo que algunas de las personas más brillantes se están metiendo en esto. Su autocrítica hacia la industria: en vez de pintar una versión positiva del futuro, nos dedicamos a explicar por qué todos deberían tener miedo.

  • #policy
  • #hardware
X

Peter Yang

Peter Yang libera /fuck-cancer, una skill para pacientes y cuidadores

La skill construye y mantiene un brief que funciona como única fuente de verdad, armado a partir de tus documentos y tu contexto, con cinco secciones: datos del paciente y del equipo médico para consultar durante las llamadas, exactamente tres próximas acciones, lo que sabemos separado entre hechos confirmados y preguntas abiertas, términos médicos en lenguaje llano, y un registro de cuidados con las actualizaciones y decisiones recientes. Cuando necesita investigar, tira del National Cancer Institute y de la API de ClinicalTrials.gov. Funciona con ChatGPT, Codex o Claude Code, y guarda un archivo Markdown local o un Google Doc compartido para que toda la familia trabaje sobre la misma información. Salió de lo que le contaron pacientes y cuidadores después de que compartiera la historia de su madre, incluido que el volumen de médicos, documentos y papeleo del seguro se vuelve abrumador muy rápido.

  • #open-source
  • #products
  • #health
X

Swyx

Aviso: las capacidades locked-use de Codex están dejando a la gente fuera del keychain de macOS

Swyx dice que a él lo dejó fuera dos veces esta semana, y apunta a los foros de desarrolladores de Apple, donde se reconoce como un bug conocido en funciones inestables de Mac de las que Codex depende ahora mismo. Su consejo es directo: evítalo por ahora. Preferiría hacerlo todo en la nube, pero dice que la nube todavía no llega.

  • #developer-tools
  • #bugs
X

Google Labs

Google Labs abre lista de espera para Play with Putty, vibe coding multijugador

Putty es una herramienta colaborativa para construir sitios web y herramientas pequeñas entre varios y en tiempo real, presentada como vibe coding pasado a multijugador. Solo por lista de espera, solo en Estados Unidos, mayores de 18.

  • #products
  • #developer-tools
X

Nikunj Kothari

FPV Ventures Partner

Un monitor de El Niño construido en solitario con Codex y publicado en Railway

Kothari lanzó elneenyo.com, que trae actualizaciones y noticias en tiempo real directamente de fuentes gubernamentales, con estimaciones de impacto y costo por región, registros históricos, y un glosario y FAQ para las distintas lecturas. Lo construyó con ChatGPT Codex sobre Railway, con el pulido de diseño de las skills de Emil Kowalski y loaders generativos de Kasturi, después de que un episodio de Odd Lots le diera la idea.

  • #products
  • #agents

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.