13 entradas13 builders

AI Builders Digest

Lo que dijeron hoy quienes construyen la IA de verdad. Una página, unos 3 min de lectura.

Anthropic lanzó Fable 5.1 con mejor escritura, precios más bajos y nuevas salvaguardas empresariales. Sam Altman actualizó sobre el sprint de seguridad de OpenAI y el próximo modelo. Además: Box prueba Fable 5.1 en cargas de trabajo empresariales, el enfoque de Peregrine para la IA en seguridad pública, y más.

X

Claude

Claude Fable 5.1 se lanza en todas partes

Claude Fable 5.1 está disponible hoy con escritura mejorada, reducción de falsos positivos en salvaguardas (60% menos intervenciones cibernéticas, 85% menos retrocesos de biología) y nuevas Enterprise Frontier Safeguards para privacidad sin retención de datos mientras se previene el mal uso. Un modelo especializado Mythos 5.1 está disponible a través de programas de acceso confiables.

  • #products
  • #safety
  • #enterprise
X

Sam Altman

Altman: OpenAI corre en seguridad, próximo modelo pronto

Sam Altman dice que OpenAI ha estado corriendo en prioridades de seguridad durante el verano y lanzará un nuevo modelo pronto. Reconoce la tensión entre la emoción por las capacidades de Astra y la necesidad de precaución, y enfatiza que el despliegue iterativo con alineación de seguridad es la máxima prioridad.

  • #safety
  • #policy
  • #products
X

Alex Albert

AnthropicAI Research

Alex Albert explica Enterprise Frontier Safeguards

Albert destaca EFS como una nueva capa de retención cero de datos para agentes que permite a las empresas mantener datos en su propia nube mientras un monitor automatizado señala patrones de riesgo. También muestra Fable 5.1 generando recorridos cinematográficos de casas a partir de una foto mediante Blender headless.

  • #safety
  • #enterprise
  • #agents
X

Boris Cherny

Fable 5.1: recortes de precios, salvaguardas más seguras, mejor tono

Anthropic redujo las lecturas de caché en Fable 5.1 a $0.25 por millón de tokens (desde $1), haciendo que las sesiones de Claude Code sean hasta un 38% más baratas. Las nuevas salvaguardas de biología intervienen en solicitudes benignas un 85% menos frecuente, y las intervenciones cibernéticas caen un 60% por sesión. El modelo también escribe con menos jerga de Claude.

  • #products
  • #safety
  • #pricing
X

Aaron Levie

Box CEO

Box prueba Fable 5.1: salto de 7 puntos porcentuales sobre Fable 5

Aaron Levie informa que las pruebas de lanzamiento temprano de Box de Fable 5.1 en evaluaciones de trabajo empresarial complejo muestran una mejora general de 7 puntos. Victorias específicas: servicios financieros (+17%), tecnología (+37%) y sector público (+16%). También predice que la IA para ciberseguridad se volverá vertical, con modelos frontera encontrando vulnerabilidades y empresas necesitando IA para clasificarlas y corregirlas.

  • #enterprise
  • #evals
  • #safety
X

Nan Yu

OpenAI product staff

Nan Yu: hacer que los agentes sean menos molestos es una gran oportunidad

Nan Yu destaca que la característica principal de Fable 5.1 es una escritura menos molesta, y argumenta que reducir la frustración del usuario es un alfa clave. Sugiere que los diseñadores de UX deberían convertirse en diseñadores de conversación y retórica para evitar que los usuarios abandonen los agentes por frustración.

  • #products
  • #agents
  • #ux
X

Madhu Guru

Meta Senior Director of AI

Madhu Guru: toda empresa debería construir productos que se mejoren a sí mismos

Guru argumenta que las empresas deberían construir sus propios sistemas de post-entrenamiento, evaluaciones y volantes de datos, elogiando al equipo de ML de Shopify. Describe cinco piezas clave para productos que se mejoren a sí mismos: métricas claras, articulación de estrategia, base de conocimiento, conexiones de sistemas internos y un arnés para el flujo de desarrollo de productos.

  • #agents
  • #enterprise
  • #evals
X

Guillermo Rauch

Vercel CEO

Vercel lanza Fable 5.1 en AI Gateway, presenta Fluid compute

Guillermo Rauch anuncia que Fable 5.1 está disponible en Vercel AI Gateway. También detalla Fluid, una plataforma de cómputo unificada que impulsa builds, sandboxes y funciones con Dockerfiles compartidos, perímetros de seguridad y redes. La visión: una plataforma de cómputo global limitada solo por la física.

  • #products
  • #infrastructure
  • #open-source
X

Thariq

Thariq: Fable 5.1 es excelente; el esfuerzo de cambio ya no rompe el caché

Thariq recomienda probar Fable 5.1 en tareas de menor esfuerzo con menos casos extremos, señalando que el esfuerzo de cambio ya no rompe el caché de prompt, haciéndolo más práctico para trabajo iterativo.

  • #products
  • #agents
X

Cat Wu

Cat Wu: Fable 5.1 permite proyectos ambiciosos que antes tomaban meses

Cat Wu dice que el equipo ha asumido proyectos más ambiciosos con Fable 5.1 que antes habrían tomado meses. Invita a los usuarios a probar Fable 5.1 en Claude Code, Cowork y Tag.

  • #products
  • #agents
X

Nikunj Kothari

FPV Ventures partner

WebMCP permite a los agentes interactuar con sitios web de forma nativa

Nikunj Kothari destaca WebMCP, que da a los agentes llamadas a herramientas para interactuar con sitios web, incluyendo soporte completo de UI/UX y elementos interactivos. Una demo muestra agentes creando sus propias vistas en un rastreador de situaciones, preservando ediciones humanas y generando enlaces compartibles.

  • #agents
  • #open-source
  • #products
Pódcast

Training Data

Peregrine: IA para ciudades sin el estado de vigilancia

Nick Noone y Ben Rudolph de Peregrine describen cómo construyeron una plataforma de IA para seguridad pública que invierte el modelo típico de recolección de datos. En lugar de acumular datos, integran datos de agencias existentes con una gobernanza estricta, permitiendo a los detectives resolver casos fríos (por ejemplo, exonerar a un hombre condenado injustamente) y a los gestores de emergencias analizar patrones como corrientes de resaca de tormentas prolongadas. Sus ingenieros desplegados en el terreno trabajan dentro de las agencias, generando confianza y soluciones personalizadas, con el 90% de las integraciones ahora escritas por agentes.

  • #agents
  • #safety
  • #policy

Recíbelo por correo

Un correo al día. Cancela con un clic.

De dónde sale esto

Los datos provienen del proyecto de código abierto follow-builders, de zarazhangrui, publicado bajo licencia MIT. Los resúmenes los genera un LLM a partir de los feeds públicos de ese proyecto, y los prompts de resumen están adaptados de él. Cada entrada enlaza a su fuente original.

Resúmenes generados automáticamente. Lee el original antes de dar por buena cualquier afirmación.