ÚltimoAnthropic baja 90% el precio de Haiku y Microsoft mete un modelo de 137B en una laptop
THE ZAO°EFFECT

Briefing Diario · 9 de octubre de 2026

Anthropic baja 90% el precio de Haiku y Microsoft mete un modelo de 137B en una laptop

Haiku 5.5 a $0,10 por millón de tokens, Copilot local de Microsoft, SynthID abierto a todos y Arena vale $3.100 millones.

Ayer la noticia no fue un modelo más inteligente. Fue uno más barato, uno que corre en tu máquina, y el negocio creciente de demostrar que todo esto de verdad funciona. Anthropic recortó cerca de 90% el precio de su modelo pequeño, Microsoft sacó un modelo de programación de 137 mil millones de parámetros que corre en una laptop, Google abrió su detector de marcas de agua de IA a cualquiera con un navegador, y la empresa que rankea a los modelos levantó 200 millones de dólares. Y de fondo, Nueva York destrabó un expediente que acusa a TikTok de darle a algunos usuarios jóvenes una herramienta de seguridad que no hacía nada.

Anthropic deja Haiku en $0,10 por millón de tokens

  • Claude Haiku 5.5 cuesta $0,10 por millón de tokens de entrada y $0,50 de salida en pedidos menores a 100.000 tokens, contra $1,00 y $5,00 de Haiku 4.5: cerca de 90% más barato. Por encima de ese umbral son $0,50 y $2,50. Anthropic dice que alrededor del 90% de los pedidos a Haiku 4.5 caían en el tramo barato y calcula una caída de 75% en el costo promedio de una carga de trabajo.
  • Los benchmarks del propio fabricante muestran que no es solo precio: OSWorld 2.1 pasa de 15,7% a 72,4% y GDPval-AA v2.1 de 735 a 1.620. Anthropic también bajó a la mitad la lectura de caché de Sonnet 5.5, de $0,20 a $0,10 por millón. Ya está disponible en la API de Anthropic, AWS, Google Cloud y Azure.

Por qué importaQué significa para Latinoamérica: a este precio cambia lo que vale la pena automatizar. Si facturas en bolívares, pesos o soles y vendes servicios con IA, tareas que la semana pasada no justificaban una llamada a la API - clasificar cada mensaje que entra, leer cada factura, etiquetar cada ticket - hoy cuestan centavos a escala. Audita tus prompts cortos: ahí está el ahorro.

Microsoft pone un modelo de 137 mil millones de parámetros en tu laptop

  • MAI Code 1.1 Flash es un modelo de mezcla de expertos con 137 mil millones de parámetros totales y 6.800 millones activos por pedido. La versión local está cuantizada a unos 3,3 bits por peso y pesa 53GB, cerca de 80% menos que la versión en la nube. Corre sobre un runtime llama.cpp CUDA para Windows ARM64 dentro de GitHub Copilot CLI, la app de Copilot y VS Code.
  • Microsoft reporta que el modelo local cuantizado saca 70,80% en SWE-Bench Verified contra 72,6% en la nube, y 66,29% en Terminal-Bench 2.1 contra 62,9%. Las pruebas corrieron en una Surface Laptop Ultra armada alrededor de NVIDIA RTX Spark con hasta 128GB de memoria unificada; el pico de memoria llegó a 75,5GB con contexto de 256k. El ruteo automático de Copilot entre local y nube llega a fin de octubre.

Por qué importaQué significa para Latinoamérica: perder 1,8 puntos de precisión para dejar de pagar por token y dejar de mandar código a un servidor es un canje que muchos equipos aceptan, sobre todo con internet inestable o pagos en dólares complicados. El problema es el hardware: 128GB de memoria unificada no es la laptop que tiene la mayoría. Por ahora es techo alto, no democratización.

Google abre su detector de marcas de agua de IA a todo el mundo

  • SynthID Detector ya es un sitio público independiente, disponible en todo el mundo y en inglés por ahora. Revisa si una imagen, un video o un audio lleva una marca de agua SynthID de Google o de sus socios, y ya lee las marcas de OpenAI, NVIDIA y Kakao. Apple aparece como próximo.
  • Google dice que lleva más de 180 mil millones de imágenes y videos marcados, más 240.000 años de audio, desde que SynthID arrancó en 2023, y que las verificaciones integradas en Buscador, la app de Gemini y Chrome atienden más de 1 millón de pedidos diarios. El límite duro: solo detecta lo que fue marcado desde el origen.

Por qué importaQué significa para Latinoamérica: en una región donde los audios y videos virales circulan por WhatsApp sin fuente, tener un verificador gratis ayuda. Pero cuidado con el falso alivio: un detector que solo reconoce generadores que cooperan responde la mitad fácil de la pregunta. Lo hecho con un modelo abierto o sin metadatos sale limpio, así que un resultado negativo no prueba nada. Descubre quién publicó primero antes de creerle al detector.

La empresa que rankea a los modelos ya vale $3.100 millones

  • Arena, el ranking colaborativo donde la gente compara dos respuestas anónimas de modelos y vota, levantó una Serie B de 200 millones de dólares con una valoración de 3.100 millones, co-liderada por Lightspeed Venture Partners y Khosla Ventures, con Salesforce Ventures, Dell Technologies Capital, a16z, Felicis, 01 Advisors y Endeavor Catalyst.
  • Es casi el doble de los 1.700 millones post-money de su Serie A de 150 millones en enero, unos diez meses antes. Arena reporta decenas de millones de visitantes mensuales, más de 1.000 modelos monitoreados, comunidad en más de 150 países e ingresos anualizados cerca de 100 millones de dólares a junio, contra 30 millones en enero. El ranking público sigue gratis; la plata viene de vender analítica de evaluación a laboratorios y empresas.

Por qué importaQué significa para Latinoamérica: cuando cada laboratorio se declara primero en sus propios benchmarks, el árbitro se vuelve el activo. La valoración de Arena es una apuesta a que ya nadie le cree a las cifras que un modelo publica de sí mismo. Si vendes soluciones con IA, compara en Arena antes de comprometer un proveedor con un cliente.

Nueva York acusa a TikTok de dar a jóvenes una herramienta de seguridad que no hacía nada

  • Una demanda enmendada de la fiscal general de Nueva York, Letitia James, presentada bajo sello a fines de agosto de 2026 y destrabada por un juez la semana pasada, alega que en 2023 TikTok le dio a miles de usuarios - incluidos menores - una versión que no funcionaba de Algo Refresh, la función que reinicia las recomendaciones. Los usuarios creían que servía; su feed no cambiaba.
  • El expediente dice que las pruebas también midieron el efecto de la función en el tiempo dentro de la app y en la venta de publicidad, y cita la advertencia interna de un gerente de producto del equipo de Bienestar Digital de TikTok de que un grupo placebo contradecía el propósito de la herramienta. TikTok responde que prueba funciones de forma rutinaria y que la demanda da una imagen falsa de cómo opera Algo Refresh. Más de 24 estados ya demandaron a la empresa; en septiembre acordó pagarle a Alabama hasta 300 millones de dólares para cerrar ese caso.

Por qué importaQué significa para Latinoamérica: es la siguiente fase de la regulación de plataformas. Ya no se discute si existe una función de seguridad, sino si de verdad hace lo que promete. Dejar a un grupo de control fuera de una protección es mucho más difícil de defender que un algoritmo malo. Si tienes hijos adolescentes, no confíes en el botón: revisa el feed con ellos.

La foto completa

Cuatro de las cinco historias de ayer apuntan al mismo lado: la inteligencia bruta se vuelve barata y portátil, y lo escaso es la prueba. Anthropic y Microsoft abarataron y acercaron la capacidad al dispositivo con horas de diferencia. Google, Arena y la fiscalía de Nueva York venden o exigen el mismo producto desde ángulos distintos: evidencia de que un sistema es lo que dice ser. El verificador de marcas de agua, el ranking independiente y el expediente destrabado son tres versiones de una sola pregunta: quién verifica esto. Agenda esa pregunta, no el conteo de parámetros, como el filtro para decidir qué productos de IA sobreviven los próximos dos años.

Para profundizar

Fuentes y lecturas

  1. VentureBeat - Anthropic launches Claude Haiku 5.5 with 90% API price reduction
  2. MarkTechPost - Claude Haiku 5.5 at $0.10 per million input tokens
  3. Microsoft - Bringing local models and sandboxed tools to Windows and GitHub Copilot
  4. Google DeepMind - SynthID Detector expands for AI content
  5. The Decoder - 180 billion images and videos carry SynthID watermarks
  6. Bloomberg - AI model evaluator Arena valued at over $3 billion
  7. TechCrunch - Arena nearly doubles valuation to $3.1B in 10 months
  8. FinSMEs - Arena raises $200M Series B at $3.1B valuation
  9. Reuters via TNW - TikTok gave young users a placebo safety tool, New York alleges

La señal, directo a tu correo.

Cada día hábil: las historias de tecnología e IA que importan, verificadas y condensadas en una lectura de 3 minutos. Cero spam.