eficiencia
3 published articles
IA multimodal
Un modelo de 12B supera a uno de 90B. La ortodoxia del escalado está en aprietos
Pixtral-12B iguala o supera a modelos siete veces más grandes en benchmarks multimodales, sin sacrificar el rendimiento lingüístico. Mistral también publica un nuevo benchmark abierto para la evaluación práctica de lenguaje visual, desafiando la idea de que más grande siempre es mejor.
2026-07-17
Análisis comparativo de referencia
GPT-5.6 hace que cada dólar en IA rinda más que nunca
La familia GPT-5.6 de OpenAI, Sol, Terra, Luna, ofrece resultados de vanguardia en codificación, ciberseguridad y pruebas profesionales a una fracción del costo en tokens de sus competidores. El modo multiagente 'ultra' y los precios escalonados buscan hacer que la inteligencia de frontera sea accesible para más usuarios, mientras que las salvaguardas en capas abordan los riesgos de doble uso.
2026-07-09
Investigación en IA de código abierto
Contexto de un millón de tokens con una décima parte de la caché KV: la apuesta de eficiencia de DeepSeek-V4
La vista previa de DeepSeek-V4 combina un modelo Pro de 1,6 billones de parámetros con una variante Flash de 284 mil millones, ambos con un millón de tokens de contexto. El documento afirma que el modelo requiere el 27% de los FLOPs de inferencia y el 10% de la caché KV de V3.2, las cifras que hacen rentable servir el contexto.
2026-06-22