IoT y SensoresFeatured6 min read
Investigación en IA
Cómo BMW metió 16K de contexto en una GPU de 16 GB rediseñando la atención
Investigadores de BMW demuestran que la Atención Global Jerárquica, combinada con retropropagación truncada y almacenamiento externo de KV, permite que una GPU de 16 GB entrene en 16K tokens, cuatro veces el límite de la atención densa, sin pérdida medible en la calidad del adaptador.
2026-07-20