IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
IA en el borde
El runtime solo para CPU de Audio8 permite que la clonación de voz quepa en aproximadamente 1 GiB de RAM
El ONNX Runtime de Audio8 ejecuta la vista previa de TTS de 0,6B enteramente en CPU: pesos autorregresivos INT4, un códec de 44,1 kHz incluido, PCM en streaming y un endpoint compatible con OpenAI. El servicio ocupa aproximadamente 1 GiB de RAM en una laptop, y no se necesitan PyTorch ni Transformers en tiempo de ejecución.
2026-08-05
IA explicable
La perilla que nadie quería girar: dtControl2+ε permite sacrificar optimalidad por claridad
Una nueva extensión de dtControl2 permite a los ingenieros intercambiar una cantidad precisa de rendimiento por árboles de decisión más pequeños y comprensibles. La herramienta, dtControl2+ε, garantiza ε-optimalidad mientras poda árboles hasta órdenes de magnitud con menos nodos.
2026-08-05
Generación de imágenes con IA
Reve 2.1 logra el segundo puesto en Arena con una décima parte del cómputo
Reve 2.1 afirma el segundo puesto general en las tablas de Arena mientras se entrena con menos de una décima parte del cómputo de los laboratorios que lo rodean. La compañía también detalla la salida en 4K, las regiones direccionables y el renderizado de texto multilingüe.
2026-08-05
Consolidación de la IA
Los investigadores de Reve se dirigen a OpenAI; sus productos permanecen en su lugar
La inversión de OpenAI en el laboratorio independiente Reve implica un movimiento de talento investigador: parte del equipo de Investigación de IA de Reve se une al impulso multimodal de OpenAI mientras los productos de Reve permanecen en su lugar. No se reveló ningún monto.
2026-08-05
Seguridad de IA
Shieldstral, de Mistral, pone tu política de moderación en el prompt, no en los pesos
Shieldstral plantea la moderación como una pregunta binaria: una instrucción, una consulta de sí/no y el contenido a evaluar. Mistral afirma que el modelo de 3B iguala a los guardarraíles abiertos hasta siete veces su tamaño en seguridad de texto, con pesos Apache 2.0 que se ejecutan en una GPU de 16GB.
2026-08-05
Seguridad de IA
Shieldstral, el clasificador de 3B que supera a modelos siete veces más grandes
Un clasificador de seguridad de 3B iguala a los modelos de texto casi siete veces más grandes y establece un nuevo estado del arte en moderación multimodal, según un artículo de arXiv de julio de 2026. El truco: la moderación reformulada como respuesta a preguntas binarias, entrenada con aproximadamente 54,1 millones de muestras.
2026-08-05
Inteligencia Artificial
Los LFM2.5-Encoders abogan por los modelos pequeños: 3,7× más rápidos que ModernBERT en CPU
Los LFM2.5-Encoders de pesos abiertos de Liquid AI defienden que el NLP de producción pertenece a los modelos pequeños. Un encoder de 230M supera a ModernBERT-base en los benchmarks y escanea documentos completos en unos 28 segundos en una CPU de portátil, aproximadamente 3,7× más rápido.
2026-08-05
Economía del cómputo
La IA compró las GPU; nadie se hace cargo de mantenerlas ocupadas
La adquisición tiene un equipo. La utilización no. Con acuerdos de GPU de múltiples gigavatios cerrándose entre cuatro proveedores, la métrica que decidió la economía de las aerolíneas se está convirtiendo en la restricción vinculante de la IA, y los clústeres inactivos pierden dinero por hora de calendario.
2026-08-04
Autonomía de red
Un punto ciego de confianza en redes de agentes de múltiples proveedores recibe una solución
Cuando la herramienta del Proveedor B se ve comprometida, los agentes del Proveedor A siguen usándola sin saberlo. Un nuevo artículo propone una máquina de estados de confianza con propagación de cascada amortiguada para reducir la contención de horas a tiempo casi real.
2026-08-04
Investigación en IA
Penelope oculta su razonamiento en una sola capa del decodificador para reducir los costos de inferencia
Penelope, un marco de razonamiento latente para Transformers solo decodificador, localiza el cómputo recurrente en un intervalo estrecho del decodificador, reduciendo la latencia de inferencia sin un gran impacto en la precisión. El artículo describe un currículo que traslada el razonamiento de tokens visibles a un bucle GRU interno.
2026-08-04
IA empresarial
La mitad de las empresas de Asia no usa inglés para la IA. Ese es el cuello de botella
La encuesta de NielsenIQ encargada por Alibaba Cloud a 1.000 responsables de TI en Asia revela que el 95% aumentará sus presupuestos de IA y que el 75% considera la IA indispensable. El hallazgo más relevante: solo alrededor de la mitad de las empresas usa inglés para la IA, lo que convierte a los modelos en idiomas locales en el próximo cuello de botella.
2026-08-04
Agentes de IA
Tratar los SOP como código: un nuevo runtime con paginación de pila separa a los agentes fuertes de los débiles
Una nueva investigación de Hong Kong y China continental demuestra que compilar SOP en pseudocódigo ejecutable y ejecutarlos en una máquina virtual con pila paginada separa limpiamente a los agentes capaces de los frágiles. El trabajo produce una regla de implementación precisa: compilar primero, paginar solo después de una verificación de disciplina a nivel de modelo.
2026-08-04