SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

4 min read

IA en el borde

El runtime solo para CPU de Audio8 permite que la clonación de voz quepa en aproximadamente 1 GiB de RAM

El ONNX Runtime de Audio8 ejecuta la vista previa de TTS de 0,6B enteramente en CPU: pesos autorregresivos INT4, un códec de 44,1 kHz incluido, PCM en streaming y un endpoint compatible con OpenAI. El servicio ocupa aproximadamente 1 GiB de RAM en una laptop, y no se necesitan PyTorch ni Transformers en tiempo de ejecución.

2026-08-05

3 min read

IA explicable

La perilla que nadie quería girar: dtControl2+ε permite sacrificar optimalidad por claridad

Una nueva extensión de dtControl2 permite a los ingenieros intercambiar una cantidad precisa de rendimiento por árboles de decisión más pequeños y comprensibles. La herramienta, dtControl2+ε, garantiza ε-optimalidad mientras poda árboles hasta órdenes de magnitud con menos nodos.

2026-08-05

Featured3 min read

Generación de imágenes con IA

Reve 2.1 logra el segundo puesto en Arena con una décima parte del cómputo

Reve 2.1 afirma el segundo puesto general en las tablas de Arena mientras se entrena con menos de una décima parte del cómputo de los laboratorios que lo rodean. La compañía también detalla la salida en 4K, las regiones direccionables y el renderizado de texto multilingüe.

2026-08-05

Featured4 min read

Consolidación de la IA

Los investigadores de Reve se dirigen a OpenAI; sus productos permanecen en su lugar

La inversión de OpenAI en el laboratorio independiente Reve implica un movimiento de talento investigador: parte del equipo de Investigación de IA de Reve se une al impulso multimodal de OpenAI mientras los productos de Reve permanecen en su lugar. No se reveló ningún monto.

2026-08-05

Featured4 min read

Seguridad de IA

Shieldstral, de Mistral, pone tu política de moderación en el prompt, no en los pesos

Shieldstral plantea la moderación como una pregunta binaria: una instrucción, una consulta de sí/no y el contenido a evaluar. Mistral afirma que el modelo de 3B iguala a los guardarraíles abiertos hasta siete veces su tamaño en seguridad de texto, con pesos Apache 2.0 que se ejecutan en una GPU de 16GB.

2026-08-05

Featured4 min read

Seguridad de IA

Shieldstral, el clasificador de 3B que supera a modelos siete veces más grandes

Un clasificador de seguridad de 3B iguala a los modelos de texto casi siete veces más grandes y establece un nuevo estado del arte en moderación multimodal, según un artículo de arXiv de julio de 2026. El truco: la moderación reformulada como respuesta a preguntas binarias, entrenada con aproximadamente 54,1 millones de muestras.

2026-08-05

5 min read

Inteligencia Artificial

Los LFM2.5-Encoders abogan por los modelos pequeños: 3,7× más rápidos que ModernBERT en CPU

Los LFM2.5-Encoders de pesos abiertos de Liquid AI defienden que el NLP de producción pertenece a los modelos pequeños. Un encoder de 230M supera a ModernBERT-base en los benchmarks y escanea documentos completos en unos 28 segundos en una CPU de portátil, aproximadamente 3,7× más rápido.

2026-08-05

5 min read

Economía del cómputo

La IA compró las GPU; nadie se hace cargo de mantenerlas ocupadas

La adquisición tiene un equipo. La utilización no. Con acuerdos de GPU de múltiples gigavatios cerrándose entre cuatro proveedores, la métrica que decidió la economía de las aerolíneas se está convirtiendo en la restricción vinculante de la IA, y los clústeres inactivos pierden dinero por hora de calendario.

2026-08-04

2 min read

Autonomía de red

Un punto ciego de confianza en redes de agentes de múltiples proveedores recibe una solución

Cuando la herramienta del Proveedor B se ve comprometida, los agentes del Proveedor A siguen usándola sin saberlo. Un nuevo artículo propone una máquina de estados de confianza con propagación de cascada amortiguada para reducir la contención de horas a tiempo casi real.

2026-08-04

3 min read

Investigación en IA

Penelope oculta su razonamiento en una sola capa del decodificador para reducir los costos de inferencia

Penelope, un marco de razonamiento latente para Transformers solo decodificador, localiza el cómputo recurrente en un intervalo estrecho del decodificador, reduciendo la latencia de inferencia sin un gran impacto en la precisión. El artículo describe un currículo que traslada el razonamiento de tokens visibles a un bucle GRU interno.

2026-08-04

5 min read

IA empresarial

La mitad de las empresas de Asia no usa inglés para la IA. Ese es el cuello de botella

La encuesta de NielsenIQ encargada por Alibaba Cloud a 1.000 responsables de TI en Asia revela que el 95% aumentará sus presupuestos de IA y que el 75% considera la IA indispensable. El hallazgo más relevante: solo alrededor de la mitad de las empresas usa inglés para la IA, lo que convierte a los modelos en idiomas locales en el próximo cuello de botella.

2026-08-04

5 min read

Agentes de IA

Tratar los SOP como código: un nuevo runtime con paginación de pila separa a los agentes fuertes de los débiles

Una nueva investigación de Hong Kong y China continental demuestra que compilar SOP en pseudocódigo ejecutable y ejecutarlos en una máquina virtual con pila paginada separa limpiamente a los agentes capaces de los frágiles. El trabajo produce una regla de implementación precisa: compilar primero, paginar solo después de una verificación de disciplina a nivel de modelo.

2026-08-04

← PreviousPage 8 / 48 · 565 articlesNext →