IA periférica
7 published articles
IA en el borde
El runtime solo para CPU de Audio8 permite que la clonación de voz quepa en aproximadamente 1 GiB de RAM
El ONNX Runtime de Audio8 ejecuta la vista previa de TTS de 0,6B enteramente en CPU: pesos autorregresivos INT4, un códec de 44,1 kHz incluido, PCM en streaming y un endpoint compatible con OpenAI. El servicio ocupa aproximadamente 1 GiB de RAM en una laptop, y no se necesitan PyTorch ni Transformers en tiempo de ejecución.
2026-08-05
TTS de código abierto
El nuevo modelo TTS de Audio8 clona voces en 11 idiomas de forma gratuita
Audio8 lanza Audio8-TTS Preview bajo Apache 2.0, un modelo de 0.6B que admite 11 idiomas, clonación de voz zero-shot y un códec de 44.1 kHz incluido. El lanzamiento apunta a aplicaciones de habla en el borde que necesitan velocidad y privacidad.
2026-07-30
IA Física
El modelo de borde de 4 mil millones de parámetros de Nvidia hace algo que la mayoría de los VLM pequeños no hacen
Cosmos 3 Edge de Nvidia alberga modelado del mundo en 4B parámetros, ocupando el primer lugar en VANTAGE-Bench entre su clase de tamaño. Su diseño de transformador dual combina razonamiento con predicción de acciones en tiempo real para robots, todo desplegable en hardware Jetson y RTX.
2026-07-28
IA en el borde
Mistral Nano se ejecuta en dispositivos con menos de 1 GB de RAM, igualando el 85% de las puntuaciones de razonamiento de su hermano mayor
El nuevo Mistral Nano de Mistral AI está dirigido a dispositivos periféricos con menos de 1 GB de RAM, logrando el 85% del rendimiento de razonamiento de su modelo más grande Mistral Small en pruebas comparativas estándar.
2026-07-25
IA Empresarial
Mistral posiciona su plataforma de IA empresarial como la puerta de entrada a operaciones nativas de IA
Mistral AI presenta una plataforma empresarial integral adaptada para ventas, ingeniería, cumplimiento normativo, soporte y operaciones, con soluciones específicas para finanzas, salud, logística, comercio electrónico, gobierno y defensa. La empresa destaca clientes existentes como BNP Paribas, AXA, CMA CGM y France Travail.
2026-07-18
LLMs y Modelos
La receta de cascada de Mistral reduce los LLM sin eliminar el razonamiento
La destilación en cascada de Mistral reduce modelos grandes a pequeños conservando el razonamiento y la visión. La variante de 3B tiene capacidades que antes requerían diez veces los parámetros, y todo es Apache 2.0.
2026-07-17
reporte especial / IA en el borde
Nvidia DeepStream se vuelve código abierto: qué significa el lanzamiento 9.1 para la IA en el borde
El código fuente completo del SDK de análisis de video DeepStream de Nvidia ya está en GitHub bajo licencias Apache 2.0 y CC-BY-4.0, abriendo el desarrollo de IA en el borde a una audiencia más amplia. La versión 9.1 trae agentes de codificación basados en LLM, integración con Triton Inference Server y repositorios consolidados para pipelines de extremo a extremo.
2026-07-16