Hugging Face
20 published articles
NVIDIA
Nvidia y Hugging Face se unen para hacer aburrido el entrenamiento distribuido de difusión
NeMo Automodel de Nvidia ahora se integra directamente con Diffusers de Hugging Face, lo que permite entrenamiento distribuido de nivel de producción para modelos como FLUX, Wan 2.1 y HunyuanVideo. La biblioteca bajo Apache 2.0 maneja el paralelismo como un conmutador de configuración y permite que los puntos de control ajustados se carguen directamente en los pipelines de inferencia.
2026-07-19
Investigación en IA
El cuello de botella que frena a los agentes de IA no es la exploración, sino la evaluación
Dos nuevos artículos de Hugging Face abordan el mismo problema central desde direcciones opuestas: cómo lograr que los agentes de IA evalúen de forma fiable sus propias acciones. AJ-Bench construye un punto de referencia para agentes jueces conscientes del entorno, mientras que HeavySkill sostiene que el mejor juez reside dentro de los parámetros del modelo.
2026-07-17
Ciberseguridad
¿Qué sucede cuando una IA ataca una plataforma de IA? La brecha de Hugging Face es un modelo para la próxima era de la ciberseguridad
Hugging Face sufrió una brecha por parte de un agente autónomo de IA que explotó su canal de datos. El incidente revela cómo las herramientas ofensivas impulsadas por IA operan a velocidad de máquina, y por qué los defensores necesitan modelos capaces en su propia infraestructura para mantener el ritmo.
2026-07-16
Infraestructura en la nube
El salto entre GPUs acaba de encontrar un muro. Una integración lo derribó.
Al montar el almacenamiento de Hugging Face como un backend de primera clase en SkyPilot con cero costos de salida para lecturas, los equipos ahora pueden ejecutar entrenamiento e inferencia en cualquier nube que tenga GPUs libres sin duplicar datos ni pagar tarifas de transferencia por GB. La integración combina el montaje diferido mediante hf-mount con la deduplicación impulsada por Xet para mantener eficiente el movimiento de datos.
2026-07-15
Inteligencia Artificial
Lo que Inkling revela sobre la nueva línea divisoria del mercado de modelos de código abierto
Inkling es el primer modelo disponible abiertamente de casi 1 billón de parámetros con entrada nativa de audio, imagen y texto, junto con una ventana de contexto de 1 millón de tokens y una variante cuantizada NVFP4. Los puntajes brutos en los benchmarks son sólidos, pero la historia más reveladora es cómo el ecosistema de código abierto ha pasado de ser un agente de recuperación a una competencia activa en la frontera, y dónde encaja Inkling en ese nuevo mapa.
2026-07-15
Integración con AWS
AWS y Hugging Face acaban con la peor parte de implementar modelos de IA
AWS y Hugging Face lanzaron una integración de un clic que envía a los desarrolladores desde la página de un modelo directamente a SageMaker Studio con permisos y cuotas de GPU preconfiguradas. Eso significa no más configuración de IAM, no más solicitudes de cuota, no más cambios de pestañas entre paneles.
2026-07-14
Innovación en código abierto
El Moon Bot de Hugging Face convierte Slack en un agente de codificación, y eso es solo esta semana
Moon Bot lleva la asistencia de codificación con IA directamente a los flujos de trabajo de Slack, mientras que VLX-Flow y VLX-Seek abordan la comprensión de video en tiempo real y la percepción de grano fino. Otros aspectos destacados incluyen una receta de preentrenamiento de codificadores médicos, experimentos de destilación QLORA en Qwen y un punto de referencia extraterrestre para el aprendizaje automático.
2026-06-29
Investigación en IA de código abierto
Contexto de un millón de tokens con una décima parte de la caché KV: la apuesta de eficiencia de DeepSeek-V4
La vista previa de DeepSeek-V4 combina un modelo Pro de 1,6 billones de parámetros con una variante Flash de 284 mil millones, ambos con un millón de tokens de contexto. El documento afirma que el modelo requiere el 27% de los FLOPs de inferencia y el 10% de la caché KV de V3.2, las cifras que hacen rentable servir el contexto.
2026-06-22