IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
424 published articles
Datos sintéticos
Sin jefe, sin cuello de botella: por qué un marco peer-to-peer está repensando la generación de datos sintéticos
Matrix es un marco descentralizado que utiliza mensajes serializados enviados a través de colas distribuidas para la generación de datos sintéticos multiagente. Al eliminar el orquestador central, logra un rendimiento entre 2 y 15 veces mayor en hardware idéntico.
2026-06-06
IA local
Ollama 0.30 trae inferencia GPU más rápida y soporte nativo de modelos GGUF
Ollama 0.30 aumenta la inferencia en NVIDIA hasta en un 20%, habilita el soporte GPU Vulkan por defecto para dispositivos AMD e Intel, y amplía la compatibilidad con modelos GGUF, incluidos modelos ajustados de Hugging Face y soporte para llamadas a herramientas con agentes de codificación.
2026-06-05
Infraestructura de IA
El nuevo Nemotron 3 Ultra de Nvidia pone patas arriba la ecuación de costos de los flujos de trabajo agénticos
Nemotron 3 Ultra, el modelo agéntico denso-disperso de Nvidia, promete reducir los costos de inferencia hasta en un 30% frente a modelos abiertos similares, manteniendo un razonamiento de frontera. Con una ventana de contexto de 1 millón de tokens y cuantización nativa NVFP4, se posiciona como el caballo de batalla para cargas de trabajo empresariales de llamadas a herramientas.
2026-06-04
Inteligencia Artificial
OpenJarvis ofrece una alternativa local a los agentes de IA basados en la nube
OpenJarvis 1.0 de los laboratorios Hazy Research y Scaling Intelligence de Stanford permite ejecutar agentes de IA personales localmente a través de Ollama, con acceso a la nube opcional. Incluye configuraciones preestablecidas para resúmenes matutinos, investigación en documentos y asistentes de código local, priorizando la eficiencia y la privacidad mientras rastrea energía, costo y latencia.
2026-05-28
Infraestructura en la nube
¿Qué ejecuta un agente? ANOLISA de Alibaba Cloud reescribe la capa del sistema operativo
ANOLISA de Alibaba Cloud es una actualización del sistema operativo en tres capas para la era de los agentes, que reduce el uso de tokens en un 30% y mejora el tiempo de ejecución en una proporción similar. Diseñado para despliegues de alta densidad de agentes, aborda la seguridad, la observabilidad y la ineficiencia a nivel de kernel.
2026-05-26
Model Studio
El precio fuera de horas punta de Qwen3.7 reduce los costes de API en un 80%, y los desarrolladores de EE. UU. obtienen las mejores horas
El precio fuera de horas punta de Qwen3.7 de Alibaba ofrece hasta un 80% de descuento en llamadas API durante horas que cubren el día laboral de EE. UU. y la UE. Aquí se compara con GPT-5.5, Claude y Gemini, y qué cargas de trabajo se benefician más.
2026-05-20
Qwen3.7
El vacío de las zonas horarias que reduce los costos de inferencia de IA en un 80%
Model Studio reduce automáticamente los costos de API de Qwen3.7-Max y Qwen3.7-Plus hasta en un 80% durante una ventana nocturna que coincide con las horas laborales en Estados Unidos y Europa. Sin registro, sin cambios de código, solo inferencia más barata para cualquiera que ajuste sus llamadas correctamente.
2026-05-20
Alibaba Cloud
Anolisa v0.3 brinda a los agentes de IA una red de seguridad y un botón de deshacer
El sistema operativo de agentes de Alibaba Cloud, Anolisa, llega a la versión 0.3 con un módulo de seguridad dedicado llamado AgentSecCore, visualización de costos en tiempo real y capturas instantáneas del espacio de trabajo que permiten deshacer acciones de agentes en milisegundos.
2026-05-07
Pagos con Stablecoins
Stablecoins, no cripto: Circle apunta a empresas con pagos gestionados
Circle launches a managed stablecoin payments service that lets banks and enterprises process crypto transactions without managing digital assets. The service handles wallet infrastructure, aiming to simplify stablecoin adoption for institutions wary of direct crypto exposure.
2026-03-31
Inferencia local de IA
Ollama acaba de reescribir su motor para Apple silicon. La generación M5 es la verdadera historia
Ollama presenta una vista previa de inferencia basada en MLX en Apple silicon, llevando a Qwen3.5-35B-A3B a 1.851 tok/s de prefill en M5. El cambio también trae cuantización NVFP4 para paridad en producción y una caché más inteligente para flujos de trabajo de agentes.
2026-03-30
Arquitecturas multiagente
Por qué Qoder le da un jefe a cada agente de IA
El Modo Expertos de Qoder reemplaza la mensajería multiagente de igual a igual con un solo Líder que coordina expertos especializados de forma asíncrona. La arquitectura reduce la explosión de estados, mejora la calidad en cuatro dimensiones y extrae habilidades reutilizables después de cada tarea.
2026-03-11
Investigación en seguridad de IA
Los modelos de IA no pueden dejar de pensar en voz alta. Eso es tanto una buena noticia como una pesadilla para la seguridad.
Claude Sonnet 4.5 puede controlar su cadena de pensamiento solo el 2.7% del tiempo, frente al 61.9% para los resultados finales. La brecha plantea preguntas abiertas sobre la solidez de la monitorización de CoT como mecanismo de seguridad, y nadie sabe por qué existe.
2026-03-09