IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
364 published articles
Lanzamiento de producto
Claude Sonnet 5 ya está aquí, y Anthropic apuesta por la ciencia y la empresa
Anthropic lanzó Claude Sonnet 5, un modelo más rápido y capaz para codificación y agentes, junto con Claude Science para investigadores y Claude Tag para equipos. La compañía también publicó un marco de política sobre el crecimiento exponencial de la IA.
2026-06-30
Análisis del lanzamiento de Anthropic
Claude Sonnet 5 hace más difícil justificar la brecha de precio con Opus
Claude Sonnet 5 promete un razonamiento y rendimiento agente casi al nivel de Opus a un costo menor. Los primeros evaluadores reportan mejoras drásticas en la finalización autónoma de tareas y en el seguimiento de operaciones complejas de múltiples pasos. Con precios introductorios hasta agosto de 2026, el modelo hace más difícil justificar la brecha de precio con Opus.
2026-06-30
Inteligencia Artificial
El nuevo modelo de DeepSeek pone la eficiencia en el frente de la carrera armamentista de la IA
DeepSeek ha lanzado un nuevo LLM que agudiza su competencia con los principales laboratorios de IA al apostar por la eficiencia sobre la fuerza bruta. El modelo busca ofrecer un rendimiento sólido con un uso optimizado de recursos, reflejando un giro más amplio de la industria hacia una IA rentable.
2026-06-30
Análisis de evaluación de agentes
ProgramBench: todas las IAs públicas obtienen un 0% en la prueba de codificación más difícil hasta el momento
ProgramBench desafía a los agentes de IA a reconstruir programas solo a partir de binarios, sin código fuente ni descripciones de problemas. Todos los modelos públicos fallan al resolver completamente cualquier tarea, exponiendo debilidades en la exploración, arquitectura y juicio de parada. El benchmark es una prueba de estrés para agentes de codificación que avanzan más allá de los flujos de trabajo basados en parches.
2026-06-29
Datos sintéticos
Sin jefe, sin cuello de botella: por qué un marco peer-to-peer está repensando la generación de datos sintéticos
Matrix es un marco descentralizado que utiliza mensajes serializados enviados a través de colas distribuidas para la generación de datos sintéticos multiagente. Al eliminar el orquestador central, logra un rendimiento entre 2 y 15 veces mayor en hardware idéntico.
2026-06-06
IA local
Ollama 0.30 trae inferencia GPU más rápida y soporte nativo de modelos GGUF
Ollama 0.30 aumenta la inferencia en NVIDIA hasta en un 20%, habilita el soporte GPU Vulkan por defecto para dispositivos AMD e Intel, y amplía la compatibilidad con modelos GGUF, incluidos modelos ajustados de Hugging Face y soporte para llamadas a herramientas con agentes de codificación.
2026-06-05
Infraestructura de IA
El nuevo Nemotron 3 Ultra de Nvidia pone patas arriba la ecuación de costos de los flujos de trabajo agénticos
Nemotron 3 Ultra, el modelo agéntico denso-disperso de Nvidia, promete reducir los costos de inferencia hasta en un 30% frente a modelos abiertos similares, manteniendo un razonamiento de frontera. Con una ventana de contexto de 1 millón de tokens y cuantización nativa NVFP4, se posiciona como el caballo de batalla para cargas de trabajo empresariales de llamadas a herramientas.
2026-06-04
Inteligencia Artificial
OpenJarvis ofrece una alternativa local a los agentes de IA basados en la nube
OpenJarvis 1.0 de los laboratorios Hazy Research y Scaling Intelligence de Stanford permite ejecutar agentes de IA personales localmente a través de Ollama, con acceso a la nube opcional. Incluye configuraciones preestablecidas para resúmenes matutinos, investigación en documentos y asistentes de código local, priorizando la eficiencia y la privacidad mientras rastrea energía, costo y latencia.
2026-05-28
Infraestructura en la nube
¿Qué ejecuta un agente? ANOLISA de Alibaba Cloud reescribe la capa del sistema operativo
ANOLISA de Alibaba Cloud es una actualización del sistema operativo en tres capas para la era de los agentes, que reduce el uso de tokens en un 30% y mejora el tiempo de ejecución en una proporción similar. Diseñado para despliegues de alta densidad de agentes, aborda la seguridad, la observabilidad y la ineficiencia a nivel de kernel.
2026-05-26
Alibaba Cloud
Anolisa v0.3 brinda a los agentes de IA una red de seguridad y un botón de deshacer
El sistema operativo de agentes de Alibaba Cloud, Anolisa, llega a la versión 0.3 con un módulo de seguridad dedicado llamado AgentSecCore, visualización de costos en tiempo real y capturas instantáneas del espacio de trabajo que permiten deshacer acciones de agentes en milisegundos.
2026-05-07
Inferencia local de IA
Ollama acaba de reescribir su motor para Apple silicon. La generación M5 es la verdadera historia
Ollama presenta una vista previa de inferencia basada en MLX en Apple silicon, llevando a Qwen3.5-35B-A3B a 1.851 tok/s de prefill en M5. El cambio también trae cuantización NVFP4 para paridad en producción y una caché más inteligente para flujos de trabajo de agentes.
2026-03-30
Investigación en seguridad de IA
Los modelos de IA no pueden dejar de pensar en voz alta. Eso es tanto una buena noticia como una pesadilla para la seguridad.
Claude Sonnet 4.5 puede controlar su cadena de pensamiento solo el 2.7% del tiempo, frente al 61.9% para los resultados finales. La brecha plantea preguntas abiertas sobre la solidez de la monitorización de CoT como mecanismo de seguridad, y nadie sabe por qué existe.
2026-03-09