SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

424 published articles

4 min read

Datos sintéticos

Sin jefe, sin cuello de botella: por qué un marco peer-to-peer está repensando la generación de datos sintéticos

Matrix es un marco descentralizado que utiliza mensajes serializados enviados a través de colas distribuidas para la generación de datos sintéticos multiagente. Al eliminar el orquestador central, logra un rendimiento entre 2 y 15 veces mayor en hardware idéntico.

2026-06-06

Featured3 min read

IA local

Ollama 0.30 trae inferencia GPU más rápida y soporte nativo de modelos GGUF

Ollama 0.30 aumenta la inferencia en NVIDIA hasta en un 20%, habilita el soporte GPU Vulkan por defecto para dispositivos AMD e Intel, y amplía la compatibilidad con modelos GGUF, incluidos modelos ajustados de Hugging Face y soporte para llamadas a herramientas con agentes de codificación.

2026-06-05

Featured5 min read

Infraestructura de IA

El nuevo Nemotron 3 Ultra de Nvidia pone patas arriba la ecuación de costos de los flujos de trabajo agénticos

Nemotron 3 Ultra, el modelo agéntico denso-disperso de Nvidia, promete reducir los costos de inferencia hasta en un 30% frente a modelos abiertos similares, manteniendo un razonamiento de frontera. Con una ventana de contexto de 1 millón de tokens y cuantización nativa NVFP4, se posiciona como el caballo de batalla para cargas de trabajo empresariales de llamadas a herramientas.

2026-06-04

4 min read

Inteligencia Artificial

OpenJarvis ofrece una alternativa local a los agentes de IA basados en la nube

OpenJarvis 1.0 de los laboratorios Hazy Research y Scaling Intelligence de Stanford permite ejecutar agentes de IA personales localmente a través de Ollama, con acceso a la nube opcional. Incluye configuraciones preestablecidas para resúmenes matutinos, investigación en documentos y asistentes de código local, priorizando la eficiencia y la privacidad mientras rastrea energía, costo y latencia.

2026-05-28

7 min read

Infraestructura en la nube

¿Qué ejecuta un agente? ANOLISA de Alibaba Cloud reescribe la capa del sistema operativo

ANOLISA de Alibaba Cloud es una actualización del sistema operativo en tres capas para la era de los agentes, que reduce el uso de tokens en un 30% y mejora el tiempo de ejecución en una proporción similar. Diseñado para despliegues de alta densidad de agentes, aborda la seguridad, la observabilidad y la ineficiencia a nivel de kernel.

2026-05-26

Featured1 min read

Model Studio

El precio fuera de horas punta de Qwen3.7 reduce los costes de API en un 80%, y los desarrolladores de EE. UU. obtienen las mejores horas

El precio fuera de horas punta de Qwen3.7 de Alibaba ofrece hasta un 80% de descuento en llamadas API durante horas que cubren el día laboral de EE. UU. y la UE. Aquí se compara con GPT-5.5, Claude y Gemini, y qué cargas de trabajo se benefician más.

2026-05-20

Featured2 min read

Qwen3.7

El vacío de las zonas horarias que reduce los costos de inferencia de IA en un 80%

Model Studio reduce automáticamente los costos de API de Qwen3.7-Max y Qwen3.7-Plus hasta en un 80% durante una ventana nocturna que coincide con las horas laborales en Estados Unidos y Europa. Sin registro, sin cambios de código, solo inferencia más barata para cualquiera que ajuste sus llamadas correctamente.

2026-05-20

4 min read

Alibaba Cloud

Anolisa v0.3 brinda a los agentes de IA una red de seguridad y un botón de deshacer

El sistema operativo de agentes de Alibaba Cloud, Anolisa, llega a la versión 0.3 con un módulo de seguridad dedicado llamado AgentSecCore, visualización de costos en tiempo real y capturas instantáneas del espacio de trabajo que permiten deshacer acciones de agentes en milisegundos.

2026-05-07

1 min read

Pagos con Stablecoins

Stablecoins, no cripto: Circle apunta a empresas con pagos gestionados

Circle launches a managed stablecoin payments service that lets banks and enterprises process crypto transactions without managing digital assets. The service handles wallet infrastructure, aiming to simplify stablecoin adoption for institutions wary of direct crypto exposure.

2026-03-31

Featured4 min read

Inferencia local de IA

Ollama acaba de reescribir su motor para Apple silicon. La generación M5 es la verdadera historia

Ollama presenta una vista previa de inferencia basada en MLX en Apple silicon, llevando a Qwen3.5-35B-A3B a 1.851 tok/s de prefill en M5. El cambio también trae cuantización NVFP4 para paridad en producción y una caché más inteligente para flujos de trabajo de agentes.

2026-03-30

Featured3 min read

Arquitecturas multiagente

Por qué Qoder le da un jefe a cada agente de IA

El Modo Expertos de Qoder reemplaza la mensajería multiagente de igual a igual con un solo Líder que coordina expertos especializados de forma asíncrona. La arquitectura reduce la explosión de estados, mejora la calidad en cuatro dimensiones y extrae habilidades reutilizables después de cada tarea.

2026-03-11

4 min read

Investigación en seguridad de IA

Los modelos de IA no pueden dejar de pensar en voz alta. Eso es tanto una buena noticia como una pesadilla para la seguridad.

Claude Sonnet 4.5 puede controlar su cadena de pensamiento solo el 2.7% del tiempo, frente al 61.9% para los resultados finales. La brecha plantea preguntas abiertas sobre la solidez de la monitorización de CoT como mecanismo de seguridad, y nadie sabe por qué existe.

2026-03-09

← PreviousPage 35 / 36 · 424 articlesNext →