IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
Inteligencia Artificial
AutoVSR: un marco de IA que integra esquemas de circuitos con expresiones simbólicas mediante verificación prioritaria
AutoVSR utiliza percepción visual, una representación intermedia ejecutable y solucionadores simbólicos aumentados con herramientas para convertir de forma fiable diagramas de circuitos en expresiones simbólicas válidas. Los experimentos realizados en cinco tipos de circuitos muestran que supera tanto a los VLM de propósito general como a los métodos especializados, logrando mejoras de precisión del 30 al 59% y del 42 al 52%, respectivamente.
2026-08-04
Agentes de IA
El bot de Slack de Hugging Face consulta datos de producción. El LLM nunca ve las claves
Hugging Face ejecuta un agente de codificación interno de Slack, Moon Bot, que puede consultar bases de datos de producción y abrir PRs. Su diseño de seguridad mantiene las credenciales fuera del alcance del modelo mediante niveles de Okta, bash en sandbox y proxies inversos locales que inyectan las claves en el lado del servidor.
2026-08-04
Infraestructura de IA
Hacer que los agentes paguen es fácil. Hacerlos confiables no lo es.
El Agent Stack de Circle proporciona los rieles financieros para la economía de agentes: pagos en USDC, políticas de gasto y un registro de servicios. Pero la verdadera barrera no es la tecnología, es la gobernanza. Sin registros de auditoría transparentes y barreras programables, la promesa del comercio autónomo sigue siendo teórica.
2026-08-04
IA japonesa
Sakana Namazu apuesta por el keigo frente a la era de la IA más fuerte
Sakana AI presentó Namazu, un modelo especializado en documentos empresariales japoneses, correo electrónico y keigo. Llega mientras las empresas asiáticas informan de que la escasez y la baja calidad de los modelos en idiomas locales están frenando la adopción de la IA.
2026-08-03
Inteligencia Artificial
El meme de IA 'preciso' de Musk acierta con el pasado y se equivoca con el presente
Musk republicó un meme que divide la IA en una noble era teórica y una era de escalado de brainlets. Ambas mitades son historia real, pero el binario se está derrumbando: los kernels han vuelto como ingeniería, los modelos pequeños rivalizan con el escalado, y DeepMind está reconstruyendo el rigor para el deep learning.
2026-08-03
IA de código abierto
Qwen3.8-Max superó a 458 equipos humanos en 24 horas, trabajando solo
Qwen3.8-Max superó a 458 de 526 equipos humanos en un concurso de 24 horas mientras trabajaba solo, y Alibaba publicará sus pesos como código abierto la próxima semana. Por ahora, todas las cifras son autodeclaradas, lo cual es exactamente por lo que las afirmaciones de autonomía merecen ser examinadas.
2026-08-03
Agentes de IA
La promesa de agentes 24/7 de Zuckerberg choca con el problema de confianza de Meta
Zuckerberg promete agentes de consumo 24/7 para salud, relaciones y finanzas, y los llama la próxima ola de ingresos de Meta. La distribución es real a escala de WhatsApp, pero un déficit de confianza y la falta de ecosistemas de datos se interponen entre la visión y los miles de millones de usuarios que necesita.
2026-08-03
Investigación sobre alineación de IA
La alineación pluralista no tiene lugar en la IA de producción, según investigadores
Un artículo presentado en julio de 2026 audita laboratorios de frontera y no encuentra mención del pluralismo en sus documentos públicos. Identifica tres razones para la brecha y propone una hoja de ruta hacia la adopción.
2026-08-03
Estrategia de producto
Sakana AI apuesta contra la era de la 'IA más fuerte': orquestación y lanzamientos rápidos
Sakana AI lanzó Sakana Chat, Marlin, Fugu y Translate en rápida sucesión. El jefe de producto, Sota Omura, explica por qué lanzar rápido es el manual de juego de la era de la IA y por qué la compañía apuesta contra una única 'IA más fuerte'.
2026-08-03
Investigación en IA
Por qué la probabilidad logarítmica de los tokens es la señal equivocada para monitorear modelos de razonamiento de IA
Novelis Research demuestra que la probabilidad logarítmica de los tokens falla como monitor de decodificador para modelos de razonamiento cuantizados, siendo ciega a los bucles confiados. Introducen un controlador e-CUSUM calibrado que combina señales de incertidumbre y repetición, logrando selectividad en GSM8K con DeepSeek-R1-Distill-Qwen-1.5B.
2026-08-03
Desarrollo de IA
Los agentes de codificación están dejando tu máquina local: Alibaba y Mistral se vuelven remotos
Qoder de Alibaba Cloud introduce la delegación remota para agentes de codificación, permitiendo a los desarrolladores descargar tareas de larga duración en sandboxes en la nube. La función, combinada con un nuevo motor de conocimiento, enfrenta a Qoder directamente contra los agentes remotos de Mistral en una carrera por desacoplar el desarrollo asistido por IA del terminal local.
2026-08-03
Inteligencia Artificial
Cómo un sistema de doble memoria enseñó a la IA a diagnosticar los fallos que sigue olvidando
OpsMem combina una memoria a corto plazo (STM) para el estado de diagnóstico en evolución con una memoria a largo plazo (LTM) para la experiencia operativa reutilizable. A través de un mecanismo llamado resonancia de memoria cruzada, el sistema activa experiencia relevante del estado desde la LTM para guiar el diagnóstico multiagente. En un conjunto de datos de microservicios de Huawei, superó las líneas base de razonamiento agéntico y aumentadas con conocimiento por márgenes significativos.
2026-08-03