SevenTnewS

Inferencia de IA

6 published articles

IA4 min read

Infraestructura de IA y Política

Groq apuesta su futuro por la "American AI Stack"

Groq respaldó el Plan de Acción de IA de la Casa Blanca el mismo día de su lanzamiento, nombrándose a sí misma la capa de cómputo de la American AI Stack. El comunicado revela a una empresa que apuesta a que la política nacional y la inferencia nacional barata la llevarán al mercado global.

2026-08-08

IA3 min read

Infraestructura de inferencia

La inferencia de IA se está convirtiendo en un problema de ubicación: Groq abre un centro de datos en el Reino Unido

Groq abrió un centro de datos en el Reino Unido con Equinix mientras GroqCloud supera los 3,5 millones de desarrolladores y el tráfico de IA en producción sigue aumentando. La medida es una apuesta a que la inferencia ahora es un problema de geografía, donde la latencia y la localidad deciden dónde puede ejecutarse la IA en tiempo real.

2026-08-08

IA5 min read

IA Geoespacial

La plataforma OlmoEarth de Ai2 convierte la inferencia satelital en un problema de sistemas distribuidos

La plataforma OlmoEarth de Ai2 aborda la escala única de la inferencia geoespacial dividiendo el trabajo en preparación de datos impulsada por CPU, inferencia en GPU y posprocesamiento en CPU. Un mapa de riesgo de incendios forestales a escala continental se ejecutó con una aceleración de 155x a una fracción de centavo por kilómetro cuadrado. La arquitectura, la tolerancia a fallos y la hoja de ruta muestran cómo el equipo está operacionalizando modelos fundacionales para organizaciones ambientales.

2026-08-02

Hardware y Electrónica2 min read

Arquitectura de GPU

AMD MI455X duplica la capacidad de memoria, pruebas de Hugging Face confirman 3x en rendimiento de solicitudes

Los primeros resultados de Hugging Face muestran que el AMD Instinct MI455X puede manejar el triple de solicitudes concurrentes que el MI300, gracias a 432 GB de memoria HBM4. La biblioteca Transformers logra una tasa de éxito del 99.5% en 24 arquitecturas de modelos clave.

2026-07-30

IA5 min read

Hardware e infraestructura de IA

El acuerdo de Groq con Nvidia importa más que su recaudación de 750 millones de dólares

Groq firmó un acuerdo de licencia no exclusivo con Nvidia para tecnología de inferencia, señalando un giro estratégico de competir en silicio a impulsar la infraestructura global de IA. El acuerdo, junto con una recaudación de 750 millones de dólares y una colaboración con el DOE, posiciona a Groq como un hiperescalador emergente, no solo como un fabricante de chips.

2026-07-16

IAFeatured1 min read

Model Studio

El precio fuera de horas punta de Qwen3.7 reduce los costes de API en un 80%, y los desarrolladores de EE. UU. obtienen las mejores horas

El precio fuera de horas punta de Qwen3.7 de Alibaba ofrece hasta un 80% de descuento en llamadas API durante horas que cubren el día laboral de EE. UU. y la UE. Aquí se compara con GPT-5.5, Claude y Gemini, y qué cargas de trabajo se benefician más.

2026-05-20