SevenTnewS

Inférence IA

6 published articles

IA4 min read

Infrastructure et politique de l'IA

Groq parie son avenir sur l'American AI Stack

Groq a approuvé le plan d'action sur l'IA de la Maison-Blanche le jour de son lancement, se désignant comme couche de calcul de l'American AI Stack. Le communiqué révèle une entreprise qui parie que la politique nationale et l'inférence domestique bon marché la mèneront sur le marché mondial.

2026-08-08

IA3 min read

Infrastructure d'inférence

L'inférence IA devient un problème de localisation : Groq ouvre un centre de données au Royaume-Uni

Groq a ouvert un centre de données au Royaume-Uni avec Equinix alors que GroqCloud dépasse les 3,5 millions de développeurs et que le trafic IA en production ne cesse de croître. Ce choix est un pari : l'inférence est désormais un problème de géographie, la latence et la proximité décidant où l'IA en temps réel peut s'exécuter.

2026-08-08

IA5 min read

IA géospatiale

La plateforme OlmoEarth d’Ai2 transforme l’inférence satellitaire en un problème de systèmes distribués

La plateforme OlmoEarth d’Ai2 aborde l’échelle unique de l’inférence géospatiale en divisant le travail en préparation des données pilotée par CPU, inférence GPU et post-traitement CPU. Une carte des risques d’incendie à l’échelle d’un continent a été exécutée avec une accélération de 155x pour une fraction de centime par kilomètre carré. L’architecture, la tolérance aux pannes et la feuille de route montrent comment l’équipe opérationnalise les modèles de base pour les organisations environnementales.

2026-08-02

Matériel & Électronique2 min read

Architecture GPU

AMD MI455X double la capacité mémoire, les tests de Hugging Face confirment un débit de requêtes multiplié par 3

Les premiers résultats de Hugging Face montrent que l'AMD Instinct MI455X peut gérer trois fois plus de requêtes simultanées que le MI300, grâce à 432 Go de mémoire HBM4. La bibliothèque Transformers atteint un taux de succès de 99,5 % sur 24 architectures de modèles clés.

2026-07-30

IA5 min read

Matériel et infrastructure IA

L'accord de Groq avec Nvidia compte plus que sa levée de 750 millions de dollars

Groq a signé un accord de licence non exclusif avec Nvidia pour la technologie d'inférence, signalant un pivot stratégique, passant de la compétition sur le silicium à l'alimentation de l'infrastructure IA mondiale. L'accord, associé à une levée de 750 millions de dollars et à une collaboration avec le DOE, positionne Groq comme un hyperscaler émergent, et non seulement un fabricant de puces.

2026-07-16

IAFeatured1 min read

Model Studio

Les tarifs hors pointe de Qwen3.7 réduisent les coûts API de 80 %, et les développeurs américains bénéficient des meilleures heures

Les tarifs hors pointe de Qwen3.7 d'Alibaba offrent jusqu'à 80 % de réduction sur les appels API pendant les heures couvrant la journée de travail américaine et européenne. Voici comment cela se compare à GPT-5.5, Claude et Gemini, et quelles charges de travail en bénéficient le plus.

2026-05-20