SevenTnewS

DeepSeek

DeepSeek-V3, DeepSeek-R1, Coder y el avance chino en LLMs de código abierto.

7 published articles

4 min read

Agentes de IA · Código abierto

DeepSeek lanza un harness de agentes donde incluso el modelo es un plugin

DeepSeek publicó DeepSeek Harness, un runtime de agentes de código abierto donde los modelos, las herramientas, los sandboxes y la interfaz de usuario son todos plugins de Cordis. Los registros de sesión de solo añadidura y un modo mínimo de dos herramientas apuntan a una ambición más discreta: ejecuciones de agentes auditables y reproducibles.

2026-08-16

2 min read

Inteligencia Artificial

DeepSeek-OCR 2 trae el Flujo Causal Visual a la comprensión de documentos de código abierto

DeepSeek-OCR 2 introduce el Flujo Causal Visual para una codificación visual similar a la humana. Ahora disponible como código abierto en GitHub, el modelo es compatible con vLLM y Transformers, resolución dinámica (hasta 1,216 tokens visuales) y conversión de documentos a Markdown.

2026-07-09

Featured2 min read

Economía de API

DeepSeek V4 llega en julio con un cambio de precios que dolerá si programas cuando el sol está en lo alto

DeepSeek V4 llega a mediados de julio con precios por carga máxima. El costo de la API se duplica durante el horario comercial, hasta $1.74 por millón de tokens de salida, pero las tarifas fuera de las horas pico pueden ser una ganga para cargas de trabajo con aciertos de caché.

2026-07-09

5 min read

Lanzamiento de modelo

Llega el avance de DeepSeek-V4, y la competencia de pesos abiertos se vuelve más difícil para todos

DeepSeek presenta el avance de DeepSeek-V4 con razonamiento de primer nivel y habilidades de agente más sólidas, ahora disponible en múltiples plataformas. El lanzamiento señala una escalada importante en la carrera de IA de pesos abiertos, presionando a OpenAI y Google para que justifiquen sus estrategias de código cerrado.

2026-07-05

2 min read

Optimización de Inferencia de LLM

Aleph Alpha construye un modelo teórico de inferencia para descifrar el rendimiento de DeepSeek V3 a partir de primitivas de hardware

El modelo teórico de Aleph Alpha predice el rendimiento de inferencia de DeepSeek V3 únicamente a partir de parámetros de hardware, revelando cómo la cantidad de GPU y el ancho de banda de interconexión desplazan el cuello de botella entre cómputo, memoria y comunicación.

2026-07-04

3 min read

Inteligencia Artificial

El nuevo modelo de DeepSeek pone la eficiencia en el frente de la carrera armamentista de la IA

DeepSeek ha lanzado un nuevo LLM que agudiza su competencia con los principales laboratorios de IA al apostar por la eficiencia sobre la fuerza bruta. El modelo busca ofrecer un rendimiento sólido con un uso optimizado de recursos, reflejando un giro más amplio de la industria hacia una IA rentable.

2026-06-30

4 min read

Investigación en IA de código abierto

Contexto de un millón de tokens con una décima parte de la caché KV: la apuesta de eficiencia de DeepSeek-V4

La vista previa de DeepSeek-V4 combina un modelo Pro de 1,6 billones de parámetros con una variante Flash de 284 mil millones, ambos con un millón de tokens de contexto. El documento afirma que el modelo requiere el 27% de los FLOPs de inferencia y el 10% de la caché KV de V3.2, las cifras que hacen rentable servir el contexto.

2026-06-22