DeepSeek
DeepSeek-V3, DeepSeek-R1, Coder y el avance chino en LLMs de código abierto.
7 published articles
Agentes de IA · Código abierto
DeepSeek lanza un harness de agentes donde incluso el modelo es un plugin
DeepSeek publicó DeepSeek Harness, un runtime de agentes de código abierto donde los modelos, las herramientas, los sandboxes y la interfaz de usuario son todos plugins de Cordis. Los registros de sesión de solo añadidura y un modo mínimo de dos herramientas apuntan a una ambición más discreta: ejecuciones de agentes auditables y reproducibles.
2026-08-16
Inteligencia Artificial
DeepSeek-OCR 2 trae el Flujo Causal Visual a la comprensión de documentos de código abierto
DeepSeek-OCR 2 introduce el Flujo Causal Visual para una codificación visual similar a la humana. Ahora disponible como código abierto en GitHub, el modelo es compatible con vLLM y Transformers, resolución dinámica (hasta 1,216 tokens visuales) y conversión de documentos a Markdown.
2026-07-09
Economía de API
DeepSeek V4 llega en julio con un cambio de precios que dolerá si programas cuando el sol está en lo alto
DeepSeek V4 llega a mediados de julio con precios por carga máxima. El costo de la API se duplica durante el horario comercial, hasta $1.74 por millón de tokens de salida, pero las tarifas fuera de las horas pico pueden ser una ganga para cargas de trabajo con aciertos de caché.
2026-07-09
Lanzamiento de modelo
Llega el avance de DeepSeek-V4, y la competencia de pesos abiertos se vuelve más difícil para todos
DeepSeek presenta el avance de DeepSeek-V4 con razonamiento de primer nivel y habilidades de agente más sólidas, ahora disponible en múltiples plataformas. El lanzamiento señala una escalada importante en la carrera de IA de pesos abiertos, presionando a OpenAI y Google para que justifiquen sus estrategias de código cerrado.
2026-07-05
Optimización de Inferencia de LLM
Aleph Alpha construye un modelo teórico de inferencia para descifrar el rendimiento de DeepSeek V3 a partir de primitivas de hardware
El modelo teórico de Aleph Alpha predice el rendimiento de inferencia de DeepSeek V3 únicamente a partir de parámetros de hardware, revelando cómo la cantidad de GPU y el ancho de banda de interconexión desplazan el cuello de botella entre cómputo, memoria y comunicación.
2026-07-04
Inteligencia Artificial
El nuevo modelo de DeepSeek pone la eficiencia en el frente de la carrera armamentista de la IA
DeepSeek ha lanzado un nuevo LLM que agudiza su competencia con los principales laboratorios de IA al apostar por la eficiencia sobre la fuerza bruta. El modelo busca ofrecer un rendimiento sólido con un uso optimizado de recursos, reflejando un giro más amplio de la industria hacia una IA rentable.
2026-06-30
Investigación en IA de código abierto
Contexto de un millón de tokens con una décima parte de la caché KV: la apuesta de eficiencia de DeepSeek-V4
La vista previa de DeepSeek-V4 combina un modelo Pro de 1,6 billones de parámetros con una variante Flash de 284 mil millones, ambos con un millón de tokens de contexto. El documento afirma que el modelo requiere el 27% de los FLOPs de inferencia y el 10% de la caché KV de V3.2, las cifras que hacen rentable servir el contexto.
2026-06-22