---
title: "DeepSeek-V4-Pro llega a disponibilidad general con mejoras para agentes y nuevos precios de API"
description: "DeepSeek liberó V4-Pro en disponibilidad general con avances en agentes, esfuerzo de razonamiento configurable y soporte nativo de la API Responses de OpenAI. Junto al lanzamiento estrena tarifas por horario: la hora valle cuesta 50% menos que la hora peak."
slug: "deepseek-v4-pro-agentes-precios-hora-valle-50-por-ciento-26-08-13"
canonical: "https://www.revenuehublatam.com/noticias/ia-ventas/deepseek-v4-pro-agentes-precios-hora-valle-50-por-ciento-26-08-13"
language: "es"
section: "Noticias"
category: "IA en Ventas"
published: "2026-08-14T01:15:00+00:00"
updated: "2026-08-14T01:15:00+00:00"
tags: ["DeepSeek", "agentes de IA", "precios de API", "modelos de lenguaje", "costos de IA"]
keywords: ["DeepSeek V4-Pro", "precios API DeepSeek", "agentes de IA", "hora valle IA", "esfuerzo de razonamiento", "IA para ventas Chile", "costos de IA Latinoamerica"]
source_name: "DeepSeek"
source_url: "https://api-docs.deepseek.com/news/news260813/"
publisher: "Revenue Hub Latam"
publisher_url: "https://www.revenuehublatam.com"
---

# DeepSeek-V4-Pro llega a disponibilidad general con mejoras para agentes y nuevos precios de API

> DeepSeek lanzó el 13 de agosto de 2026 la disponibilidad general de DeepSeek-V4-Pro, su modelo enfocado en agentes. Incorpora esfuerzo de razonamiento configurable en tres niveles (bajo, alto y máximo) para V4-Pro y V4-Flash, y soporte nativo de la API Responses de OpenAI optimizada para Codex. Con el lanzamiento, DeepSeek cambia su estructura de precios de API e introduce tarifas peak y valle: la hora valle cuesta 50% menos. Los nuevos precios rigen desde las 16:00 UTC del 16 de agosto de 2026, es decir el mediodía en Chile.

DeepSeek anunció el 13 de agosto de 2026 que **DeepSeek-V4-Pro entra en disponibilidad general**. El foco declarado del lanzamiento son los agentes: la compañía afirma que el modelo trae mejoras importantes en tareas agénticas con ganancias medidas en producción, no solo en benchmarks de laboratorio.

El anuncio viene acompañado de un cambio de precios que, para cualquier equipo que corra volumen en Latinoamérica, puede pesar más que el salto de capacidades: DeepSeek deja atrás la tarifa plana y pasa a un esquema con **hora peak y hora valle**.

## ¿Qué cambia con DeepSeek-V4-Pro?

Según la nota oficial de DeepSeek, la versión general incluye tres novedades concretas:

-   **Mejoras de agentes** con ganancias en producción, el escenario donde los modelos suelen degradarse frente a la demo.
-   **Esfuerzo de razonamiento flexible** en tres niveles, disponible tanto para V4-Pro como para V4-Flash.
-   **Soporte nativo de la API Responses de OpenAI**, optimizado para Codex con configuración en un clic.

V4-Pro ya está disponible en la aplicación y en la web bajo el modo «Expert Mode», y también por API. Los nombres de modelo no cambian, así que la migración no obliga a reescribir integraciones existentes.

## ¿Cómo funciona el esfuerzo de razonamiento configurable?

Es el punto más relevante para quien opera agentes con presupuesto acotado. DeepSeek define tres niveles y les asigna un uso recomendado: **bajo** para tareas simples, **alto** para flujos de trabajo agénticos del día a día y **máximo** para tareas complejas.

La lógica de negocio detrás es directa. Hasta ahora, un equipo que quería precisión en el 5% de casos difíciles terminaba pagando ese nivel de razonamiento en el 100% de las llamadas. Poder graduar el esfuerzo por tarea convierte una decisión binaria en una palanca de costo unitario.

## ¿Cuándo entran en vigencia los nuevos precios de la API?

DeepSeek confirmó que la nueva estructura de precios rige desde las **16:00 UTC del 16 de agosto de 2026**, equivalente al mediodía en Chile continental. El cambio central es la introducción de tarifas diferenciadas por horario: la **hora valle cuesta 50% menos que la hora peak**.

La compañía plantea el esquema como un incentivo a programar cargas de trabajo con criterio, no a consumir en cualquier momento. Es el mismo principio que la industria eléctrica aplica hace décadas, ahora trasladado a la inferencia.

## ¿Por qué importa esto para las empresas en Chile y Latinoamérica?

Por el huso horario. La hora peak de un proveedor con centro de gravedad en Asia no coincide con la jornada laboral chilena ni con la del resto de Latinoamérica. Buena parte del trabajo asíncrono que un equipo comercial corre de noche o de madrugada (enriquecimiento de datos de CRM, resúmenes de llamadas, scoring de leads, limpieza de bases) puede caer naturalmente en ventana valle.

Eso significa que el descuento de 50% no exige rediseñar la operación: exige saber qué procesos son sensibles a la latencia y cuáles no. La mayoría de las empresas B2B de la región nunca ha hecho esa distinción porque nunca tuvo un incentivo económico para hacerla.

## Análisis de Revenue Hub

El titular es el modelo, pero la noticia de negocio es el precio. Durante dos años el costo de inferencia se comportó como una variable que solo bajaba, y eso permitió a los equipos comerciales no pensar en ella. La aparición de tarifas por horario marca el fin de esa comodidad: el costo de la IA deja de ser un número fijo en un contrato y pasa a ser algo que se gestiona, como el gasto en cloud.

Para un líder comercial en Chile o Latinoamérica esto abre una pregunta que conviene responder antes de que la responda la factura: ¿cuáles de nuestros procesos con IA necesitan respuesta en segundos y cuáles solo necesitan estar listos mañana a las 9? Un agente que conversa con un prospecto en el sitio web es lo primero. Un proceso que normaliza 40.000 contactos del CRM es lo segundo, y hoy se puede correr a mitad de precio. Separar ambas categorías es un ejercicio de una hora que puede cambiar la estructura de costos de todo el stack.

La advertencia obvia: elegir proveedor por precio de lista es un error caro. Un modelo más barato que exige el doble de intentos para completar una tarea agéntica termina costando más, y el riesgo de gobernanza de datos con proveedores de distintas jurisdicciones sigue siendo un tema abierto para empresas reguladas. La recomendación es medir costo por tarea completada, no costo por millón de tokens, y probar en un flujo acotado antes de mover volumen. Puedes seguir el resto de la cobertura en nuestra sección de [IA en ventas](/noticias/ia-ventas) y contrastarla con lo que publicamos en el [blog de Revenue Hub](/blog).

## Preguntas frecuentes

### ¿Qué es DeepSeek-V4-Pro?

Es el modelo de DeepSeek orientado a agentes que pasó a disponibilidad general el 13 de agosto de 2026. Incluye mejoras en tareas agénticas, esfuerzo de razonamiento configurable en tres niveles y soporte nativo de la API Responses de OpenAI optimizada para Codex.

### ¿Cuánto cuesta la API de DeepSeek tras el cambio de precios?

DeepSeek no publicó una tarifa plana única: introdujo precios diferenciados por horario. La tarifa de hora valle es 50% más baja que la de hora peak. Los valores exactos por modelo están en la tabla de precios oficial de DeepSeek, vigente desde el 16 de agosto de 2026.

### ¿Cuándo empiezan a regir los nuevos precios?

Desde las 16:00 UTC del 16 de agosto de 2026, equivalente al mediodía en Chile continental.

### ¿Qué significa el esfuerzo de razonamiento flexible?

Permite elegir cuánto razona el modelo antes de responder. DeepSeek define tres niveles: bajo para tareas simples, alto para flujos agénticos cotidianos y máximo para tareas complejas. Está disponible en V4-Pro y en V4-Flash.

### ¿DeepSeek V4-Pro es mejor que GPT-5.6 o Gemini 3.7 Flash?

DeepSeek publicó su propia tabla de benchmarks junto al lanzamiento, pero no existe todavía una comparación independiente entre V4-Pro y los modelos recién liberados por OpenAI y Google. La recomendación práctica es medir en tu propio caso de uso: costo por tarea completada y tasa de éxito, no puntaje de benchmark.

### ¿Hay que cambiar el código para usar V4-Pro?

No. DeepSeek indicó que los nombres de modelo se mantienen sin cambios, por lo que las integraciones existentes siguen funcionando. Los detalles de configuración están en su documentación de API.

### ¿Cómo pueden aprovechar esto las empresas B2B en Chile y Latinoamérica?

Separando los procesos sensibles a la latencia (agentes que conversan con prospectos en tiempo real) de los procesos por lotes que pueden esperar (enriquecimiento de CRM, scoring, resúmenes masivos). Los segundos pueden programarse en ventana valle y costar la mitad.

### ¿Dónde se puede probar DeepSeek-V4-Pro?

Está disponible en la aplicación y la web de DeepSeek bajo el modo Expert Mode, y también mediante API para uso programático.

---

Fuente original: [DeepSeek](https://api-docs.deepseek.com/news/news260813/) (api-docs.deepseek.com)
