Ir al contenido principal

OpenAI anuncia GPT-4 Turbo con visión: lo que sabemos hasta ahora

Descubre la última novedad de OpenAI, GPT-4 Turbo con visión, y sus funciones clave, incluido un corte de conocimiento más reciente, una ventana de contexto ampliada, precios más ajustados y mucho más.
Actualizado 17 sept 2026  · 7 min leer

Explorar con IA

ChatGPTClaudePerplexity

En el reciente OpenAI DevDay, la organización hizo un anuncio muy esperado: la presentación de GPT-4 Turbo, una mejora de su revolucionario modelo de IA. Aquí repasamos en detalle qué es GPT-4 Turbo, sus funciones clave y cómo puede beneficiar a desarrolladores y usuarios.

En artículos aparte, puedes leer más sobre los GPTs y la tienda de ChatGPT, y la API de Assistants, que también se anunciaron en el Dev Day.

¿Qué es GPT-4 Turbo?

GPT-4 Turbo es una actualización del modelo de lenguaje grande GPT-4 existente. Aporta varias mejoras, entre ellas una ventana de contexto mucho mayor y acceso a conocimiento más actualizado. OpenAI ha ido mejorando gradualmente las capacidades de GPT-4 en ChatGPT con la incorporación de instrucciones personalizadas, plugins de ChatGPT, DALL-E 3 y Advanced Data Analytics. Esta última actualización trae un buen número de novedades interesantes.

¿Qué es GPT-4 Turbo con visión?

GPT-4 Turbo con visión es una variante de GPT-4 Turbo que incorpora capacidad de reconocimiento óptico de caracteres (OCR). Es decir, puedes proporcionarle una imagen y devolverá el texto contenido en ella. Por ejemplo, puedes subir la foto de un menú y te devolverá las opciones de comida que aparecen en la imagen. Del mismo modo, puedes proporcionar la foto de una factura y extraer automáticamente el nombre del proveedor y el detalle de los artículos.

Las funciones "con visión" estarán disponibles por defecto en ChatGPT y, para desarrolladores, seleccionando el modelo "gpt-4-vision" en la API de OpenAI.

Funciones clave de GPT-4 Turbo

GPT-4 Turbo incorpora varias mejoras respecto a modelos anteriores que potencian sus capacidades. Estas son algunas de las funciones que lo hacen destacar:

Corte de conocimiento más reciente

Sam Altman promete mantener ChatGPT actualizado

Sam Altman promete mantener ChatGPT actualizado

Las versiones existentes de GPT-3.5 y GPT-4 tenían un corte de conocimiento en septiembre de 2021. Esto significa que no podían responder sobre eventos reales posteriores a esa fecha, a menos que tuvieran acceso a fuentes de datos externas.

GPT-4 amplía ese corte de conocimiento diecinueve meses, hasta abril de 2023. Esto implica que GPT-4 Turbo dispone de información y eventos hasta esa fecha, lo que lo convierte en una fuente más informada y fiable. Además, el CEO de OpenAI, Sam Altman, prometió que "[OpenAI] intentará que [GPT] no vuelva a quedarse tan desactualizado".

Ventana de contexto de 128K

La ventana de contexto de un modelo de lenguaje grande (LLM) mide cuánto dura su memoria de la conversación. Si un modelo tiene una ventana de 4.000 tokens (unas 3.000 palabras), todo lo que quede más allá de esos 4.000 tokens se ignora y las respuestas pueden volverse menos precisas o incluso contradictorias con mensajes anteriores. Esto complica trabajar con documentos largos o que un chatbot mantenga conversaciones extendidas.

GPT-4 tiene una longitud máxima de contexto de 32k (32.000) tokens. GPT-4 Turbo la aumenta a 128k tokens (unas 240 páginas a 400 palabras por página). Supera el máximo de 100k de contexto de Claude 2 de Anthropic y lo pone a la altura del modelo YARN-MISTRAL-7b-128k de Nous Research.

Está por ver si la ventana de contexto más larga se traduce en un rendimiento satisfactorio en toda la ventana. Investigación reciente de la Universidad de Stanford mostró que los modelos de contexto largo existentes solo ofrecían respuestas precisas al recuperar información cerca del inicio o del final del documento.

También conviene señalar que 128k parece ser solo un paso hacia el sueño de un "contexto infinito". Investigación temprana de Microsoft y la Universidad Jiaotong de Xi'an pretende escalar los LLM a mil millones de tokens de contexto.

GPT se pone en oferta

OpenAI ha respondido al aumento de la competencia en el mercado de LLM y ha reducido el precio de GPT-4 Turbo para ajustarlo a los presupuestos de los desarrolladores. Al usar la API de OpenAI, el precio de los tokens de entrada de GPT-4 Turbo es ahora un tercio del anterior: de 3 centavos de dólar a 1 centavo por cada 1.000 tokens. Los tokens de salida cuestan ahora la mitad: de 6 a 3 centavos de dólar por cada 1.000 tokens.

La misma tendencia continúa con los modelos GPT-3.5 Turbo, que ofrecen tokens de entrada 3 veces más baratos a 0,1 centavos de dólar por 1.000 tokens y tokens de salida 2 veces más baratos a 0,2 centavos por 1.000 tokens.

Además, los tokens de entrada del modelo GPT-3.5 Turbo 4K ajustado fino son ahora 4 veces más asequibles, con una bajada de 1,2 a 0,3 centavos de dólar por 1.000 tokens, y los tokens de salida son 2,7 veces más baratos, de 1,6 a 0,6 centavos por 1.000 tokens. El precio de entrenamiento se mantiene en 0,8 centavos por 1.000 tokens.

Estos ajustes buscan que los modelos avanzados de IA resulten más rentables para los desarrolladores.

GPT se vuelve multimodal: imágenes como prompt y texto a voz

Se anunció que "GPT-4 Turbo con visión" llegará en breve. Pronto podrás dar indicaciones a GPT-4 Turbo usando imágenes como prompts, introduciéndolas directamente en el cuadro de chat. La herramienta podrá generar subtítulos o describir lo que aparece en la imagen. También gestionará solicitudes de texto a voz.

Actualizaciones de function calling

Function calling es una función para desarrolladores que integran IA generativa en sus aplicaciones. Les permite describir funciones de su app o de APIs externas a GPT-4 Turbo. Con la capacidad de llamar a varias funciones en un solo mensaje, esta característica agiliza la interacción con el modelo. Por ejemplo, los usuarios pueden enviar un único mensaje solicitando múltiples acciones, sin necesidad de varios intercambios ida y vuelta con el modelo.

Cómo acceder a GPT-4 Turbo

El acceso a GPT-4 Turbo está disponible para "todos los desarrolladores de pago"; es decir, si tienes acceso a la API, puedes pasar simplemente "gpt-4-1106-preview" como nombre de modelo en la API de OpenAI. Del mismo modo, para GPT-4 Turbo con visión, puedes pasar "gpt-4-vision-preview" como nombre de modelo.

Ten en cuenta que estos modelos en vista previa aún no se consideran aptos para producción. No obstante, como parte del anuncio, Altman también prometió que habrá una versión para producción en las próximas semanas.

Para quienes no son desarrolladores, es probable que GPT-4 Turbo esté disponible para usuarios de ChatGPT Plus y ChatGPT Enterprise en las próximas semanas.

Límites de uso

El acceso a los modelos GPT a través de la API de OpenAI está sujeto a límites de tasa. Es decir, solo puedes realizar un número limitado de solicitudes a la API por mes. OpenAI ha publicado ahora directrices más claras sobre cómo funcionan estos límites, para que tu aplicación no se quede cortada por sorpresa.

Además, los límites de tasa para GPT-4 se han duplicado.

Como GPT-4 Turbo está actualmente en fase de vista previa, los límites de uso para GPT-4 Turbo se establecen en 20 solicitudes por minuto y 100 por día. OpenAI ha indicado que por ahora no aumentará estos límites para este modelo, aunque probablemente lo hará cuando haya una versión pública.

Reflexión final

El anuncio de GPT-4 Turbo ofrece un avance emocionante del futuro de la IA generativa, y tenemos muchas ganas de ponerle las manos encima. Si estás empezando con todo lo relacionado con GPT, echa un vistazo a nuestro curso Introduction to ChatGPT. Si buscas profundizar más, nuestro tutorial sobre el uso de GPT-3.5 y GPT-4 a través de la API de OpenAI en Python tiene mucho que explorar.


Richie Cotton's photo
Author
Richie Cotton
LinkedIn

Richie ayuda a particulares y organizaciones a mejorar en el uso de los datos y la IA. Es científico de datos desde antes de que se llamara ciencia de datos, y ha escrito dos libros y creado muchos cursos DataCamp sobre el tema. Es presentador del podcast DataFramed, y dirige el programa de seminarios web de DataCamp.

Temas
Inteligencia Artificial

¡Empieza hoy tu viaje con OpenAI!

Curso

Trabajar con la API de OpenAI

3 h
172.6K
Desarrolla aplicaciones basadas en IA con la API OpenAI. Conoce la funcionalidad que sustenta aplicaciones populares de IA como ChatGPT.
Ver detallesRight Arrow
Iniciar Curso
Ver másRight Arrow
Relacionado

blog

¿Qué es GPT-4 y por qué es importante?

OpenAI ha anunciado el lanzamiento de su último gran modelo lingüístico, GPT-4. Este modelo es un gran modelo multimodal que puede aceptar tanto entradas de imagen como de texto y generar salidas de texto.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

Todo lo que sabemos sobre GPT-5

Descubre cómo GPT-5 evolucionará hasta convertirse en un sistema unificado con funciones avanzadas, cuyo lanzamiento está previsto para el verano de 2025, basándose en la última hoja de ruta de OpenAI y en la historia de GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

An avian AI exits its cage

blog

12 alternativas de código abierto a GPT-4

Alternativas de código abierto a GPT-4 que pueden ofrecer un rendimiento similar y requieren menos recursos informáticos para funcionar. Estos proyectos vienen con instrucciones, fuentes de código, pesos del modelo, conjuntos de datos e IU de chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

Tutorial

Visión GPT-4: Guía completa para principiantes

Este tutorial le presentará todo lo que necesita saber sobre GPT-4 Vision, desde cómo acceder a él hasta ejemplos prácticos del mundo real y sus limitaciones.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Tutorial

Cómo ajustar GPT 3.5: Liberar todo el potencial de la IA

Explore GPT-3.5 Turbo y descubra el potencial transformador del ajuste fino. Aprenda a personalizar este modelo de lenguaje avanzado para aplicaciones especializadas, mejore su rendimiento y comprenda los costes asociados, la seguridad y las consideraciones de privacidad.
Moez Ali's photo

Moez Ali

11 min

Tutorial

Ajuste fino de GPT-3 mediante la API OpenAI y Python

Libere todo el potencial de GPT-3 mediante el ajuste fino. Aprenda a utilizar la API de OpenAI y Python para mejorar este modelo de red neuronal avanzado para su caso de uso específico.
Zoumana Keita 's photo

Zoumana Keita

12 min

Ver MásVer Más