Unlock exclusive introductory pricing for the newly launched Gemini 3.5 Flash.

Google lanza el nuevo modelo Gemini 2.5 Flash-Lite

CometAPI
annaJun 27, 2025
Google lanza el nuevo modelo Gemini 2.5 Flash-Lite

Google DeepMind anunciรณ hoy importantes expansiones de su familia Gemini 2.5, presentando las versiones estables de Gemini 2.5 Pro y Gemini 2.5 Flash, junto con una vista previa del nuevo modelo Gemini 2.5 Flash-Lite. Estas actualizaciones reflejan el compromiso continuo de Google de ofrecer una gama de modelos de IA que equilibran costo, velocidad y rendimiento para diversas cargas de trabajo.

Versiones estables: Gemini 2.5 Pro y Flash

El 17 de junio de 2025, Google anunciรณ la disponibilidad general de Gemini 2.5 Pro y Gemini 2.5 Flash. La versiรณn Pro ofrece la mรกxima capacidad de razonamiento y estรก diseรฑada para tareas de alta complejidad, como la generaciรณn avanzada de cรณdigo, el anรกlisis cientรญfico y la sรญntesis de datos a gran escala. Por otro lado, Gemini 2.5 Flash ofrece una opciรณn de gama media optimizada para usos cotidianos que requieren baja latencia, ideal para chatbots, resรบmenes y creaciรณn de contenido a gran escala.

Descripciรณn general: Tres modelos de la familia Gemini -2.5

ModeloEstadoVentajasCasos de uso ideales
Gemini 2.5 Flashโ€‘Lite (avance)Vista previaEl mรกs rรกpido y econรณmico; multimodal; razonamiento controlable; habilitado por herramientasTareas de gran volumen como chatbots, resรบmenes y bรบsquedas.
Gรฉminis 2.5 FlashEstableEquilibrado: baja latencia, buen razonamiento, multimodalConversaciones en tiempo real, atenciรณn al cliente
Gรฉminis 2.5 ProEstableMรกs capaces: razonamiento profundo, amplio contexto, multimodalInvestigaciรณn, codificaciรณn compleja, tareas cientรญficas

Google lanza el nuevo modelo Gemini 2.5 Flash-Lite

Gemini 2.5 Flashโ€‘Lite: Aspectos destacados de la vista previa

Latencia ultrabaja y ahorro de costesDiseรฑado para aplicaciones de alto volumen en tiempo real, como traducciรณn, clasificaciรณn y resumen. Ofrece una inferencia mรกs rรกpida y un menor coste por llamada en comparaciรณn con Flashโ€‘Lite 2.0 y la versiรณn completa de Flash.

Rendimiento fundamental mejorado:Supera los modelos Flash-Lite anteriores en puntos de referencia de generaciรณn de cรณdigo, lรณgica, matemรกticas, razonamiento multimodal y ciencia.

Costo y eficienciaPrecios de Flashโ€‘Lite (vista previa): ~$0.10 por 1 millรณn de tokens de entrada y ~$0.40 por 1 millรณn de tokens de salida, significativamente mรกs barato que Flash ($0.30/$2.50) y Pro ($1.25/$10).

Capacidades completas de Gemini -2.5:

  • Pensamiento controlable:Los usuarios pueden establecer โ€œpresupuestos de pensamientoโ€ (lรญmites de tokens) para intercambiar velocidad por profundidad. Flash-Lite puede activar esta opciรณn segรบn sea necesario.
  • Entrada multimodal:Admite texto, imรกgenes, audio y vรญdeo (incluidos clips de una hora de duraciรณn), con capacidades para analizar grรกficos, interfaz de usuario, escenas y resรบmenes de eventos.
  • Integraciรณn de herramientas:Incluye Bรบsqueda de Google, ejecuciรณn de cรณdigo y una ventana de contexto de un millรณn de tokens, que coincide con las capacidades de Flash y Pro.

Posicionamiento en la curva precio-rendimiento

Google posiciona la alta velocidad y el bajo costo de Flashโ€‘Lite en el Frontera de Pareto, lo que significa que se encuentra entre los modelos mรกs rentables y a la vez mรกs capaces del mundo (). En evaluaciones comparativas, Flashโ€‘Lite representa el mejor valor:Inteligente y asequible.


Acerca de Flash y Pro

  • Gรฉminis 2.5 FlashModelo de pensamiento multimodal, estable y de baja latencia. Se sitรบa por debajo de Pro, pero prรกcticamente a la par con GPT-4o en capacidad, con velocidad y rentabilidad superiores ().
  • Gรฉminis 2.5 ProEl modelo mรกs avanzado de Google. Reconocido por gestionar horas de vรญdeo y audio, cรณdigo y cรกlculos complejos, y razonamiento contextual. Tambiรฉn introduce presupuestos de pensamiento selectivos y una calidad de cรณdigo mejorada para funcionar como una IA insignia estable a largo plazo.

Implementaciรณn y precios

  • Disponibilidad:Los tres modelos son accesibles a travรฉs de Estudio de IA de Google, Google Cloud Vรฉrtice AI, y Aplicaciรณn Gรฉminis .
  • Estructura de costo (Precios de Vertex AI a partir del 16 de junio de 2025):
  • Pro:$1.25/1M de entrada, $10/1M de salida (superior a 200ย XNUMX tokens)
  • Flash: $0.15/1 millรณn de entradas, $3.50/1 millรณn de salidas en modo de โ€œpensamientoโ€ e incluye 1,500 indicaciones fundamentadas gratuitas por dรญa ()
  • Flashโ€‘Lite (vista previa): ~$0.10/$0.40 por 1 millรณn de tokens

Primeros Pasos

CometAPI proporciona una interfaz REST unificada que integra cientos de modelos de IA en un รบnico punto de conexiรณn, con gestiรณn de claves API integrada, cuotas de uso y paneles de facturaciรณn. En lugar de tener que gestionar mรบltiples URL y credenciales de proveedores.

Los desarrolladores pueden accederย API de Gemini 2.5 Flash-Lite (versiรณn preliminar) atravesarย CometAPILos รบltimos modelos listados corresponden a la fecha de publicaciรณn del artรญculo. Para comenzar, explore las capacidades del modelo en elย Playgroundย y consultar elย Guรญa de APIย Para obtener instrucciones detalladas, consulte la secciรณn "Antes de acceder, asegรบrese de haber iniciado sesiรณn en CometAPI y de haber obtenido la clave API".ย CometAPIย Ofrecemos un precio muy inferior al oficial para ayudarte a integrarte.

ยฟListo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Crรฉditos de prueba gratuitos incluidos. No se requiere tarjeta de crรฉdito.

Leer Mรกs