Saltar al contenido
APIIntermedio

Documentación de la API de Google Gemini

Documentación oficial de la API Gemini de Google, que abarca comprensión de texto, imagen, audio y vídeo en una interfaz multimodal unificada. Incluye guías sobre autenticación, function calling, caché de contexto y ejecución de código, con una generosa capa gratuita para experimentación; orientada a desarrolladores que construyen aplicaciones que necesitan procesar múltiples tipos de contenido en una sola petición.

Descripción general

"Documentación de la API de Google Gemini" es un recurso de tipo "API" seleccionado por AI Resource Hub, clasificado en la categoría APIs de IA y adecuado para estudiantes de nivel Intermedio. Lo proporciona Google, se actualizó por última vez el 2026-06-24 y tiene una puntuación editorial de 4.5/5 de nuestro equipo. Haz clic en "Visitar recurso" a la derecha para abrir la página original.

Etiquetas

GoogleGéminisAPIMultimodal

Características clave

  • Multimodal de nacimiento: texto, imagen, audio y vídeo
  • Ventanas de contexto larguísimas
  • Niveles Flash y Pro para equilibrar velocidad y coste

Ventajas

  • +Comprensión multimodal potente
  • +Nivel gratuito generoso para prototipar
  • +Un nivel gratuito generoso abarata el prototipado

Desventajas

  • El comportamiento puede variar entre niveles de modelo
  • Los nombres y niveles de modelo cambian a menudo
  • Algunas funciones están limitadas por región

Preguntas frecuentes