Gemini es el asistente de IA de Google. Reúne en una sola interfaz la generación de texto, imagen, vídeo y audio, y acepta como entrada texto, voz, imágenes, archivos y vídeo.
Sus funciones con nombre propio son Deep Research, que elabora informes extensos encadenando búsquedas y citando las fuentes; Canvas, un espacio de edición donde el documento se retoca por partes en lugar de regenerarse entero; los Gems, asistentes que el usuario configura una vez con instrucciones fijas y reutiliza después; Gemini Live, conversación por voz en tiempo real con cámara y pantalla compartida; los modelos de imagen Nano Banana y de vídeo Veo; y las acciones programadas, tareas que se ejecutan solas de forma recurrente.
Está integrado con Gmail, Drive, Docs, Calendar, YouTube, Maps y el buscador, y también dentro de Chrome. Tiene API a través de Google AI Studio y Vertex AI.
La versión gratuita, con una cuenta de Google, incluye generación de imágenes, Deep Research, Canvas, Gems y Gemini Live, con una ventana de contexto de 32.000 tokens, subidas de vídeo de hasta cinco minutos y de audio de hasta diez, y límites que se renuevan cada cinco horas. La generación de vídeo y los modelos de imagen superiores son de pago.