Gemini
La IA de Google. Se usa en la web, y también tiene una CLI gratuita y de código abierto.
Qué es
Gemini es el asistente de IA de Google. Lo usas gratis en la web (gemini.google.com) para escribir, resumir, razonar y generar imágenes. Para quien programa, existe el Gemini CLI: un agente de código abierto que corre en tu terminal, con una capa gratuita generosa (login con tu cuenta de Google: 60 pedidos/min y 1.000/día).
Cómo acceder
Web: entra a gemini.google.com con tu cuenta de Google (gratis). CLI: instálala según tu sistema con los comandos de abajo. Para la API necesitás una clave gratis desde Google AI Studio (aistudio.google.com/apikey).
Comandos
Probar el Gemini CLI sin instalar (Node 18+)
npx @google/gemini-cli Instalar el Gemini CLI (cualquier SO, Node 18+)
npm install -g @google/gemini-cli Instalar en macOS con Homebrew
brew install gemini-cli Iniciar y autenticar (login con Google, gratis)
gemini Al iniciar, elige 'Login with Google' para la capa gratuita (60/min, 1.000/día).
Usar con una API key (opcional)
$env:GEMINI_API_KEY="TU_API_KEY"; gemini export GEMINI_API_KEY="TU_API_KEY"
gemini La key se obtiene gratis en aistudio.google.com/apikey. En Windows el comando es para PowerShell.
Gemini es la marca con la que Google agrupa toda su IA generativa. Resuelve dos necesidades muy distintas bajo el mismo nombre. Para cualquier persona, es un asistente gratis en la web para escribir, resumir, razonar y generar imágenes, integrado a fondo con Google Docs, Gmail y el resto del ecosistema. Para quien programa, es un agente de terminal de código abierto con una capa gratuita generosa que compite directamente con Claude Code.
La gran ventaja de Gemini para el usuario medio es que ya tienes cuenta: cualquiera con Gmail accede sin configurar nada. Si trabajas dentro del ecosistema Google (Docs, Sheets, Slides, Drive), la integración nativa hace que muchas tareas se hagan sin salir del documento donde ya estás. Para quien no vive en Google, sigue siendo competitivo, pero pierde parte de su atractivo.
Frente a ChatGPT, Gemini destaca cuando lo necesario es buscar información actualizada (tiene acceso a la web por defecto) o cuando ya trabajas con productos de Google. Frente a Claude, gana en accesibilidad e integraciones, pero pierde algo de matiz en escritura larga. Frente a la CLI de Claude Code, su Gemini CLI rivaliza en capacidad y suele tener una capa gratuita más generosa.
Qué hace bien
La integración con Google Workspace es probablemente la diferencia más clara frente a la competencia. Puedes invocar Gemini directamente dentro de un documento, una hoja de cálculo o un correo, sin copiar-pegar entre ventanas. Para resumir un hilo de Gmail, redactar un borrador o generar tablas en Sheets, no hace falta abrir otra pestaña.
El acceso a la web está activado por defecto, así que cuando le preguntas por algo actual te devuelve información reciente. Conviene seguir verificando datos sensibles, pero es notablemente más útil que un asistente que solo sabe lo que aprendió hasta su corte de entrenamiento.
La generación de imágenes está integrada gratis en el chat (es la familia Nano Banana, con su propia ficha en la biblioteca). Le pides la imagen en la misma conversación donde estás escribiendo y la usas para texto, edición de fotos o piezas con texto en varios idiomas.
El Gemini CLI es la pieza más interesante para programadores. Es un agente de código abierto que corre en tu terminal, lee tu carpeta de trabajo, propone cambios y ejecuta comandos con tu permiso. Su capa gratuita con login de Google es bastante generosa (60 peticiones por minuto y mil al día, según la web oficial), suficiente para uso real sin tarjeta de crédito.
Para uso programático en aplicaciones propias, Google AI Studio te da una API key gratuita y un banco de pruebas donde ajustar prompts y parámetros antes de llevar la integración a producción.
Cuándo elegirla (y cuándo no)
- Mejor que ChatGPT cuando vives en el ecosistema Google y quieres integraciones nativas en Docs, Gmail o Drive.
- Mejor que Claude para tareas donde necesitas información actual sin pasos extra.
- Mejor que Claude Code en términos de capa gratuita generosa de su CLI para muchos perfiles.
- Peor que Claude para textos muy largos con matices o análisis cuidadosos.
- Peor que Perplexity cuando lo importante es respuestas con muchas fuentes citadas de forma ordenada.
- Peor que ChatGPT si lo que valoras es la cantidad y variedad de plugins, GPTs personalizados o herramientas de la comunidad.
- Igualado por la competencia en tareas cotidianas; su valor diferencial aparece con el ecosistema Google y la CLI.
Cómo empezar en 5 minutos
Los pasos de acceso a la web, la CLI y la API están arriba en la ficha. Una vez dentro:
- Para usos cotidianos arranca en gemini.google.com con tu cuenta de Google. Sin instalaciones, ya puedes escribir, pegar texto y pedir imágenes.
- Aprovecha la integración con Workspace si ya usas Google Docs o Gmail. Activa Gemini desde dentro del documento y úsalo para resumir, redactar o reformular en el mismo lugar donde trabajas.
- Si programas, prueba primero el CLI sin instalar nada con npx, y solo cuando te convenza, instálalo de forma global con npm. Ejecútalo siempre dentro de la carpeta del proyecto que quieres que entienda.
- En el CLI elige “Login with Google” la primera vez para activar la capa gratuita. Sirve para tareas reales sin configurar API keys.
- Si vas a integrar Gemini en una app propia, consigue una API key gratis en Google AI Studio, guárdala como variable de entorno y haz una prueba mínima antes de planificar arquitectura.
Casos de uso reales
Una persona que vive en Gmail y Google Docs: usa Gemini directamente dentro del documento para reformular un párrafo, resumir un hilo largo de correo o generar una tabla a partir de notas. No sale del flujo donde ya estaba trabajando.
Un docente preparando material: pide a Gemini un guion para una clase, lo refina con preguntas de seguimiento, y luego le pide que genere una imagen ilustrativa para los apuntes. Todo en la misma conversación, sin abrir otra herramienta.
Un programador con un proyecto en su máquina: abre el Gemini CLI en la carpeta del proyecto y le pide cosas como “explica qué hace este repositorio”, “añade pruebas a esta función” o “ayúdame a depurar este error”. El CLI lee los archivos, propone cambios y los aplica solo con su permiso.
Una startup integrando IA en su app: prototipa la funcionalidad en Google AI Studio para afinar el prompt y los parámetros. Cuando funciona consistentemente, lleva la misma configuración a su código en producción usando la API.
Errores comunes y cómo evitarlos
- Confundir Gemini en la web (chat) con Gemini API (para aplicaciones). Son accesos distintos con configuraciones diferentes; no compartas claves ni esperes el mismo comportamiento.
- Confiar ciegamente en la información actualizada que devuelve. Acceder a la web no equivale a verificar fuentes; cruza datos sensibles.
- Usar el CLI fuera de la carpeta del proyecto. Si lo abres en tu directorio personal, no entiende el contexto y las respuestas son genéricas.
- Olvidar los límites de la capa gratuita del CLI. Para volúmenes altos, revisa la web oficial los planes y consumo actuales.
- Mezclar varios temas dispares en el mismo chat. Cuando cambies de tarea, abre un chat nuevo para que el contexto previo no contamine la respuesta.
- Pasar por alto la generación de imágenes integrada (Nano Banana). Muchas veces lo que buscas ya está dentro del mismo chat sin necesidad de ir a otra herramienta.
Combinaciones que rinden
Si trabajas en Google Workspace, combina Gemini en el chat principal para tareas largas (resumir un informe, redactar un primer borrador) y dentro de Docs o Gmail para ediciones puntuales. Reduces el número de pestañas abiertas y aprovechas el contexto que ya estaba en la pieza.
Para programadores, un patrón útil es usar el Gemini CLI para tareas con capa gratuita generosa y reservar otro asistente (Claude, ChatGPT) para casos en los que ya hayas agotado los límites del día o necesites un perfil distinto. Tener dos CLIs configuradas y alternar según consumo es lo que en la práctica hace mucha gente.
Mini-ejercicio
Abre el Gemini CLI en una carpeta tuya con código (puede ser un proyecto pequeño o un script personal) y pídele que te explique qué hace el archivo principal. Luego pídele que añada un comentario al inicio describiendo el funcionamiento. Sabrás que está bien si el comentario describe el archivo con precisión y, al revisarlo tú, no encuentras afirmaciones inventadas.
Funciones
- Conversar, escribir y resumir
- Generar y editar imágenes
- Agente de programación en la terminal (Gemini CLI)
- Acceso por API para tus propias apps
Casos de uso
- Redactar o resumir sin instalar nada (web)
- Automatizar tareas de código desde la terminal (CLI)
- Integrar Gemini en una app propia (API)
Plan de pago: Planes pagos (Google AI Pro/Ultra) con modelos más potentes y más límites; la web y la capa gratis de la CLI no cuestan.
Enlaces
Actualizado: 27 de mayo de 2026