Ir directamente al contenido

Gemini 3: mucho más que “otro chatbot”

20 nov., 2025 80
Gemini 3: mucho más que “otro chatbot”

Google ha presentado Gemini 3, su nueva generación de modelos de inteligencia artificial, con un salto importante en tres frentes:

- razonamiento profundo,

- multimodalidad completa (texto, imagen, vídeo, audio y código)

- capacidad agéntica, es decir, la posibilidad de actuar sobre tus aplicaciones y datos, no solo responder.

Según la información oficial de Google DeepMind, Gemini 3 Pro se posiciona como el modelo más avanzado de la compañía, con mejoras claras en razonamiento científico, matemático y comprensión multimodal frente a Gemini 2.5, y con resultados de primer nivel en benchmarks como GPQA Diamond, AIME 2025 o MMMU-Pro.

Medios como Cinco Días destacan además dos puntos clave:

- el salto en comprensión multimodal,

- y un contexto de hasta un millón de tokens, suficiente para analizar libros completos, expedientes extensos o grandes bases documentales en una sola interacción

Para un despacho profesional en España, esto ya no es solo “IA para chatear”: es una infraestructura de razonamiento que puede trabajar directamente sobre documentos, pantallas, vídeos formativos, correos y agenda.

Un modelo más potente, más visual y con contexto “casi infinito”

Razonamiento avanzado: Google posiciona Gemini 3 como un modelo pensado explícitamente para resolver problemas complejos: matemáticas de competición, razonamiento científico, programación y tareas que requieren varios pasos de lógica encadenada

En términos prácticos para un despacho, esto significa:

- Mejor capacidad para analizar normativa compleja, informes extensos o contratos largos.

- Mayor precisión al combinar datos financieros, laborales y fiscales en un mismo caso.

- Más consistencia al generar explicaciones paso a paso (por ejemplo, simulaciones de escenarios para clientes).

Multimodalidad real: texto, imagen, vídeo, audio y código: Gemini 3 trabaja de forma nativa con:

- Texto: consultas jurídicas, correos, informes internos.

- Imágenes y capturas de pantalla: por ejemplo, una foto de un documento en papel o de un panel de un software de nóminas.

- Vídeo y audio: reuniones grabadas, formaciones internas, webinars.

- Código: scripts, integraciones con herramientas internas, automatizaciones.

Esto abre escenarios muy concretos en un despacho:

- Subir un vídeo de una sesión formativa interna y pedir un resumen, un test para el equipo y una guía rápida para nuevos empleados.

- Compartir una captura de pantalla del ERP laboral o fiscal y pedir a Gemini 3 que identifique errores de configuración o que explique qué significan determinados campos.

- Trabajar con plantillas de Excel o código para automatizar cálculos recurrentes.

Contexto largo: de los PDFs sueltos al “expediente vivo”

El contexto de hasta 1M tokens permite trabajar con:

- Expedientes completos de clientes.

- Históricos de comunicaciones (correos, actas de reuniones, informes).

- Bases de conocimiento internas o manuales de procedimiento.

De asistente conversacional a IA agéntica: cuando el modelo actúa por ti

Uno de los cambios de fondo que trae Gemini 3 es el giro hacia la IA agéntica: modelos que no solo generan texto, sino que planifican y ejecutan acciones en tu nombre.

Informaciones recientes apuntan a que Gemini 3 está diseñada para:

- Gestionar correos y calendario,

- Coordinar tareas entre aplicaciones (Gmail, Calendar, Drive, incluso servicios externos),

- Planificar viajes, reservas o reuniones de forma autónoma,

- Conectarse de forma más profunda a APIs de Google (Workspace, Maps, YouTube, etc.).

Este movimiento encaja con la estrategia de Google de sustituir progresivamente Google Assistant por Gemini en Android a lo largo de 2025, de modo que el “asistente del móvil” pase a ser un modelo de IA de propósito general con capacidades de agente.

Modos de Gemini 3: Pro, Deep Think y Agente

Google está desplegando Gemini 3 como una familia de modelos y modos, con distintas capas de capacidad y precio:

Gemini 3 Pro 

- Es la puerta de entrada principal: razonamiento multimodal de alto nivel, disponible como gemini-3-pro-preview en la API y en la app.

- Soporta más de 30 idiomas, incluyendo español, catalán, euskera y gallego, tanto en la experiencia de app como en búsqueda. [El Mundo]

Para despachos, es suficiente para:

- Automatizar redacción y revisión de textos.

- Hacer resúmenes fiables de documentos complejos.

- Generar argumentarios, guiones de formación o material comercial.

Gemini 3 Deep Think: el modo de razonamiento extremo

Deep Think es el modo de razonamiento avanzado que Google ya venía probando con Gemini 2.5 y que ahora se traslada al ecosistema Gemini 3 para suscriptores de Google AI Ultra. [La Razón]

En pruebas internas, Deep Think asociado a Gemini 3 alcanza alrededor de 93,8 % en GPQA Diamond, un benchmark de razonamiento científico de muy alta dificultad.

Es especialmente interesante para:

- Proyectos que requieran mucha precisión en el razonamiento y las cifras (p. ej. planificación fiscal compleja, simulaciones económicas, optimización de estructuras societarias).

- Departamentos de I+D, data teams o despachos que quieran analizar grandes conjuntos de datos y extraer conclusiones estructuradas.

Gemini 3 Agente: la capa que ejecuta tareas

Finalmente, Google está introduciendo capacidades agénticas de alto nivel asociadas a planes tipo Google AI Ultra, donde el modelo puede encadenar acciones: leer correos, proponer respuestas, crear eventos, coordinarse con otras herramientas, etc. [Xataka]

La frontera entre “chat” y “operación” se difumina:

- El usuario pide: “Organiza las reuniones con estos tres clientes, revisa la disponibilidad de los socios y prepara una propuesta de agenda para cada uno”.

- El sistema no solo redacta correos, sino que consulta agendas, propone huecos, crea eventos y deja preparados borradores de mensajes.

Gemini 3 más allá de Google: el impacto en Apple y Siri

Aunque Gemini 3 nace en el ecosistema Google, su impacto va a llegar también a usuarios de iPhone.

En las últimas semanas se ha confirmado que Apple ha alcanzado un acuerdo con Google para utilizar un modelo Gemini personalizado —en torno a 1,2 billones de parámetros— como base de la nueva Siri, con despliegue previsto a partir de 2026 y ejecución en servidores privados de Apple para mantener su narrativa de privacidad. [The New York Times]

Esto implica dos cosas importantes:

- La “batalla de asistentes” no será solo Siri vs. Gemini vs. ChatGPT, sino una combinación: Apple Intelligence apoyado por modelos externos como Gemini.

- Para un despacho, independientemente de si su equipo usa Android o iOS, la experiencia de IA avanzada se estandariza: el mismo tipo de razonamiento y capacidades visuales estarán disponible en ambos mundos.

Riesgos: dependencia, gobernanza y “burbuja de la IA”

El lanzamiento de Gemini 3 llega en un contexto de dudas sobre la viabilidad económica de la carrera de modelos gigantes. Inversores como Michael Burry han reducido exposición a valores de IA y megacaps tecnológicas, alertando sobre una posible burbuja y sobrevaloración de determinados activos. [Expansión]

Para un despacho, esto no significa “no usar IA”, sino:

- Evitar casarse con un solo proveedor sin estrategia de salida.

- Diseñar una arquitectura de datos propia (procedimientos, governance, seguridad) que no dependa exclusivamente del roadmap de un fabricante.

- Apostar por formación interna como la que ofrece el propio Club de Innovación para que la ventaja competitiva no sea la herramienta, sino el uso que hace el equipo de ella.