Laboratorio
Entidad que desarrolla o publica el modelo y mantiene su documentación técnica y de seguridad.
Consulta los modelos documentados, las evaluaciones publicadas y las fuentes primarias asociadas a esta organización.
Modelo Flash para ingeniería de software de larga duración, agentes autónomos y flujos empresariales complejos.
16 SEP. 2026↗ RAZONAMIENTO MULTIMODALRazonamiento multimodal, código y problemas complejos.
16 SEP. 2026↗ FLASH ANTERIOR · AGENTESGeneración Flash anterior para código complejo, agentes y ejecución multietapa; útil como punto de comparación con Gemini 3.8.
18 SEP. 2026↗ IMAGEN NATIVA EFICIENTEModelo de imagen de producción que combina generación, edición y razonamiento visual con equilibrio entre calidad, coste y latencia.
18 SEP. 2026↗ VÍDEO CINEMATOGRÁFICO CON AUDIOModelo de vídeo cinematográfico con audio nativo, extensión de escenas y control mediante fotogramas e imágenes de referencia.
18 SEP. 2026↗ GENERACIÓN MUSICALModelo de música para canciones completas con voz, letra y control de estructura, estilo, duración e instrumentación.
18 SEP. 2026↗ EMBEDDING MULTIMODAL UNIFICADOModelo de embeddings que sitúa texto, imágenes, vídeo, audio y PDF en un espacio vectorial común para búsqueda y RAG multimodal.
18 SEP. 2026↗ RAZONAMIENTO ESPACIAL INCORPORADOModelo especializado en comprensión física, vídeo, razonamiento espacial y orquestación de herramientas para sistemas robóticos.
18 SEP. 2026↗ CONVERSACIÓN MULTIMODAL EN TIEMPO REALModelo de conversación en directo que integra voz, vídeo y herramientas con baja latencia.
29 SEP. 2026↗ VOZ EN DIRECTO CON RAZONAMIENTO PROLONGADOVariante de voz en directo con razonamiento en segundo plano para tareas complejas de varios pasos.
29 SEP. 2026↗Las cifras se muestran con el contexto comunicado por su fuente. Un resultado del proveedor no equivale a una comparación independiente ni sustituye una evaluación propia.
| Modelo | Benchmark | Resultado | Métrica |
|---|---|---|---|
| Gemini 3.8 Flash | Artificial Analysis Intelligence v4.1 | 50,2 | Índice |
| Gemini 3.8 Flash | GDPval-AA v2 | 1.348,8 | Elo |
| Gemini 3.1 Pro | SWE-Bench Pro | 54,2 % | Resuelto |
| Gemini 3.1 Pro | Terminal-Bench 2.1 | 70,7 % | Exactitud |
| Gemini 3.7 Flash | Evaluaciones Gemini 3.7 Flash | Publicadas | Código y agentes |
| Nano Banana 2 | Evaluación visual Nano Banana 2 | Modelo recomendado | Calidad, coste y latencia |
| Veo 3.1 | MovieGenBench | Liderazgo publicado | Preferencia global texto a vídeo |
| Lyria 3.5 | Evaluación de Lyria 3.5 | Publicada | Musicalidad, voz y coherencia estructural |
| Gemini Embedding 2 | Evaluaciones Gemini Embedding 2 | Publicadas | Recuperación multimodal |
| Gemini Robotics ER 2 | Evaluaciones Robotics ER 2 | Publicadas | Razonamiento espacial y robótico |
Una organización, un producto y un modelo no son la misma unidad. Inferama los separa para evitar atribuir capacidades o condiciones comerciales al elemento equivocado.
Entidad que desarrolla o publica el modelo y mantiene su documentación técnica y de seguridad.
Versión identificable con límites, modalidades y comportamiento que pueden cambiar entre lanzamientos.
API, aplicación, nube asociada o plan comercial; cada canal puede tener precios, retención y límites distintos.
Cada afirmación debe conservar la página oficial consultada y la fecha de verificación.
Gemini Robotics ER 2 se presenta como un modelo de visión y lenguaje capaz de planificar tareas de varios pasos para robótica. Eso no demuestra que controle directamente un robot ni que sus planes sean seguros o fiables en cualquier entorno. Analizamos qué respalda la documentación disponible y qué debe probar cada equipo.
30 sep. 2026 ↗ ANALISISLa documentación de Google describe un modelo que representa texto y otros tipos de contenido en un espacio de embeddings común. Eso acredita una capacidad declarada, no que mejore la recuperación en un corpus concreto. Revisamos qué permiten concluir las fuentes disponibles sobre rendimiento, acceso, precio y datos, y qué conviene comprobar antes de una prueba.
30 sep. 2026 ↗ ANALISISGoogle presenta Gemini 3.8 Flash como un modelo orientado a ingeniería de software de horizonte largo y agentes autónomos. Esa orientación declarada no demuestra por sí sola que resuelva tareas prolongadas con fiabilidad. Esta revisión distingue las afirmaciones del proveedor, las condiciones de acceso y precio documentadas para Agent Platform y la evidencia que no aparece en las fuentes consultadas.
30 sep. 2026 ↗ ANALISISGoogle describe Gemini 3.1 Pro como un modelo para tareas complejas, pero esa descripción no demuestra que una integración concreta complete un flujo de varios pasos de forma fiable. Proponemos un protocolo de evaluación reversible y explicamos qué puede afirmarse —y qué no— sobre acceso, precio, seguridad y rendimiento con las fuentes disponibles.
29 sep. 2026 ↗ ANALISISLa documentación de Google presenta Gemini 3.7 Flash como un modelo para tareas con varios pasos, refactorización y razonamiento. Esto es lo que las fuentes disponibles permiten verificar —y lo que todavía no— sobre acceso, precio, seguridad y rendimiento.
29 sep. 2026 ↗ COMPARATIVANo hay aquí resultados de una ejecución comparativa que permitan declarar un ganador. Sí hay un protocolo reproducible para medir calidad del parche, regresiones, coste y tiempo bajo condiciones comunes, y para decidir qué evidencia necesitaría un equipo antes de elegir.
28 sep. 2026 ↗