Google Gemini: La Vanguardia en Inteligencia Artificial de Alphabet

Gemini 1.0, la última creación de Google en inteligencia artificial, se está desplegando en varios productos y plataformas, incluyendo Bard.
En un anuncio reciente, Google reveló el lanzamiento de la versión 1.0 de Gemini, una inteligencia artificial (IA) multimodal y adaptable que se presenta en tres niveles: Gemini Ultra, Gemini Pro y Gemini Nano. Estos niveles están diseñados para adaptarse a diversas aplicaciones, desde dispositivos hasta centros de datos.
A finales de marzo pasado, The Information anticipó que los equipos de inteligencia artificial de Google y DeepMind estaban colaborando en una iniciativa llamada Gemini, con la ambición de competir y superar el dominio de la desarrolladora de ChatGPT.
Ahora, Google ha presentado oficialmente la primera versión de Gemini (1.0), describiéndola como un modelo de IA que marca el comienzo de una “nueva era de modelos” y representa uno de los mayores esfuerzos científicos e ingenieriles de la compañía, según el CEO Sundar Pichai.
Demis Hassabis, director ejecutivo y cofundador de Google DeepMind, destacó que Gemini fue construido desde cero como un modelo multimodal nativo, capaz de comprender, operar y combinar sin problemas diferentes tipos de información, como texto, código, audio, imagen y vídeo.
La flexibilidad de Gemini le permite ejecutarse eficientemente tanto en centros de datos como en dispositivos móviles, optimizado en tres tamaños distintos. Gemini Ultra, el modelo más grande, se destina a tareas altamente complejas, mientras que Gemini Pro es ideal para una amplia gama de tareas, y Gemini Nano es eficiente para tareas en dispositivos.
Google detalló que el rendimiento de Gemini Ultra supera los resultados actuales de última generación en 30 de los 32 puntos de referencia académicos utilizados en la investigación y desarrollo de modelos de lenguaje grande (LLM). Además, la IA supera a los expertos humanos en comprensión masiva de lenguajes multitarea (MMLU) con un 90 por ciento de precisión.
Gemini también puede extraer información de cientos de miles de documentos mediante la lectura, el filtrado y la comprensión de la información, abriendo nuevas posibilidades en campos que van desde la ciencia hasta las finanzas.
En cuanto a su aplicación práctica, Gemini 1.0 puede comprender, explicar y generar código de alta calidad en lenguajes de programación populares, como Python, Java, C++ y Go. También se puede utilizar como motor para sistemas de codificación, como AlphaCode 2.
La implementación de Gemini 1.0 ya está en marcha en productos y plataformas de Google, incluyendo Bard, que ahora utilizará una versión mejorada de Gemini Pro para un razonamiento, planificación y comprensión más avanzados. Además, esta tecnología llegará a Pixel 8 Pro, específicamente con la versión Gemini Nano, para potenciar funciones como la ‘Resumir’ en la aplicación Grabadora y la implementación de ‘Respuesta inteligente’ en Gboard.
En los próximos meses, Gemini estará disponible en servicios de Google como Búsqueda, Anuncios, Chrome y Duet AI, y se está probando para mejorar la Experiencia Generativa de Búsqueda (SGE) y hacerla más rápida para los usuarios. A partir del 13 de diciembre, los desarrolladores podrán acceder a Gemini Pro a través de la API de Gemini en Google AI Studio o Google Cloud Vertex AI.
Con respecto a Gemini Ultra, Google está llevando a cabo exhaustivas comprobaciones de confianza y seguridad, que incluyen la formación de equipos externos y el perfeccionamiento del modelo mediante Reinforcement Learning from Human Feedback (RLHF).