InicioBlogGoogle lanza Gemini: su modelo de IA más grande y capaz

Google lanza Gemini: su modelo de IA más grande y capaz

Google presenta Gemini, su última joya en inteligencia artificial. Desde capacidades multimodales hasta eficiencia escalable, su modelo se ha estado entrenando desde al menos mayo de 2023, superando evaluaciones exhaustivas de seguridad, incluyendo pruebas de adversarios y evaluaciones de toxicidad y sesgo.

Google ha lanzado oficialmente su último y más grande modelo de inteligencia artificial, denominado «Gemini». El anuncio fue hecho por Sundar Pichai, CEO de Google y Alphabet, y Demis Hassabis, CEO y cofundador de Google DeepMind, en el artículo Introducing Gemini: our largest and most capable AI model, publicado en The Keyword[1].

En un comunicado conjunto, Pichai destacó la importancia del avance en la inteligencia artificial, calificándolo como una oportunidad para impulsar el progreso científico y mejorar la vida de las personas. Señaló que la transición actual con la IA será más significativa que los cambios a móviles o web anteriores. Pichai enfatizó la ambición de Google de hacer que la IA sea útil para todos, en todas partes del mundo.

Hassabis, en representación del equipo de Gemini, compartió detalles sobre el nuevo modelo, describiéndolo como el más capaz y general hasta la fecha. Gemini es el resultado de una colaboración a gran escala entre equipos de Google, incluidos los colegas de Google Research. Fue diseñado desde cero para ser multimodal, capaz de comprender y combinar diferentes tipos de información, como texto, código, audio, imagen y video.

Google ha optimizado Gemini 1.0, su primera versión, para tres tamaños diferentes:

  • Gemini Ultra: el modelo más grande y capaz para tareas muy complejas.
  • Gemini Pro: el mejor modelo para escalar una amplia gama de tareas.
  • Gemini Nano: un modelo más eficiente para tareas en el dispositivo.

Desempeño de vanguardia y nuevas capacidades

Gemini 1.0, la primera versión del modelo, está optimizado para diferentes tamaños: Ultra, Pro y Nano. Estos modelos representan un hito significativo en los esfuerzos científicos y de ingeniería de Google. Hassabis destacó la flexibilidad de Gemini, que puede ejecutarse eficientemente en centros de datos y dispositivos móviles.

Se llevaron a cabo pruebas rigurosas de rendimiento en una variedad de tareas, y Gemini Ultra superó los resultados del estado actual de la técnica en 30 de los 32 benchmarks académicos ampliamente utilizados en la investigación y desarrollo de modelos de lenguaje masivo. Gemini Ultra logró un puntaje del 90.0% en MMLU, siendo el primer modelo en superar a expertos humanos en comprensión masiva del lenguaje multitarea.

Ya en mayo de 2023 Google había anunciado que Gemini estaba entrenándose. La mención de Gemeni también estuvo a cargo de Pichai, en la presentación de PaLM 2, la respuesta de Google a Chat GPT4 de OpenAI.

Nuevas capacidades de generación de código y eficiencia escalable

Gemini destaca en la generación de código avanzada, siendo capaz de entender y generar código de alta calidad en varios lenguajes de programación. Gemini Ultra sobresale en benchmarks de codificación, como HumanEval y Natural2Code.

El modelo fue entrenado a escala utilizando la infraestructura optimizada para IA de Google, utilizando unidades de procesamiento de tensor (TPUs) diseñadas internamente. Google también anunció Cloud TPU v5p, el sistema TPU más potente, eficiente y escalable hasta la fecha, diseñado para acelerar el desarrollo de Gemini y ayudar a los desarrolladores a entrenar modelos de IA generativos a gran escala de manera más rápida.

Compromiso con la responsabilidad y la seguridad

Google destaca su compromiso con la IA audaz y responsable. Gemini ha pasado por evaluaciones exhaustivas de seguridad, incluyendo pruebas de adversarios y evaluaciones de toxicidad y sesgo. Se están implementando nuevas protecciones para abordar las capacidades multimodales de Gemini, y se están realizando evaluaciones de seguridad en colaboración con expertos externos, según detalla Google.

Disponibilidad de Gemini 1.0

Gemini 1.0 ya se está implementando en una variedad de productos y plataformas, incluyendo Google Bard y Pixel. Los desarrolladores y clientes empresariales pueden acceder a Gemini Pro a partir del 13 de diciembre a través de la API Gemini[2] en Google AI Studio o Google Cloud Vertex AI.

Gemini Ultra estará disponible para clientes selectos, desarrolladores y expertos en seguridad para experimentación y retroalimentación a principios del próximo año.

El lanzamiento de Gemini marca un hito significativo en el desarrollo de la inteligencia artificial, abriendo nuevas posibilidades para la innovación futura y reafirmando el compromiso de Google con la responsabilidad y la seguridad en el desarrollo de modelos de IA.


Fuentes de la información:

  • [1] Pichai, Sundar. “Introducing Gemini: Our Largest and Most Capable AI Model.” Google, 6 Dec. 2023, https://blog.google/technology/ai/google-gemini-ai/
  • [2] “Vertex AI.” Google Cloud, https://cloud.google.com/vertex-ai.
Nicolás Ockier
Nicolás Ockierhttps://ockier.es/quien-soy/
Mi nombre es Nicolás Ockier, Senior SEO en Barcelona. Con más de 15 años de experiencia como SEO manager, me he convertido en un solucionador de problemas de marketing digital que determina el contenido que necesita una web en función de las consultas de los motores de búsqueda. Durante años llevo obteniendo excelentes resultados en mercados altamente competitivos. Mastodon - LinkedIn - Facebook - Twitter - Google Developer
Artículos Relacionado

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Tiempo excedido. Por favor, completa el captcha nuevamente.

Cómo funciona algoritmo de Google
¿Cómo funciona el algoritmo de Google?
LO ÚLTIMO
LO MÁS POPULAR