A continuaciónSiguiente guía
Google Mente Profunda
Empresas
GUÍA de empresas
Gemma es la familia de modelos de IA livianos y abiertos de Google creados a partir de la misma investigación y tecnología que Gemini.
Permite a los desarrolladores descargar, ajustar y ejecutar modelos capaces en su propio hardware, incluso en una sola computadora portátil o GPU.
Anunciada en febrero de 2024, Gemma le da a Google una entrada en la carrera de modelos de peso abierto junto a Llama y Mistral de Meta. Los modelos se envían en tamaños pequeños, la primera versión vino en versiones de parámetros 2B y 7B, con pesos que puede descargar y ejecutar localmente, a diferencia del Gemini cerrado, solo API. Google distribuye variantes básicas (preentrenadas) y ajustadas a instrucciones bajo una licencia permisiva que permite el uso comercial. La familia se expandió rápidamente: CodeGemma para programación, PaliGemma para tareas de lenguaje visual, RecurrentGemma para secuencias largas eficientes y Gemma 2 (y posteriores) con mayor rendimiento en tamaños como 9B y 27B. Gemma está diseñada para funcionar bien con herramientas populares, Hugging Face, Keras, PyTorch, JAX y Ollama, lo que la convierte en una opción práctica para implementaciones locales, sensibles a la privacidad o conscientes de los costos.
Las hojas de ruta de los proveedores influyen en las funciones que su equipo puede desarrollar a continuación.
Los términos comerciales y las opciones de implementación afectan los costos y riesgos a largo plazo.
Los incentivos de las empresas dan forma a los incumplimientos de los productos, la postura de seguridad y la apertura.
Espere que Google siga lanzando variantes de Gemma adaptadas a modalidades y tareas específicas, visión, código, matemáticas y uso en el dispositivo, al tiempo que reduce el espacio necesario para ejecutarlas. A medida que los modelos de peso abierto cierran la brecha con los sistemas de frontera, Gemma posiciona a Google para ganar la participación de los desarrolladores y potenciar implementaciones privadas y de vanguardia donde los datos no pueden salir del edificio. Una integración más estrecha con Android, Chrome y herramientas como Ollama y Vertex AI harán que el ajuste y la inferencia local sean cada vez más llave en mano.
Ejecutar un chatbot completamente fuera de línea en una computadora portátil o una sola GPU para datos sensibles a la privacidad
Ajuste de un pequeño modelo de Gemma en los documentos internos de una empresa para un asistente de soporte personalizado
Uso de CodeGemma como asistente local de generación y finalización de código dentro de un IDE
Creación de subtítulos de imágenes o aplicaciones visuales de preguntas y respuestas con la variante PaliGemma de lenguaje visual
Los anuncios de lanzamiento pueden superar la estabilidad en los flujos de trabajo de producción reales.
Los precios de API o los cambios de políticas pueden romper los supuestos de la noche a la mañana.
La dependencia de un único proveedor aumenta los costos de bloqueo y migración.
Evalúe proveedores utilizando sus propias tareas y conjuntos de datos.
Revise los términos legales, de seguridad y de privacidad antes de la integración.
Mantenga un plan alternativo entre modelos o proveedores.
Supervise las notas de la versión para que los cambios en la hoja de ruta no sorprendan a los equipos.
Free newsletter
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Gemma es la familia de modelos de IA livianos y abiertos de Google creados a partir de la misma investigación y tecnología que Gemini. Permite a los desarrolladores descargar, ajustar y ejecutar modelos capaces en su propio hardware, incluso en una sola computadora portátil o GPU.
Los pesos entrenados de Gemma se pueden descargar y ejecutar localmente, mientras que Gemini se ofrece como modelo cerrado a través de las aplicaciones y API de Google.
El lanzamiento inicial de Gemma incluyó modelos de 2 mil millones y 7 mil millones de parámetros, deliberadamente lo suficientemente pequeños como para ejecutarse en hardware modesto.
CodeGemma es la variante optimizada para la generación y finalización de código, mientras que PaliGemma maneja el lenguaje visual y RecurrentGemma apunta a secuencias largas eficientes.
Peso abierto significa que puede descargar y ejecutar los parámetros entrenados, pero los datos de entrenamiento completos y la canalización no son necesariamente de código abierto.
La destilación de conocimientos permite que un modelo de "estudiante" más pequeño aprenda a imitar un modelo de "maestro" más grande, reuniendo un gran rendimiento en un tamaño compacto.
sigue aprendiendo
Más guías seleccionadas para este tema.
A continuaciónSiguiente guía
Google Mente Profunda
Empresas