Mercado de modelos
diffusiongemma-26b-a4b-itDiffusionGemma 26B A4B IT es un modelo generativo multimodal de pesos abiertos desarrollado por Google DeepMind que procesa entradas de texto, imágenes y vídeo para generar texto mediante difusión discreta. Basado en la arquitectura «Mixture-of-Experts» (MoE) de Gemma 4 26B A4B, con un total de 25,2 mil millones de parámetros y 3,8 mil millones de parámetros activos, el modelo emplea un diseño de codificador-decodificador con atención bidireccional que genera tokens en bloques paralelos de 256 tokens, lo que permite una generación a alta velocidad que supera los 1.100 tokens por segundo con lotes de tamaño reducido en NVIDIA Hopper H100 (FP8). DiffusionGemma 26B A4B IT admite una ventana de contexto de 256 000 tokens, un modo de razonamiento configurable, llamadas a funciones nativas e inferencia multilingüe en más de 35 idiomas.
gemma-4-31b-itGemma 4 31B IT es un modelo multimodal abierto desarrollado por Google DeepMind que admite entradas de texto e imágenes, puede procesar vídeo como secuencias de fotogramas y genera salida de texto. Está diseñado para ofrecer un rendimiento de vanguardia en razonamiento, flujos de trabajo agenticos, programación y comprensión multimodal en GPU y estaciones de trabajo de consumo, con una ventana de contexto de 256K tokens y compatibilidad con más de 140 idiomas. El modelo utiliza un mecanismo de atención híbrido que intercala la atención local de ventana deslizante con la atención global completa, con claves y valores unificados en las capas globales y RoPE proporcional (p-RoPE) para mejorar el rendimiento en contextos largos.
Modo de recarga fuera de línea. Contacta al administrador para abrir una cuenta o recargar.