Mientras las grandes tecnológicas gastan miles de millones en GPUs, el proyecto open source Colibri ejecutó GLM-5.2, un modelo de 744 mil millones de parámetros, en...
MiniMax M2 utiliza arquitectura Mixture-of-Experts para activar solo 10 mil millones de parámetros por consulta, optimizando velocidad y costos.
DeepSeek lanzó su modelo V3.1, una actualización que combina una estructura híbrida de inferencia, 685 mil millones de parámetros y una ventana de contexto de 128,000...
Glm-4.5 se posiciona como tercer mejor modelo globalmente según benchmarks oficiales de Z.ai.
DeepSeek ha lanzado su modelo DeepSeek R1, marcando un avance significativo en el campo de los grandes modelos de lenguaje (LLMs).