El Solitario

  • GNU/Linux
  • Tutoriales
  • Opinión

cerebras

Diagrama de la compresión de modelos en el catálogo de Cerebras Inference
Noticias Tech

Cerebras detalla su catálogo de inferencia: GPT OSS 120B corre a 3.000 tokens/s

Cerebras actualizó la documentación de su servicio de inferencia con la tabla de modelos disponibles y una explicación detallada de su política de compresión de modelos: cuantización selectiva por capas, sin poda de arquitectura en producción.

Por Andrés Morales, hace 2 días
Chip wafer-scale de Cerebras potenciando GPT-5.6 Sol Ultrafast
Inteligencia Artificial

Cerebras acelera GPT-5.6 Sol a 750 tokens por segundo con OpenAI

Cerebras y OpenAI presentaron Ultrafast Mode, una nueva capa de inferencia que hace correr a GPT-5.6 Sol hasta 750 tokens de salida por segundo. En el examen Humanity’s Last Exam, el modelo resolvió 2.500 preguntas en 11 horas y 11 minutos, casi siete veces más rápido que Claude Fable 5.

Por Andrés Morales, hace 3 semanas13 agosto, 2026
Cursos sobre Linux
Introducción a Linux: Instala Linux en tu PC

Introducción a Linux: Instala Linux en tu PC

Empieza seguro en Linux

4.2 | Gratis


Aprendiendo Linux: uso, terminal y comandos

Aprendiendo Linux: uso, terminal y comandos

Aprende sobre el entorno de escritorio y los comandos básicos de GNU/Linux

4.7 | $19.99

El Solitario > cerebras
Entradas recientes
  • Count-Min Sketch: contar millones de eventos con kilobytes de memoria
  • Claude formaliza el Último Teorema de Fermat en Lean en 11 días
  • Claude formaliza el Último Teorema de Fermat en Lean en 11 días
  • Actor model: el patron de concurrencia sin locks ni race conditions
  • Agentes de OpenAI usaron una wiki alemana para coludirse: 18.000 posts
Categorías
  • GNU/Linux
  • Inteligencia Artificial
  • Microservicios
  • Noticias Tech
  • Opinión
  • Programación
  • Redes
  • Seguridad
  • Sin categoría
  • Tutoriales
Comentarios recientes
  • Casey en El estándar OpenAI-compatible API: auditoría técnica del contrato de-facto que unificó la inferencia LLM (2020–2026)
  • Angel_Bran en Solucionar el problema con VSYNC en Linux
  • Angel_Bran en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • Sergio en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • carlitos en Solucionar el problema con VSYNC en Linux
Etiquetas
accesibilidad agentes algoritmos android anthropic apple aprendizaje arquitectura benchmark benchmarks c2pa china claude cuantizacion dns firmware github gnome google gpu hardware huggingface inferencia Javascript kimi lean Linux llm microsoft moe moonshot nvidia openai opensource privacidad Programacion Python regulacion rust seguridad sqlite teclado vibecoding vpn wcag
  • Política de privacidad
Hestia | Desarrollado por ThemeIsle