El Solitario

  • GNU/Linux
  • Tutoriales
  • Opinión

reap

Diagrama de la compresión de modelos en el catálogo de Cerebras Inference
Noticias Tech

Cerebras detalla su catálogo de inferencia: GPT OSS 120B corre a 3.000 tokens/s

Cerebras actualizó la documentación de su servicio de inferencia con la tabla de modelos disponibles y una explicación detallada de su política de compresión de modelos: cuantización selectiva por capas, sin poda de arquitectura en producción.

Por Andrés Morales, hace 7 horas
Cursos sobre Linux
Introducción a Linux: Instala Linux en tu PC

Introducción a Linux: Instala Linux en tu PC

Empieza seguro en Linux

4.2 | Gratis


Aprendiendo Linux: uso, terminal y comandos

Aprendiendo Linux: uso, terminal y comandos

Aprende sobre el entorno de escritorio y los comandos básicos de GNU/Linux

4.7 | $19.99

El Solitario > reap
Entradas recientes
  • Agentes de OpenAI usaron una wiki alemana para coludirse: 18.000 posts
  • Cerebras detalla su catálogo de inferencia: GPT OSS 120B corre a 3.000 tokens/s
  • Any Human Ever: la web que simula una vida entre 100.000 millones
  • ICANN aprueba terminar el nivel 3 de .name: 22.000 dominios en riesgo
  • OpenTelemetry: el estándar que unifica trazas, métricas y logs
Categorías
  • GNU/Linux
  • Inteligencia Artificial
  • Microservicios
  • Noticias Tech
  • Opinión
  • Programación
  • Redes
  • Seguridad
  • Tutoriales
Comentarios recientes
  • Casey en El estándar OpenAI-compatible API: auditoría técnica del contrato de-facto que unificó la inferencia LLM (2020–2026)
  • Angel_Bran en Solucionar el problema con VSYNC en Linux
  • Angel_Bran en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • Sergio en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • carlitos en Solucionar el problema con VSYNC en Linux
Etiquetas
accesibilidad agentes algoritmos amazon amd android anthropic apple aprendizaje benchmark benchmarks busqueda c2pa china cifrado claude codex costos cuantizacion firmware github gpu hardware huggingface inferencia Javascript kimi Linux llm microsoft modelos moe moonshot openai opensource privacidad Programacion Python qwen regulacion rust seguridad sqlite vibecoding wcag
  • Política de privacidad
Hestia | Desarrollado por ThemeIsle