El Solitario

  • GNU/Linux
  • Tutoriales
  • Opinión

razonamiento

Diagrama de un modelo de IA con menos conocimiento factual y más razonamiento
Inteligencia Artificial

Qwen3.5 razona casi como GLM-5.2 pero alucina el 82% de los hechos

Los laboratorios de IA están recortando deliberadamente el conocimiento factual de sus modelos para ganar razonamiento puro. GLM-5.2, Qwen3.5 y DeepSeek V4-Flash muestran el patrón con números concretos, y la tendencia apunta a correr un modelo de frontera en una sola GPU de consumo.

Por Andrés Morales, hace 3 semanas
Diagrama del ataque de razonamiento cifrado a modelos de IA como Claude y GPT
Inteligencia Artificial

Stolen Thoughts: filtran 704 secretos del razonamiento cifrado de la IA

Un grupo de investigadores publicó Stolen Thoughts, una técnica que decodifica el razonamiento cifrado de Claude, GPT y Gemini reinyectando el bloque firmado en un modelo más débil y jailbreakeado. Al analizar 6.708 trazas públicas de agentes en GitHub y Hugging Face, hallaron 704 secretos reales, entre ellos 62 API keys y 33 contraseñas.

Por Andrés Morales, hace 4 semanas
Gráfico comparativo de los puntajes de DeepSeek V4 Flash en ARC-AGI-1 y ARC-AGI-2
Noticias Tech

DeepSeek V4 Flash: 89% en ARC-AGI-1 y 61,4% en ARC-AGI-2 por $0,04

DeepSeek V4 Flash 0731 anotó 89,0% en ARC-AGI-1 y 61,4% en ARC-AGI-2 según los resultados verificados por ARC Prize Foundation. La variante Max logra ambos puntajes a $0,02 y $0,04 por tarea, respectivamente, uno de los costos más bajos reportados para este nivel de desempeño en razonamiento abstracto.

Por Andrés Morales, hace 4 semanas
Cursos sobre Linux
Introducción a Linux: Instala Linux en tu PC

Introducción a Linux: Instala Linux en tu PC

Empieza seguro en Linux

4.2 | Gratis


Aprendiendo Linux: uso, terminal y comandos

Aprendiendo Linux: uso, terminal y comandos

Aprende sobre el entorno de escritorio y los comandos básicos de GNU/Linux

4.7 | $19.99

El Solitario > razonamiento
Entradas recientes
  • Count-Min Sketch: contar millones de eventos con kilobytes de memoria
  • Claude formaliza el Último Teorema de Fermat en Lean en 11 días
  • Claude formaliza el Último Teorema de Fermat en Lean en 11 días
  • Actor model: el patron de concurrencia sin locks ni race conditions
  • Agentes de OpenAI usaron una wiki alemana para coludirse: 18.000 posts
Categorías
  • GNU/Linux
  • Inteligencia Artificial
  • Microservicios
  • Noticias Tech
  • Opinión
  • Programación
  • Redes
  • Seguridad
  • Sin categoría
  • Tutoriales
Comentarios recientes
  • Casey en El estándar OpenAI-compatible API: auditoría técnica del contrato de-facto que unificó la inferencia LLM (2020–2026)
  • Angel_Bran en Solucionar el problema con VSYNC en Linux
  • Angel_Bran en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • Sergio en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • carlitos en Solucionar el problema con VSYNC en Linux
Etiquetas
accesibilidad agentes algoritmos android anthropic apple aprendizaje arquitectura benchmark benchmarks c2pa china claude cuantizacion dns firmware github gnome google gpu hardware huggingface inferencia Javascript kimi lean Linux llm microsoft moe moonshot nvidia openai opensource privacidad Programacion Python regulacion rust seguridad sqlite teclado vibecoding vpn wcag
  • Política de privacidad
Hestia | Desarrollado por ThemeIsle