El Solitario

  • GNU/Linux
  • Tutoriales
  • Opinión

agentes

Red de servidores representando la comunicación entre agentes de OpenAI
Inteligencia Artificial

Agentes de OpenAI usaron una wiki alemana para coludirse: 18.000 posts

Un grupo de investigadores independientes halló 18.000 mensajes que agentes autónomos de OpenAI dejaron en una wiki alemana de 25 años. Los usaron para compartir respuestas, coordinarse entre sesiones y saltarse las restricciones de su propio sandbox durante semanas.

Por Andrés Morales, hace 4 días
Tablero de Felony Bench con incidentes de seguridad de agentes de inteligencia artificial
Noticias Tech

Felony Bench: Anthropic y OpenAI empatan con 8 incidentes de agentes IA

Felony Bench es un tablero que cuenta incidentes reales donde agentes de IA afectaron a terceros. Hasta agosto de 2026, Anthropic y OpenAI empatan con 8 casos cada uno, desde robo de credenciales hasta cuentas comprometidas.

Por Andrés Morales, hace 2 semanas21 agosto, 2026
Desarrollador probando un agente de código basado en Grok 4.6
Noticias Tech

Grok 4.6: xAI iguala a GPT-5.6 Sol Max en el índice de Artificial Analysis

xAI lanzó Grok 4.6 el 12 de agosto de 2026, con foco en agentes de larga duración y trabajo visual complejo. El modelo iguala a GPT-5.6 Sol Max en el índice de Artificial Analysis con 61 puntos y cuesta entre 2 y 6 dólares por millón de tokens. Ya está disponible en Cursor, Grok Build, la API de xAI y OpenRouter.

Por Andrés Morales, hace 4 semanas
Ilustración de Docker Sandboxes ejecutando un agente de IA en una microVM aislada
Inteligencia Artificial

Docker Sandboxes: microVMs para correr agentes de IA sin supervisión

Docker presentó Sandboxes, una herramienta que ejecuta agentes de código como Claude Code y Copilot CLI dentro de microVMs desechables y aisladas del host. Cada sandbox monta solo el workspace del proyecto y permite trabajar en modo autónomo sin prompts de permiso constantes.

Por Andrés Morales, hace 4 semanas
Interfaz de OpenChamber, el entorno agéntico de desarrollo con IA
Inteligencia Artificial

OpenChamber: entorno agéntico que corre 5 modelos IA en paralelo

OpenChamber es un entorno de desarrollo agéntico y open source que deja correr una misma tarea en hasta cinco modelos de IA a la vez, fusionando o comparando resultados. Funciona sobre el SDK de OpenCode y se usa desde escritorio, navegador, celular o directamente desde el editor de código, sin enviar tu código a servidores de terceros.

Por Andrés Morales, hace 4 semanas
Interfaz conceptual de DeltaDB, el sistema de control de versiones de Zed
Noticias Tech

DeltaDB de Zed: control de versiones que registra cada cambio entre commits

Zed Industries abrió el acceso anticipado a DeltaDB, un sistema de control de versiones que registra cada operación entre commits y la enlaza a la conversación de agente de IA que la originó. Todavía no hay CLI pública: el único paso disponible es anotarse en la lista de espera.

Por Andrés Morales, hace 1 mes
Diagrama del harness minimalista Pi con sus herramientas base y extensiones
Noticias Tech

Databricks: el harness minimalista Pi vence a Claude Code y Codex en costo

Un benchmark propio de Databricks comparó tres harnesses de código sobre su base de millones de líneas y el más simple, Pi, terminó rindiendo mejor y más barato. Earendil analiza por qué la disciplina de contexto empieza a pesar tanto como el modelo elegido.

Por Andrés Morales, hace 1 mes
Terminal mostrando un agente de IA sincronizando un fork de un devtool open source con su repositorio original
Programación

Devtools open source: por qué ganan terreno con agentes de IA

Un análisis de por qué los devtools open source tienen ventaja estructural en la era de los agentes: pueden forkearse, personalizarse y mantenerse sincronizados con upstream sin que el usuario escriba una línea de código.

Por Andrés Morales, hace 1 mes4 agosto, 2026
Agente de IA revisando un extenso manual corporativo en una pantalla
Inteligencia Artificial

HANDBOOK.md: agentes de IA fallan el 64% de tareas con políticas largas

HANDBOOK.md es un nuevo benchmark que mide si los agentes de IA respetan manuales corporativos extensos durante tareas largas. El mejor de 30 configuraciones evaluadas aprueba apenas el 36,2% de las pruebas bajo calificación estricta.

Por Andrés Morales, hace 1 mes
Logo de Anthropic junto al nombre Claude Opus 5 sobre fondo oscuro
Inteligencia Artificial

Claude Opus 5: Anthropic lo iguala a Fable 5 a mitad de precio

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026: un modelo que se acerca al rendimiento de Fable 5 pagando la mitad por tarea. Repasamos los benchmarks, casos de uso reales y cómo empezar a probarlo hoy mismo.

Por Andrés Morales, hace 2 meses24 julio, 2026
Cursos sobre Linux
Introducción a Linux: Instala Linux en tu PC

Introducción a Linux: Instala Linux en tu PC

Empieza seguro en Linux

4.2 | Gratis


Aprendiendo Linux: uso, terminal y comandos

Aprendiendo Linux: uso, terminal y comandos

Aprende sobre el entorno de escritorio y los comandos básicos de GNU/Linux

4.7 | $19.99

El Solitario > agentes
Entradas recientes
  • D2 libera TALA, su algoritmo de autolayout, bajo licencia MPL-2.0
  • Factorizan una clave RSA de 512 bits de una CA de 1999 con CADO-NFS
  • BZip3 reduce el peso de BZip2 en 84% al comprimir código real
  • SeoulTech desarrolla un framework para blindar la visión por IA
  • Más del 80% de los smartphones en la UE incumple la reparabilidad
Categorías
  • GNU/Linux
  • Inteligencia Artificial
  • Microservicios
  • Noticias Tech
  • Opinión
  • Programación
  • Redes
  • Seguridad
  • Sin categoría
  • Tutoriales
Comentarios recientes
  • Casey en El estándar OpenAI-compatible API: auditoría técnica del contrato de-facto que unificó la inferencia LLM (2020–2026)
  • Angel_Bran en Solucionar el problema con VSYNC en Linux
  • Angel_Bran en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • Sergio en Configurar GRUB en Ubuntu y derivados: Cambiar el orden de arranque por defecto
  • carlitos en Solucionar el problema con VSYNC en Linux
Etiquetas
accesibilidad agentes algoritmos amd android anthropic apple aprendizaje arquitectura benchmark benchmarks busqueda c2pa china ciberseguridad claude costos cuantizacion escritura firmware github gnome gpu hardware huggingface inferencia Javascript kimi lean licencias Linux llm microsoft moe nvidia openai opensource privacidad Programacion Python regulacion rust seguridad vulnerabilidad wcag
  • Política de privacidad
Hestia | Desarrollado por ThemeIsle