Qué sabemos
De 184 respuestas consideradas plausibles por los expertos, los participantes también clasificaron 167 como plausibles (90,8 %). Esa medida describe respuestas en esta prueba, no engaño de atacantes reales.
Límites de la evidencia
Los participantes conocían la naturaleza del sistema; no hubo comparación controlada con otro honeypot ni prueba con adversarios reales. Las 226 respuestas están agrupadas en 12 personas y no son observaciones independientes.
Se analizó: texto completo.
Revisión de texto completo · 2026-10-02
Diseño y alcance
Doce participantes de seguridad, informados de que usaban un honeypot, evaluaron 226 respuestas a comandos de shelLM; tres expertos juzgaron la consistencia de esas respuestas con una shell Linux.
Hallazgo principal
De 184 respuestas consideradas plausibles por los expertos, los participantes también clasificaron 167 como plausibles (90,8 %). Esa medida describe respuestas en esta prueba, no engaño de atacantes reales.
Límites de la evidencia
Los participantes conocían la naturaleza del sistema; no hubo comparación controlada con otro honeypot ni prueba con adversarios reales. Las 226 respuestas están agrupadas en 12 personas y no son observaciones independientes.
Abrir texto completo examinado
Localizadores: PDF pp. 3–5, Sections 4–7, Figure 6, Tables 1–2
Se examinó el texto completo y se conservaron localizadores. Síntesis de un revisor, sin extracción independiente ni evaluación formal de calidad.
Fuentes y trazabilidad
- LLM in the Shell: Generative Honeypots
full-text · 2026-10-02 - Full text examined for Atlas review
full-text · 2026-10-02
Revisado: 2026-10-02. La ficha puede actualizarse cuando aparezca nueva evidencia.