UASP USB frente a BOT: arreglando bucles de reset en mass storage, timeouts y transferencias lentas

Resuelve fallos del protocolo UASP USB y problemas de fallback a BOT. Diagnostica bucles de reset en mass storage, timeouts de comandos SCSI, discos externos lentos, bugs de firmware de la enclosure y diferencias de velocidad entre UASP y BOT.

usb uasp, usb bot, mass storage, scsi errors, external drive timeout, reset loop, diagnóstico USB

Los problemas de almacenamiento USB suelen echarse al disco, pero el fallo puede estar en el transporte USB, el bridge chip, el firmware de la enclosure, el cable, el hub, el power, el soporte UASP, el fallback a BOT o el manejo de comandos SCSI. Los usuarios buscan "USB UASP timeout", "USB mass storage reset loop", "external drive disconnects under load", "USB BOT CBW CSW error", "UASP vs BOT troubleshooting" y "SCSI command failed USB" cuando un disco se monta y luego se queda colgado, desaparece o se vuelve dolorosamente lento.

Bus Scope ayuda porque el almacenamiento USB no es solo I/O de文件系统. Por debajo del diálogo de copia de archivos, el host envía comandos SCSI sobre transportes USB.

BOT y UASP

USB Mass Storage Bulk-Only Transport, BOT, es antiguo y muy soportado. Usa command block wrappers, transferencias de datos y command status wrappers.

UASP, USB Attached SCSI Protocol, es más nuevo y soporta command queuing más eficiente sobre USB. Puede mejorar el rendimiento, pero también depende del firmware del bridge, del comportamiento del host controller, del soporte de drivers y de la calidad del cable.

Los síntomas pueden diferir:

  • BOT va pero lento.
  • UASP es rápido hasta que se resetea.
  • UASP falla en una máquina pero BOT va en otra.
  • La enclosure externa se resetea bajo escrituras fuertes.
  • El disco desaparece durante transferencias grandes.

Bucles de reset bajo carga

Si un disco enumera y se monta pero se resetea durante escrituras, mira alrededor de la primera carga que falla:

  • Escritura secuencial grande.
  • Ráfaga de I/O aleatorio.
  • Consulta SMART.
  • Flush de caché.
  • Reset SCSI.
  • Bulk timeout USB.
  • Desconexión del dispositivo.

El error visible del SO puede ser "I/O error", "device not ready" o "disk removed". La traza del bus puede enseñar si el bridge USB dejó de responder o si el host lo reseteó.

Evidencia BOT

Para BOT, inspecciona:

  • Command Block Wrapper.
  • Data phase.
  • Command Status Wrapper.
  • Opcode del comando SCSI.
  • Residue de la transferencia.
  • Recuperación de STALL.
  • Bulk-only mass storage reset.

Si falta el CSW o es inválido, el host puede resetear el dispositivo.

Evidencia UASP

UASP usa streams y task management de SCSI. Los fallos pueden aparecer como timeouts de comandos, tasks abortados o resets. Las trazas UASP pueden ser más complejas que las BOT, pero la pregunta de fondo sigue siendo: ¿qué comando estaba en vuelo cuando el dispositivo dejó de responder?

Los bugs de firmware del bridge son habituales en enclosures concretas. Probar el mismo disco en otra enclosure separa la salud del disco del comportamiento del bridge USB.

Power y cable

Los dispositivos de almacenamiento consumen energía real, sobre todo discos giratorios y SSDs de alto rendimiento. Un cable marginal o un hub bus-powered pueden producir resets solo bajo carga de escritura.

Si los resets correlacionan con I/O fuerte, prueba:

  • Cable corto.
  • Puerto directo.
  • Hub con alimentación.
  • Otra enclosure.
  • Otro host controller.

Guarda la captura; los tests de topología son más sólidos cuando se combinan con evidencia de paquetes.

Checklist de depuración

Usa este flujo:

  1. Captura la enumeración e identifica BOT o UASP.
  2. Captura el mount y el primer I/O fuerte.
  3. Identifica el último comando SCSI correcto.
  4. Busca bulk timeout, STALL, reset o desconexión.
  5. Para BOT, inspecciona CBW y CSW.
  6. Para UASP, inspecciona el comportamiento de comandos y tareas.
  7. Compara puerto directo frente a hub.
  8. Compara UASP y fallback a BOT si es posible.
  9. Prueba otra enclosure con el mismo disco.
  10. Conserva el timing en torno al primer reset.

Diagnóstico final

Los fallos de USB mass storage suelen ser problemas de transporte y bridge, no solo del disco. Importan UASP, BOT, comandos SCSI, firmware del bridge, power, cable y comportamiento del host controller.

Bus Scope ayuda a exponer la conversación de almacenamiento USB para que los bucles de reset y los síntomas de disco lento se puedan rastrear hasta evidencia real a nivel de bus.