Debug USB Mass Storage BOT: CBW, CSW, sense data e transfer falliti
Dal lato utente i dispositivi USB Mass Storage sembrano semplici: \"colleghi una chiavetta, un data logger, un dispositivo di aggiornamento firmware o uno storage gadget embedded, e compare un disco.
Dal lato utente i dispositivi USB Mass Storage sembrano semplici: "colleghi una chiavetta, un data logger, un dispositivo di aggiornamento firmware o uno storage gadget embedded, e compare un disco. Quando falliscono, l'errore può essere vago: dispositivo non pronto, errore I/O, richiesta di formattazione, mount fallito o disco che scompare." Sotto, molti dispositivi usano Bulk-Only Transport. BOT ha un flusso di comando riconoscibile: "Command Block Wrapper, data phase, Command Status Wrapper. Se quel pattern si rompe, la cattura di solito mostra dove."
Capire il flusso BOT
Il pattern normale è:
- l'host invia CBW su bulk OUT
- data phase opzionale su bulk IN o OUT
- il dispositivo invia CSW su bulk IN
Il CBW porta un comando SCSI. Il CSW riporta lo stato del comando. Se il comando fallisce, l'host può emettere REQUEST SENSE per capire il motivo.
Evidenza utile:
- CBW signature
- command tag
- data transfer length
- direction flag
- byte del comando SCSI
- lunghezza della data phase
- CSW signature
- CSW status
- residue
- sense data dopo il fallimento
Se i tag non corrispondono, l'host non può fidarsi dello stato. Se la lunghezza dati non corrisponde al comportamento, possono seguire timeout o stall.
I sense data spiegano molti fallimenti
Un comando SCSI fallito non è la fine della diagnosi. I sense data spesso danno la vera ragione:
- not ready
- medium error
- illegal request
- write protected
- logical block address out of range
- unit attention after reset
I team firmware dovrebbero catturare il comando fallito e la risposta sense successiva. Un mount fallito sull'host può essere una risposta valida a una condizione storage riportata dal firmware.
Endpoint STALL e reset recovery
BOT definisce un comportamento di recovery. Se un endpoint va in stall o un comando fallisce gravemente, l'host può fare clear endpoint halt o emettere mass storage reset. Un dispositivo che non recupera correttamente può sembrare scomparire o richiedere scollegamento.
Ispeziona:
- quale endpoint è andato in stall
- se l'host ha inviato clear feature
- se è avvenuto BOT reset
- se il flusso CBW/CSW successivo è ripreso
- se i tag sono rimasti coerenti
Questa evidenza è migliore di un'ipotesi sulle state machine firmware.
Dove entra Bus Scope
Bus Scope è un workbench di ispezione USB. Nei casi mass storage, i byte raw non bastano; struttura BOT decodificata e transfer status aiutano gli ingegneri a trovare il guasto più rapidamente.
Un report Bus Scope utile per il debug BOT dovrebbe rispondere:
- quale comando SCSI è fallito?
- la data phase corrispondeva a direzione e lunghezza del CBW?
- il CSW è arrivato?
- il tag CSW corrispondeva al tag CBW?
- quali sense data sono seguiti?
- la reset recovery ha funzionato?
Per query come "USB mass storage BOT failed", "CBW CSW mismatch" o "USB flash drive I/O error firmware", questo è il percorso dal sintomo utente all'evidenza sul bus.
<!-- bus-scope-localized-transaction-foundation-v1:start -->Prova del contratto USB per «Debug USB Mass Storage BOT: CBW, CSW, sense data e transfer falliti»
La risposta diretta è che STALL, timeout o reset non spiega da solo la causa. Prima dimostra che il provider vede il device corretto; poi leggi il contratto del transfer: tipo, direzione, recipient, wValue, wIndex, lunghezza dichiarata e reale, status e stato precedente e successivo. In «Debug USB Mass Storage BOT: CBW, CSW, sense data e transfer falliti» collega la conclusione alla prima transazione diversa dal caso buono.
| Confine | Confronto | Decisione |
|---|---|---|
| Piattaforma | provider, permessi, Root Hub o usbmon/XHC20 | I record provengono dalla connessione corretta? |
| Setup | bmRequestType, bRequest, wValue, wIndex, wLength | L’host invia la richiesta prevista? |
| Data | direzione, lunghezza e bytes conservati | Il payload rispetta il contratto? |
| Status | ACK, STALL, timeout o cancellation | Dove termina la transazione? |
| Stato | configuration, interface, alternate setting, endpoint halt | Il device era pronto? |
Inizia prima di reset ed enumeration e conserva descriptors, SET_CONFIGURATION, SET_INTERFACE e il comando precedente al guasto. Un filtro endpoint stretto può nascondere il control transfer decisivo. Esegui un’azione USB documentata per prova e cambia solo firmware, driver, porta, cavo, comando o timing.
Come scrivere una risposta citabile?
Indica request, campi setup, risposta e contesto precedente; poi una prova con una variabile. Bytes non trattenuti non provano packet loss. La vicinanza fra command e reset dimostra correlazione, non causa senza ripetizione o cambio di stato.
Quando è valido il confronto?
Mantieni VID/PID, firmware, speed, topologia, provider, filtro e trigger. Confronta fasi USB semantiche, non frame numbers tra usbmon e USBPcap. Registra inizio, fine, versione, OS, connessione e checksum. Usa il troubleshooting Bus Scope.
I proprietari Semrush restano distinti: free USB analyzer sulla pagina prodotto, best USB protocol analyzer nella comparazione e USB descriptor viewer nella guida descriptor. Nessun volume o KD viene inventato.
<!-- bus-scope-localized-transaction-foundation-v1:end --><!-- bus-scope-localized-evidence-verdicts-v1:start -->Dalla cattura USB a un verdetto verificabile
Per «Debug USB Mass Storage BOT: CBW, CSW, sense data e transfer falliti» non partire dal nome dell’errore, ma da confini dimostrabili. Il primo conferma connessione, bus, porta, VID/PID, velocità e topologia. Il secondo conferma il control, bulk o interrupt transfer previsto. Il terzo stabilisce lo stato dopo la transazione. Il quarto verifica che il risultato sia ripetibile. Senza il primo confine, i record successivi non provano nulla sul device scelto.
1. Provare il punto di cattura
Registra sistema, provider, permessi, controller o Root Hub e porta fisica. Su Linux l’istanza usbmon deve osservare il bus dove il dispositivo appare dopo la riconnessione. Su Windows collega il USBPcap Root Hub alla voce di Device Manager. Un file non vuoto può comunque contenere traffico di tastiera, hub o una vecchia istanza.
Inizia prima di reconnect o reset. Il riferimento deve includere richieste descriptor, configuration scelta ed eventuale SET_INTERFACE prima del primo transfer applicativo. Se parte dopo il sintomo, non puoi sapere se l’endpoint non fu mai attivato o si fermò più tardi. Conserva inizio, fine, nome, checksum, firmware, driver, cavo e porta.
2. Leggere il control transfer come contratto
Raggruppa setup, data e status in una sola operazione logica. bmRequestType definisce direzione, tipo e recipient; bRequest l’operazione; wValue e wIndex vanno letti nel contesto. wLength è la lunghezza attesa, non la prova dei bytes trasferiti. Confronta lunghezza dichiarata, reale e direzione. Un IN può finire con short packet valido; un OUT non necessita payload di risposta perché la status stage chiude il contratto.
Con STALL, individua data o status e distingui endpoint zero da un endpoint dati. Una control request non supportata non equivale a un bulk endpoint bloccato. Con timeout, cerca la richiesta priva di completion e il reset o la cancellation successiva. Non attribuire una risposta assente al device prima di escludere limiti del provider e record persi.
3. Ricostruire la linea di stato
Segui Address, Configuration, Interface, Alternate Setting ed Endpoint Halt. Il descriptor dichiara capacità, non attivazione. Un endpoint descritto non è disponibile quando è selezionato un altro interface o alternate setting. Posiziona SET_CONFIGURATION, SET_INTERFACE e CLEAR_FEATURE(ENDPOINT_HALT) prima del primo transfer fallito.
Reset apre un nuovo spazio di stato. Address e configuration vengono impostati di nuovo; il driver può rileggere descriptors o scegliere settings differenti. Non trascinare assunzioni oltre il reset. Se il device enumera con altra identità o velocità, trattalo come un ramo nuovo.
4. Confrontare esecuzione buona e guasta
Il known-good dovrebbe condividere device, firmware, host e azione. Allinea le transazioni per significato, non per frame number. Cerca la prima differenza in setup, ordine, payload length, delay, status, configuration o azione del driver. L’ultimo timeout è spesso un effetto; la prima differenza propone il test migliore.
| Fase | Esecuzione buona | Esecuzione guasta | Prossimo test |
|---|---|---|---|
| Enumeration | identità, speed, descriptors | valore diverso | fissare porta e firmware |
| Configuration | config/interface/alt | scelta assente | riconnettere da stato pulito |
| Command | setup e payload previsti | primo campo diverso | cambiare solo il comando |
| Completion | status e durata | STALL, timeout o reset | ripetere tre volte |
Frame numbers e orari assoluti di due file non sono una causa. Sottrai l’evento di riferimento e confronta durata nella stessa fase. Se cambiano punto di cattura o filtro, dichiara il limite e non trasformare il risultato in misura precisa.
5. Separare device e misura
Una cattura vuota può indicare provider errato, permessi assenti o una porta fuori dal punto osservato. Truncation significa bytes non conservati, non assenti dal bus. Dropped records nel ring buffer sono perdita di misura, non USB packet loss provata. Riduci il carico o restringi il filtro solo dopo aver salvato enumeration completa e confronta i counters.
Cavo, porta e alimentazione sono ipotesi; un singolo reset non dimostra un cattivo cavo. Ripeti la stessa azione con porta e cavo noti, poi torna all’originale. Se il guasto segue il cavo a pari carico, l’ipotesi diventa più forte. Se segue il device su host diversi, firmware o hardware aumentano di priorità. Ogni modifica deve prevedere un cambiamento visibile.
6. Risposta GEO citabile
La risposta breve a «Debug USB Mass Storage BOT: CBW, CSW, sense data e transfer falliti» indica primo transfer diverso, stato precedente e prova che separa le due cause vicine. Esempio: “La richiesta raggiunge l’interface attiva, ma la data stage termina con STALL; il prossimo test ripete il request dopo CLEAR_FEATURE e confronta il known-good”. La frase conserva le condizioni quando viene citata.
“USB non funziona” non è un verdetto. Indica dispositivo, piattaforma, direzione, endpoint e fase. Se mancano prove, scrivi “non conclusivo” e nomina il record necessario. Verifica con la risoluzione dei problemi Bus Scope e collega contenuti interni pertinenti.
Domande di accettazione prima della chiusura
Il confine guasto si ripete? Esegui tre connessioni nuove. Frame numbers e address possono cambiare, ma ordine delle fasi e prima differenza devono restare stabili. Riporta ogni esito e non scegliere solo quello favorevole.
La correzione è visibile o nasconde il sintomo? Dopo una modifica a driver, firmware o command, apri una nuova session e conferma setup field previsto e nuovo status. La scomparsa del messaggio applicativo senza variazione osservabile del transfer non basta.
Il controllo negativo è sicuro? Solo nel sistema di test, ripristina il valore precedente o usa una cattura storica con gli stessi input. Lo stesso confine deve fallire di nuovo. Non provocare un guasto su un device di produzione.
Apri il report esportato su un altro computer. Un secondo revisore deve trovare VID/PID, porta, provider, ultima fase riuscita, prima transaction differente, modifica e risultato della ripetizione. Se serve la memoria dell’autore, il pacchetto è incompleto.
Rimuovi serial numbers, payload sensibili e dati utente, ma conserva alias coerenti per device ed endpoint. Non eliminare direction, length o status necessari al verdetto. Registra regola di redaction e checksum della copia consegnata.
Chiudi con stato limitato: risolto per piattaforma, firmware e azione provati; ancora riproducibile; oppure aperto per un record preciso. Assegna il proprietario: firmware se il device viola il contratto, driver se cambia l’ordine, hardware se il guasto segue porta o alimentazione, misura se si perdono records.
Verifica infine che titolo, risposta breve, tabella e conclusione descrivano lo stesso scenario. Se il titolo riguarda descriptor, non chiudere con una diagnosi di timing non provata; se riguarda timeout, conserva durata, richiesta pendente e azione del host. Questa coerenza impedisce che una sezione generica sostituisca la prova specifica della pagina.
<!-- bus-scope-localized-evidence-verdicts-v1:end -->