menurut SMART hard disk tidak rusak, tapi saya punya kesalahan di dmesg


12

Kadang-kadang saya memiliki masalah aneh mem-boot komputer saya (yang menjalankan Debian). Jadi saya mengeluarkan perintah "dmesg". Dalam outputnya saya melihat banyak kesalahan. Namun, ketika saya menjalankan tes SMART yang diperluas pada hard disk (menggunakan perintah "smartctl -t long / dev / sda"), hasilnya adalah disk saya tidak rusak.

Apa yang bisa menjadi alasan kesalahan itu?

Berikut ini kesalahannya:

   (...)
      [  505.918537] ata3.00: exception Emask 0x50 SAct 0x400 SErr 0x280900 action 0x6 frozen
      [  505.918549] ata3.00: irq_stat 0x08000000, interface fatal error
      [  505.918558] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
      [  505.918566] ata3.00: failed command: READ FPDMA QUEUED
      [  505.918579] ata3.00: cmd 60/40:50:20:5b:60/00:00:0b:00:00/40 tag 10 ncq 32768 in
               res 40/00:54:20:5b:60/00:00:0b:00:00/40 Emask 0x50 (ATA bus error)
      [  505.918586] ata3.00: status: { DRDY }
      [  505.918595] ata3: hard resetting link
      [  506.410055] ata3: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
      [  506.422648] ata3.00: configured for UDMA/133
      [  506.422679] ata3: EH complete
      [ 1633.123880] md: bind<sdb3>
      [ 1633.187966] RAID1 conf printout:
      [ 1633.187977]  --- wd:1 rd:2
      [ 1633.187984]  disk 0, wo:0, o:1, dev:sda3
      [ 1633.187989]  disk 1, wo:1, o:1, dev:sdb3
      [ 1633.188866] md: recovery of RAID array md0
      [ 1633.188871] md: minimum _guaranteed_  speed: 1000 KB/sec/disk.
      [ 1633.188875] md: using maximum available idle IO bandwidth (but not more than 200000 KB/sec) for recovery.
      [ 1633.188890] md: using 128k window, over a total of 1943618560k.
      [ 1634.167341] ata3.00: exception Emask 0x50 SAct 0x7f80 SErr 0x280900 action 0x6 frozen
      [ 1634.167353] ata3.00: irq_stat 0x08000000, interface fatal error
      [ 1634.167361] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
      [ 1634.167369] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167382] ata3.00: cmd 60/00:38:00:00:6f/02:00:01:00:00/40 tag 7 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167389] ata3.00: status: { DRDY }
      [ 1634.167395] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167407] ata3.00: cmd 60/00:40:00:02:6f/02:00:01:00:00/40 tag 8 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167413] ata3.00: status: { DRDY }
      [ 1634.167418] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167429] ata3.00: cmd 60/00:48:00:04:6f/02:00:01:00:00/40 tag 9 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167435] ata3.00: status: { DRDY }
      [ 1634.167439] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167451] ata3.00: cmd 60/00:50:00:06:6f/02:00:01:00:00/40 tag 10 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167457] ata3.00: status: { DRDY }
      [ 1634.167462] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167473] ata3.00: cmd 60/00:58:00:08:6f/02:00:01:00:00/40 tag 11 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167479] ata3.00: status: { DRDY }
      [ 1634.167484] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167495] ata3.00: cmd 60/00:60:00:0a:6f/02:00:01:00:00/40 tag 12 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167500] ata3.00: status: { DRDY }
      [ 1634.167505] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167516] ata3.00: cmd 60/80:68:00:0c:6f/00:00:01:00:00/40 tag 13 ncq 65536 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167522] ata3.00: status: { DRDY }
      [ 1634.167527] ata3.00: failed command: READ FPDMA QUEUED
      [ 1634.167538] ata3.00: cmd 60/00:70:80:0c:6f/02:00:01:00:00/40 tag 14 ncq 262144 in
               res 40/00:6c:00:0c:6f/00:00:01:00:00/40 Emask 0x50 (ATA bus error)
      [ 1634.167544] ata3.00: status: { DRDY }
      [ 1634.167553] ata3: hard resetting link
      [ 1634.658816] ata3: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
      [ 1634.672645] ata3.00: configured for UDMA/133
      [ 1634.672696] ata3: EH complete
      [ 1637.687898] ata3.00: exception Emask 0x50 SAct 0x3ff000 SErr 0x280900 action 0x6 frozen
      [ 1637.687910] ata3.00: irq_stat 0x08000000, interface fatal error
      [ 1637.687918] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
      [ 1637.687926] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.687940] ata3.00: cmd 60/00:60:80:a7:af/02:00:02:00:00/40 tag 12 ncq 262144 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.687947] ata3.00: status: { DRDY }
      [ 1637.687953] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.687965] ata3.00: cmd 60/00:68:80:a9:af/02:00:02:00:00/40 tag 13 ncq 262144 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.687971] ata3.00: status: { DRDY }
      [ 1637.687976] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.687987] ata3.00: cmd 60/80:70:80:ab:af/01:00:02:00:00/40 tag 14 ncq 196608 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.687993] ata3.00: status: { DRDY }
      [ 1637.687998] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688009] ata3.00: cmd 60/00:78:00:ad:af/02:00:02:00:00/40 tag 15 ncq 262144 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688015] ata3.00: status: { DRDY }
      [ 1637.688020] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688031] ata3.00: cmd 60/80:80:00:af:af/00:00:02:00:00/40 tag 16 ncq 65536 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688037] ata3.00: status: { DRDY }
      [ 1637.688042] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688053] ata3.00: cmd 60/00:88:80:af:af/01:00:02:00:00/40 tag 17 ncq 131072 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688059] ata3.00: status: { DRDY }
      [ 1637.688064] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688075] ata3.00: cmd 60/80:90:80:b0:af/00:00:02:00:00/40 tag 18 ncq 65536 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688081] ata3.00: status: { DRDY }
      [ 1637.688085] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688096] ata3.00: cmd 60/00:98:00:b1:af/02:00:02:00:00/40 tag 19 ncq 262144 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688102] ata3.00: status: { DRDY }
      [ 1637.688107] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688118] ata3.00: cmd 60/00:a0:00:b3:af/01:00:02:00:00/40 tag 20 ncq 131072 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688124] ata3.00: status: { DRDY }
      [ 1637.688129] ata3.00: failed command: READ FPDMA QUEUED
      [ 1637.688140] ata3.00: cmd 60/00:a8:00:b4:af/01:00:02:00:00/40 tag 21 ncq 131072 in
               res 40/00:ac:00:b4:af/00:00:02:00:00/40 Emask 0x50 (ATA bus error)
      [ 1637.688146] ata3.00: status: { DRDY }
      [ 1637.688154] ata3: hard resetting link
      [ 1638.179398] ata3: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
      [ 1638.192977] ata3.00: configured for UDMA/133
      [ 1638.193029] ata3: EH complete
      [ 1640.259492] md: export_rdev(sdb1)
      [ 1640.326109] md: bind<sdb1>
      [ 1640.346712] RAID1 conf printout:
      [ 1640.346724]  --- wd:1 rd:2
      [ 1640.346731]  disk 0, wo:0, o:1, dev:sda1
      [ 1640.346736]  disk 1, wo:1, o:1, dev:sdb1
      [ 1640.346893] md: delaying recovery of md1 until md0 has finished (they share one or more physical units)
      [ 1657.987964] ata3.00: exception Emask 0x50 SAct 0x40000 SErr 0x280900 action 0x6 frozen
      [ 1657.987975] ata3.00: irq_stat 0x08000000, interface fatal error
      [ 1657.987984] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
      [ 1657.987992] ata3.00: failed command: READ FPDMA QUEUED
      [ 1657.988006] ata3.00: cmd 60/00:90:00:30:2e/03:00:09:00:00/40 tag 18 ncq 393216 in
               res 40/00:94:00:30:2e/00:00:09:00:00/40 Emask 0x50 (ATA bus error)
      [ 1657.988013] ata3.00: status: { DRDY }
      [ 1657.988022] ata3: hard resetting link
      [ 1658.479548] ata3: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
      [ 1658.493107] ata3.00: configured for UDMA/133
      [ 1658.493147] ata3: EH complete
      [ 1670.547791] ata3: limiting SATA link speed to 1.5 Gbps
      [ 1670.547805] ata3.00: exception Emask 0x50 SAct 0x7f SErr 0x280900 action 0x6 frozen
      [ 1670.547812] ata3.00: irq_stat 0x08000000, interface fatal error
      [ 1670.547820] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
      [ 1670.547826] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547839] ata3.00: cmd 60/80:00:00:1f:2e/01:00:0c:00:00/40 tag 0 ncq 196608 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547846] ata3.00: status: { DRDY }
      [ 1670.547852] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547863] ata3.00: cmd 60/80:08:80:20:2e/00:00:0c:00:00/40 tag 1 ncq 65536 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547869] ata3.00: status: { DRDY }
      [ 1670.547875] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547886] ata3.00: cmd 60/00:10:00:21:2e/02:00:0c:00:00/40 tag 2 ncq 262144 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547892] ata3.00: status: { DRDY }
      [ 1670.547896] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547907] ata3.00: cmd 60/00:18:00:23:2e/02:00:0c:00:00/40 tag 3 ncq 262144 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547913] ata3.00: status: { DRDY }
      [ 1670.547918] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547929] ata3.00: cmd 60/00:20:00:25:2e/01:00:0c:00:00/40 tag 4 ncq 131072 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547935] ata3.00: status: { DRDY }
      [ 1670.547940] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547951] ata3.00: cmd 60/00:28:00:26:2e/02:00:0c:00:00/40 tag 5 ncq 262144 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547957] ata3.00: status: { DRDY }
      [ 1670.547961] ata3.00: failed command: READ FPDMA QUEUED
      [ 1670.547972] ata3.00: cmd 60/00:30:00:28:2e/02:00:0c:00:00/40 tag 6 ncq 262144 in
               res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
      [ 1670.547978] ata3.00: status: { DRDY }
      [ 1670.547987] ata3: hard resetting link
      [ 1671.039264] ata3: SATA link up 1.5 Gbps (SStatus 113 SControl 310)
      [ 1671.053386] ata3.00: configured for UDMA/133
      [ 1671.053444] ata3: EH complete
      [ 2422.512002] md: md0: recovery done.
      [ 2422.547344] md: recovery of RAID array md1
      [ 2422.547355] md: minimum _guaranteed_  speed: 1000 KB/sec/disk.
      [ 2422.547360] md: using maximum available idle IO bandwidth (but not more than 200000 KB/sec) for recovery.
      [ 2422.547378] md: using 128k window, over a total of 4877312k.
      [ 2422.668465] RAID1 conf printout:
      [ 2422.668474]  --- wd:2 rd:2
      [ 2422.668480]  disk 0, wo:0, o:1, dev:sda3
      [ 2422.668486]  disk 1, wo:0, o:1, dev:sdb3
      [ 2469.990451] md: md1: recovery done.
      [ 2470.049986] RAID1 conf printout:
      [ 2470.049997]  --- wd:2 rd:2
      [ 2470.050003]  disk 0, wo:0, o:1, dev:sda1
      [ 2470.050009]  disk 1, wo:0, o:1, dev:sdb1
      [ 3304.445149] PM: Hibernation mode set to 'platform'
      [ 3304.782375] PM: Syncing filesystems ... done.
      [ 3307.028591] Freezing user space processes ... (elapsed 0.001 seconds) done.
      (...)

1
Ini bisa terkait dengan SATA atau kabel daya yang buruk, atau mungkin catu daya yang buruk.
Thomas

1
Saya juga melihatnya dengan pengontrol buruk yang membeku dan perlu diatur ulang.
Stephen Harris

1
Saya menambahkan jawaban untuk pertanyaan ini yang mencakup keluaran dmesg yang serupa tetapi tidak identik, misalnya (sd 1: 0: 0: 0: menolak I / O ke perangkat offline dan peringatan EXT4-fs) Saya merasa ini akan membantu orang mencari masalah di Google. . Jawabannya telah dihapus meskipun tidak cocok dengan alasan yang disebutkan di unix.stackexchange.com/help/deleted-answers . Saya memiliki masalah pada SSD yang dipasang di / rumah. Saya mencoba mencabut dan menghubungkan kembali kabel daya dan SATA tetapi kesalahan tetap ada. Untungnya saya punya kabel SATA cadangan. Setelah mengganti kabel SATA saya tidak memiliki kesalahan dan masalah belum terulang kembali.
htaccess

Jawaban:


21

Pertama, perlu diingat bahwa SMART mengatakan bahwa drive Anda sehat tidak selalu berarti drive itu sehat. Laporan SMART adalah bantuan , bukan kebenaran mutlak.

Jika semua yang Anda minati adalah apa yang harus dilakukan, daripada mengapa, maka silakan gulir ke bawah ke beberapa paragraf terakhir; namun, teks sementara akan memberi tahu Anda mengapa menurut saya apa yang saya usulkan adalah tindakan yang benar, dan bagaimana cara mendapatkannya dari apa yang Anda posting.

Dengan mengatakan itu, mari kita lihat apa yang dikatakan salah satu kesalahan itu kepada kita.

[ 1670.547805] ata3.00: exception Emask 0x50 SAct 0x7f SErr 0x280900 action 0x6 frozen
[ 1670.547812] ata3.00: irq_stat 0x08000000, interface fatal error
[ 1670.547820] ata3: SError: { UnrecovData HostInt 10B8B BadCRC }
[ 1670.547826] ata3.00: failed command: READ FPDMA QUEUED
[ 1670.547839] ata3.00: cmd 60/80:00:00:1f:2e/01:00:0c:00:00/40 tag 0 ncq 196608 in
           res 40/00:2c:00:26:2e/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
[ 1670.547846] ata3.00: status: { DRDY }
[ 1670.547852] ata3.00: failed command: READ FPDMA QUEUED

(Saya harap saya mendapatkan bagian-bagian yang harus disatukan, tetapi Anda mendapatkan satu bundel dari itu sehingga tidak apa-apa.)

The Linux ata Wiki memiliki halaman yang menjelaskan cara membaca kesalahan ini . Terutama,

  • Sebuah statusnilai DRDYberarti "Perangkat siap. Biasanya 1, ketika semua OK." Melihat nilai status DRDYsangat normal dan diharapkan.
  • SError memiliki beberapa nilai komponen, yang Anda lihat (dalam cuplikan khusus ini):
    • UnrecovData "Kesalahan integritas data terjadi, antarmuka tidak pulih"
    • HostInt "Kesalahan internal adaptor bus host"
    • 10B8B "Terjadi kesalahan decoding 10b hingga 8b"
    • BadCRC "Kesalahan tautan layer CRC terjadi"

Pengkodean 10b8b, yang mengkodekan 8 bit sebagai 10 bit untuk membantu sinkronisasi sinyal dan deteksi kesalahan, digunakan pada kabel fisik, tidak harus pada drive itu sendiri. Drive kemungkinan besar menggunakan bentuk-bentuk lain dari pengkodean FEC atau ECC, dan kesalahan di sana biasanya akan muncul sebagai beberapa bentuk kesalahan I / O, kemungkinan dengan errornilai UNC("kesalahan yang tidak dapat diperbaiki - sering karena sektor buruk pada disk") , kemungkinan dengan "kesalahan media" ("perangkat lunak mendeteksi kesalahan media") dalam tanda kurung di akhir resbaris. Yang terakhir ini bukan yang Anda lihat, jadi sementara kami tidak bisa sepenuhnya mengesampingkannya, sepertinya tidak mungkin.

"Lapisan tautan" adalah kabel fisik dan jejak papan sirkuit antara pengontrol drive itu sendiri, dan chip antarmuka disk drive (kemungkinan bagian dari southbridge pada motherboard komputer Anda, tetapi dapat ditemukan di HBA offboard).

Adaptor bus host, juga dikenal sebagai HBA, adalah sirkuit yang terhubung ke peralatan penyimpanan. Juga secara sehari-hari dikenal sebagai "disk controller", sebuah istilah yang sedikit keliru dengan sistem modern. Bagian yang paling terlihat dari HBA umumnya adalah port koneksi, paling sering belakangan ini baik SATA atau faktor bentuk SAS.

The UnrecovDatadan HostIntbendera pada dasarnya memberitahu kita bahwa "sesuatu hanya pergi mengerikan salah, dan tidak ada cara untuk memulihkan atau tidak ada upaya pemulihan dibuat". Sebaliknya mungkin RecovData, yang menunjukkan bahwa "kesalahan integritas data terjadi, tetapi antarmuka pulih". (Sebagai tambahan, saya mungkin akan menggunakan HBAIntsebagai ganti HostInt, karena "tuan rumah" mengacu pada HBA, bukan keseluruhan sistem.)

Kombinasi 10B8Bdan BadCRC, yang keduanya mengarah ke lapisan tautan fisik, membuat saya curiga ada masalah pemasangan kabel.

Kecurigaan ini juga didukung oleh fakta bahwa swa-uji SMART, yang sepenuhnya internal untuk drive kecuali untuk pelaporan status, tidak menemukan kesalahan yang dirasakan produsen cukup serius untuk menjamin pelaporan dalam hasil. Jika drive mengalami masalah dalam menyimpan atau membaca data, swa-uji SMART yang panjang khususnya harus melaporkan hal itu.

TL; DR:

Hal pertama yang akan saya lakukan adalah mencabut dan memasang kembali kabel SATA di kedua ujungnya; mungkin sedikit longgar, menyebabkan kehilangan kontak listrik sebentar-sebentar. Lihat apakah itu menyelesaikan masalah. Bahkan mungkin layak melakukan ini untuk semua pemasangan kabel SATA di komputer Anda, bukan hanya disk yang terpengaruh. Jika Anda menggunakan HBA off-board, saya juga akan melepas dan duduk kembali kartu itu, terutama karena itu adalah hal yang mudah untuk dicoba saat Anda sudah bermain-main dengan kabel.

Jika gagal, coba buang dan ganti kabel SATA, lebih baik dengan kabel berkualitas tinggi. Kabel berkualitas tinggi akan sedikit lebih mahal, tetapi saya menemukan bahwa biasanya sepadan dengan biaya tambahan kecil jika itu membantu menghindari sakit kepala seperti ini. Tidak ada yang suka melihat kesalahan memuntahkan penyimpanan mereka!


2
Saya mencabut dan memasang kembali kabel SATA dan itu memecahkan masalah. Terima kasih!
user983447

@ user983447 Senang saya bisa membantu!
CVn

0

Dalam kasus saya, saya perhatikan bahwa saya telah memasang dua disk pada dua pengontrol disk yang berbeda: Yang pertama adalah PCI-Express dan PCI normal kedua. Saya menyingkirkan kesalahan BadCRC ketika saya menghubungkan kedua disk RAID pada pengontrol yang sama.


1
Jadi ketika controller itu mati, dibutuhkan kedua disk dengannya?
roaima

Ya, tetapi kemungkinan besar disk tersebut mati daripada pengontrolnya. Juga, itu akan menjadi ide yang lebih baik untuk TIDAK menggunakan PCI-controller, tetapi PCI-Express -controller berkecepatan tinggi.
PHZ.fi-Pharazon
Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.