Saya mengambil bit 1mil pertama dari file video acak, dan kemudian untuk setiap byte saya memetakan setiap bit ke bin, misalnya
c_b = ''.join(format(ord(b), '08b') for b in c)
bin1.append(c_b[0])
Kemudian dihitung:
bin1_counted = Counter(bin1)
dan hasilnya adalah:
Counter({'0': 646491, '1': 603686})
Counter({'0': 642133, '1': 608044})
Counter({'0': 644298, '1': 605879})
Counter({'0': 641961, '1': 608216})
Counter({'0': 641778, '1': 608399})
Counter({'0': 640538, '1': 609639})
Counter({'0': 641531, '1': 608646})
Itu jelas menunjukkan distribusi yang sama. Tetapi saya berharap seseorang dapat menjelaskan kepada saya mengapa demikian, dengan asumsi saya bahwa bit pertama dalam setiap byte seharusnya memiliki lebih 0dari 1karena saya berpikir bahwa mungkin ada semacam distribusi lonceng dari setiap byte 'posisi, yaitu saya mengharapkan bit pertama / kedua dari setiap byte memiliki lebih banyak 0karena karakter dapat diwakili sebelum mencapai 64?
ord(b), '08b') for b in c. Saya harus ord()masing - masing karakter berikutnya?