Μετατροπέας κειμένου σε δυαδικό
Μετατρέψτε κείμενο σε δυαδικό κώδικα και δυαδικό κώδικα ξανά σε κείμενο. Κάθε χαρακτήρας κωδικοποιείται ως UTF-8 και γράφεται ως byte 8 bit, ώστε να λειτουργούν και τονισμένα γράμματα, άλλα αλφάβητα και emoji. Διαχωρίστε τα byte με κενά, κόμματα ή νέες γραμμές ή επικολλήστε bit χωρίς διαχωριστικά. Εκτελείται στον περιηγητή σας.
Είσοδος
Έξοδος
Readme
Τι είναι το κείμενο σε δυαδική μορφή;
Οι υπολογιστές αποθηκεύουν το κείμενο ως αριθμούς. Σε κάθε χαρακτήρα αντιστοιχίζεται ένας αριθμός μέσω μιας κωδικοποίησης και αυτοί οι αριθμοί αποθηκεύονται ως bytes των 8 bits, όπου κάθε bit είναι 0 ή 1. Στα ASCII και UTF-8, το γράμμα H αντιστοιχεί στον αριθμό 72, ο οποίος σε δυαδική μορφή είναι 01001000. Η γραφή κειμένου ως μονάδων και μηδενικών είναι ένας συνηθισμένος τρόπος για τη διδασκαλία του τρόπου λειτουργίας των υπολογιστών, την απόκρυψη ενός μηνύματος σε ένα παζλ ή τη διακόσμηση μιας ανάρτησης.
Περιγραφή εργαλείου
Αυτό το εργαλείο μετατρέπει κείμενο σε δυαδική μορφή και τη δυαδική μορφή ξανά σε κείμενο. Πληκτρολογήστε κείμενο για να δείτε τα bytes του σε δυαδική μορφή ή επικολλήστε δυαδικά δεδομένα για να διαβάσετε το κείμενο. Επιλέξτε αν τα bytes θα διαχωρίζονται με κενά, κόμματα, αλλαγές γραμμής ή καθόλου. Χρησιμοποιήστε το κουμπί εναλλαγής για να αντιστρέψετε το αποτέλεσμα και να το ελέγξετε.
Δυνατότητες
- Μετατροπή κειμένου σε δυαδική μορφή και δυαδικής μορφής σε κείμενο, στο ίδιο σημείο
- Κωδικοποίηση UTF-8, ώστε να υποστηρίζονται τονισμένα γράμματα, κυριλλικά, κινεζικοί χαρακτήρες και emoji, όπως και τα αγγλικά
- Διαχωρισμός των bytes με κενό, κόμμα, αλλαγή γραμμής ή καθόλου
- Ανάγνωση δυαδικών δεδομένων που χωρίζονται με κενά, κόμματα, ελληνικά ερωτηματικά ή αλλαγές γραμμής, καθώς και συνεχόμενων bits χωρίς διαχωριστικά
- Υποστήριξη ομάδων ASCII 7 bit, όπως
1001000, και προθεμάτων0b - Επεξήγηση του προβλήματος όταν η δυαδική μορφή δεν μπορεί να διαβαστεί
Πώς λειτουργεί
Το κείμενο κωδικοποιείται ως UTF-8. Τα αγγλικά γράμματα, τα ψηφία και τα σημεία στίξης καταλαμβάνουν από ένα byte το καθένα, τα τονισμένα και τα κυριλλικά γράμματα καταλαμβάνουν δύο, οι περισσότεροι κινεζικοί και ιαπωνικοί χαρακτήρες καταλαμβάνουν τρία και τα emoji καταλαμβάνουν τέσσερα. Κάθε byte γράφεται ως 8 bits με αρχικά μηδενικά. Κατά την ανάγνωση δυαδικών δεδομένων, κάθε ομάδα ανάμεσα στα διαχωριστικά αντιστοιχεί σε ένα byte. Μια ομάδα με περισσότερα από 8 bits ή bits χωρίς διαχωριστικά χωρίζεται ανά 8 bits. Στη συνέχεια, τα bytes αποκωδικοποιούνται ως UTF-8 και το εργαλείο αναφέρει σφάλμα αν δεν σχηματίζουν έγκυρο κείμενο.
Συμβουλές
- Ένας χαρακτήρας που καταλαμβάνει περισσότερα από ένα bytes στο UTF-8 πρέπει να διατηρείται ολόκληρος. Η διαγραφή ενός από τα bytes του καθιστά τη δυαδική μορφή μη αναγνώσιμη.
- Η δυαδική μορφή από έναν παλιό πίνακα ASCII μπορεί να γράφεται με 7 bits ανά χαρακτήρα. Διατηρήστε τα κενά ανάμεσα στις ομάδες, ώστε κάθε ομάδα να διαβάζεται ως ένας χαρακτήρας.
- Για να εμφανίσετε έναν μεμονωμένο αριθμό σε δυαδική μορφή αντί για κείμενο, χρησιμοποιήστε έναν μετατροπέα βάσης αριθμών.