Apa itu Pendeteksi Karakter Tak Terlihat?

Invisible Character Detector memindai teks Anda untuk menemukan karakter Unicode tersembunyi seperti zero-width space, soft hyphen, dan non-breaking space yang dapat menyebabkan bug dalam kode, merusak operasi salin-tempel, atau menyembunyikan konten berbahaya. Tempel teks apa pun untuk langsung menampilkan setiap karakter tak terlihat beserta nama Unicode dan posisinya.

Detektor memindai enam kategori: karakter lebar-nol (U+200B, U+200C, U+200D), penanda arah (LRM, RLM), pemilih variasi, karakter kontrol, spasi tidak biasa (non-breaking, em-quad, hair), serta karakter tak terlihat langka lain. Setiap hasil menampilkan nama Unicode, kode poin heksadesimal, posisi, dan kategori. Anda dapat menyaring per kategori dan menyalin teks bersih hanya dengan satu klik.

Cara menggunakan

  1. Tempel atau ketik teks Anda di area input — karakter tersembunyi langsung terdeteksi saat Anda mengetik.
  2. Periksa hasil yang disorot yang menampilkan nama Unicode setiap karakter tak terlihat (mis. U+200B Zero Width Space), posisi, dan konteksnya.
  3. Pilih kategori yang ingin dihapus lewat pil filter, lalu klik 'Clean Text'. Setelah selesai, salin atau unduh hasil yang sudah dibersihkan.

Kapan menggunakan

  • Mendebug kode yang memunculkan kesalahan sintaksis tak jelas setelah disalin dari halaman web.
  • Membersihkan input pengguna sebelum disimpan ke basis data.
  • Memeriksa apakah email atau dokumen mencurigakan menyembunyikan homoglif atau Unicode selundupan.

Hasil

Anda menempel potongan kode yang disalin dari situs web yang terus memunculkan syntax error. Detektor menemukan dua zero-width space (U+200B) tersembunyi di antara nama variabel, ditambah tanda right-to-left (U+200F) di akhir baris — semuanya tak terlihat di editor Anda tetapi merusak kompiler.

FAQ

Apa itu spasi lebar-nol dan kenapa bisa merusak kode saya?
U+200B adalah karakter tidak terlihat yang dirancang untuk penataan huruf bahasa Asia. Jika ditempel ke dalam kode, ia berada di antara dua karakter tanpa tampak. Akibatnya 'const foo' bagi kompiler adalah 'const⁠foo', sebuah identifier asing, dan parser langsung gagal.
Apakah karakter tidak terlihat selalu buruk, atau ada yang punya guna sah?
Banyak yang berguna. Penghubung lebar-nol membangun emoji keluarga, pemilih variasi mengganti tampilan emoji, dan spasi non-breaking menjaga nama agar tidak terpotong oleh pemenggalan baris. Detektor mengklasifikasikannya supaya Anda menjaga yang dibutuhkan.
Bisakah karakter tidak terlihat dipakai untuk niat jahat?
Bisa. Email phishing kadang menyisipkan karakter pembalik arah (U+202E) sehingga 'invoice.exe' tampil sebagai 'invocxe.pdf'. Serangan prompt injection juga memanfaatkannya. Cukup jalankan teks lewat detektor dan manipulasi tersembunyi itu langsung terlihat.
Apakah 'Clean Text' menghapus semua karakter tidak terlihat atau hanya kategori tertentu?
Akan menghapus seluruh karakter tidak terlihat yang ditandai detektor sesuai filter yang aktif. Jika kategori 'spasi' dimatikan, spasi tidak biasa tetap dibiarkan. Untuk benar-benar bersih, aktifkan keenam kategori sebelum membersihkan.
Apakah spasi normal dan baris baru saya juga ikut ditandai?
Tidak. Spasi ASCII (U+0020), tab (U+0009), dan baris baru (U+000A/U+000D) memang disaring secara default karena memang diharapkan. Yang muncul hanya varian tak biasa: non-breaking, hair, en-space, dan sejenisnya, agar laporan tetap fokus pada anomali nyata.

Alat terkait