Apa yang Kami Deteksi
Teks Gambar (OCR)
Ekstrak dan analisis teks dari gambar, tangkapan layar, dan foto.
Kode QR
Dekode kode QR untuk mengungkap tautan tersembunyi dan konten spam.
Tangkapan Umum
- Gambar penipuan crypto dengan alamat dompet
- Kode QR yang mengarah ke situs phishing
- Gambar promosi dengan teks spam
- Tangkapan layar pesan spam
Bagaimana teks dan kode ditarik keluar dari gambar
Spammer memindahkan muatan mereka ke dalam gambar justru untuk menghindari filter teks, jadi Telm membaca gambar juga. Setiap gambar melewati OCR — optical character recognition — untuk mengekstrak teks apa pun yang dikandungnya, entah itu alamat dompet dalam grafik penipuan kripto, promo yang ditulis di atas foto, atau tangkapan layar pesan spam. Secara paralel, setiap kode QR didekode untuk mengungkap link yang tersembunyi di dalamnya, sering kali tujuan phishing atau malware yang tidak pernah ditampilkan gambar dalam teks biasa. Teks yang diekstrak dan link yang didekode kemudian dialirkan kembali melalui alur yang sama yang menilai pesan biasa, sehingga spam gambar dinilai berdasarkan kontennya yang sebenarnya.
Ini menutup celah yang jelas pada pertahanan berbasis teks saja dan bekerja otomatis pada setiap gambar, berdampingan dengan hashing gambar perseptual yang mengenali gambar yang pernah dilihat bahkan setelah sedikit dienkode ulang. Pengenalan mencakup delapan bahasa — Inggris, Rusia, Jerman, Prancis, Spanyol, Tionghoa, Jepang, dan Korea — dan di situlah batas jujurnya: OCR tidak sempurna pada font bergaya berat, teks terdistorsi, atau gambar beresolusi sangat rendah, dan aksara di luar rangkaian itu tidak akan ditranskripsi. Ia adalah lapisan tambahan yang kuat, bukan jaminan bahwa tidak ada teks yang bisa disembunyikan dalam gambar, itulah sebabnya ia mengalir ke alur yang lebih luas alih-alih memutuskan sendiri.
Pertanyaan yang sering diajukan
Apakah memindai setiap gambar memperlambat grup saya atau membebani biaya?
Pemindaian berjalan otomatis di latar belakang saat gambar tiba; anggota tidak perlu menunggunya untuk tetap mengobrol. Ini bagian dari alur perlindungan, bukan tambahan berbayar terpisah. Hashing gambar perseptual juga memungkinkan gambar yang sudah pernah dilihat dan dinilai dikenali kembali dengan cepat, sehingga gambar spam berulang tidak perlu masing-masing dianalisis ulang secara penuh.
Apakah OCR akan salah membaca gambar normal dan menandai postingan tak bersalah?
OCR hanya mengekstrak teks; ia tidak memutuskan sendiri. Kata-kata yang diekstrak dan link QR mana pun yang didekode dilewatkan melalui alur deteksi yang sama seperti pesan biasa, sehingga meme tak berbahaya yang berteks dinilai berdasarkan apa yang sebenarnya dikatakan teks itu. Seperti semua deteksi, keputusan ambang batas dicatat dan bisa ditinjau, dan Anda bisa mengamatinya dalam Mode Pemantauan sebelum penegakan aktif.
Bahasa apa saja yang sebenarnya bisa dibacanya?
Pengenalan mencakup delapan bahasa: Inggris, Rusia, Jerman, Prancis, Spanyol, Tionghoa, Jepang, dan Korea. Teks dalam bahasa di luar rangkaian itu tidak akan ditranskripsi dengan andal, dan font bergaya berat, huruf terdistorsi, atau tangkapan layar beresolusi sangat rendah bisa mengalahkan OCR — itu salah satu alasan ia bekerja sebagai lapisan yang mengalirkan ke alur yang lebih luas alih-alih filter mandiri.
Bisakah spammer mengalahkan OCR dengan mendistorsi teks dalam gambar?
Kadang — teks yang sengaja dibengkokkan atau berderau justru yang menyulitkan OCR, dan spammer yang gigih bisa menurunkan kualitas gambar untuk mengganggu pengenalan. Itulah sebabnya OCR tidak berdiri sendiri: dekode QR menangkap link yang disembunyikan sebagai kode, hashing perseptual menangkap gambar yang dipakai ulang, dan alur AI menilai teks apa pun yang berhasil dipulihkan, sehingga mengalahkan satu lapisan tidak melewati semuanya.
Fitur Terkait
Jelajahi lebih banyak cara Telm dapat membantu komunitas Anda