זיהוי טקסט מסריקה (OCR) בעברית
מסמך שנסרק או צולם הוא בעצם תמונה של טקסט — אי אפשר לחפש בו, לסמן ממנו או להעתיק. זיהוי תווים קורא את האותיות מהתמונה ומחזיר טקסט אמיתי, בעברית ובאנגלית.
איך זה עובד
- גררו את המסמך הסרוק או צילום של דף.
- בחרו שפה — עברית, אנגלית או שתיהן יחד.
- קבלו את הטקסט להעתקה, או PDF שאפשר לחפש בתוכו.
שאלות נפוצות
כמה זמן זה לוקח?
כשנייה עד שתיים לעמוד, תלוי במחשב וברזולוציה. בפעם הראשונה נוספת טעינה חד-פעמית של מנוע הזיהוי ומודל השפה, ואחריה הם נשמרים בדפדפן.
מה זה PDF שאפשר לחפש בו?
הסריקה נשארת בדיוק כפי שהיא נראית, ומעליה מונחת שכבת טקסט שקופה. המסמך נראה זהה, אבל אפשר לחפש בו, לסמן ולהעתיק.
הזיהוי מדויק?
על טקסט מודפס וסריקה נקייה התוצאה טובה מאוד. כותרות גדולות ומעוצבות, כתב יד, סריקה עקומה או צילום מטושטש יורידו את הדיוק — כדאי לסרוק ישר וב-300 DPI.
למה זה עובד על עברית כשכלים אחרים לא?
מודל השפה העברית נטען כאן במפורש. בלעדיו המנוע מנסה לקרוא אותיות עבריות כאילו היו לטיניות ומחזיר ג׳יבריש.
הכלי דורש JavaScript, משום שכל עיבוד הקבצים מתבצע בדפדפן שלכם ולא בשרת.
עמודים נוספים