Pildist tekstiks (OCR)

Muuda pildid redigeeritavaks tekstiks ilma neid kuhugi üles laadimata. Lisa ekraanipilt, dokumendi foto, skaneering või silt ning kohalik OCR-mootor loeb teksti otse sinu seadmes — 20 keeles, sealhulgas mitmekeelsed lehed. Redigeeri tulemust, kopeeri see lõikelauale või laadi alla .txt-failina. OCR-mootor laaditakse alla üks kord esmakasutusel ja pannakse vahemällu; sinu pildid ei lahku kunagi sinu brauserist.

Privaatsus on esikohal: iga pilt töödeldakse kohalikult sinu brauseris. Midagi ei laadita üles, ei salvestata ega edastata ühtegi serverisse.

PixelVault muudab pildid tekstiks OCR-iga, mis töötab täielikult sinu brauseris. Ekraanipildid veateadetest, fotod raamatulehtedest, skaneeritud kirjad, tšekid, sildid, tahvlid — lisa need ja tekst tuleb teisest otsast välja, valitav ja muudetav. Erinevalt tavalistest „pildist tekstiks" saitidest ei laadita midagi üles: tuvastusmootor ise töötab sinu seadmes.

Saadaval on kakskümmend tuvastuskeelt, inglise, hispaania ja saksa keelest araabia, hindi, jaapani, korea ning nii lihtsustatud kui ka traditsioonilise hiina keeleni. Segakeelsete dokumentide jaoks saab korraga lubada kuni kolm keelt. Iga keelepakett on väike ühekordne allalaadimine (umbes 1–3 MB), mille brauser vahemälus hoiab.

Tulemus ilmub muudetavasse tekstikasti koos kindlusskooriga, nii et saad üksikud märgid enne kasutamist parandada. Kopeeri kõik ühe klõpsuga lõikelauale või laadi alla .txt-failina, mis on nimetatud sinu pildi järgi.

Kuidas see töötab

PixelVault kasutab Tesseracti — maailma levinuimat avatud lähtekoodiga OCR-mootorit —, mis on kompileeritud WebAssemblysse, et see saaks töötada brauseris. Esimesel kasutusel laadib see alla mootori (umbes 5 MB) ja valitud keelte treeningandmed — täpne suurus öeldakse enne, kui midagi laaditakse. Pilti analüüsitakse taustalõimes: mootor leiab read ja sõnad, tuvastab märgid oma keelemudeli abil ning tagastab puhta teksti koos kindlushinnanguga. Kõik salvestatakse kohalikku vahemällu, nii et alates teisest korrast töötab see ka võrguühenduseta.

Miks kohalik töötlemine on oluline

Pildid, mida inimesed OCR-ist läbi lasevad, on tavaliselt just tundlikud: lepingud, arved, isikut tõendavad dokumendid, arstikirjad, privaatvestlused. Nende üleslaadimine OCR-teenusesse tähendab, et need dokumendid seisavad vähemalt hetke kellegi teise taristul. Kohalik OCR kõrvaldab selle riski täielikult — pikslid ei lahku sinu masinast ja teises otsas pole teenust, mis logiks, puhverdaks või sinu dokumentidel treeniks.

Toetatud vormingud

  • PNG / JPG — Ekraanipildid ja fotod — kõige tavalisemad OCR-i allikad.
  • WebP / AVIF / BMP / GIF — Kõik sobivad sisendiks.
  • HEIC — iPhone’iga pildistatud dokumendid dekodeeritakse enne kohalikult.
  • TXT — Väljund: puhas tekst, valmis kopeerimiseks või allalaadimiseks.

Levinud kasutusjuhud

  • Kopeeri veateade ekraanipildilt selle asemel, et seda ümber trükkida.
  • Digiteeri trükitud kiri, retsept või raamatulehekülg.
  • Eralda tabel või viitenumber pildistatud tšekilt või arvelt.
  • Võta koosoleku järel slaidilt või tahvlifotolt tekst kätte.
  • Too sotsiaalmeedia piltidelt tsitaadid muudetavasse dokumenti.

Korduma kippuvad küsimused

Kas mu pilt laaditakse teksti eraldamiseks üles?
Ei. Tuvastamine toimub sinu enda seadmes, kasutades Tesseracti OCR-mootori WebAssembly-versiooni. Dokumendid, isikutunnistused, kirjad ja ekraanipildid ei puutu kunagi serveriga kokku.
Miks on olemas ühekordne allalaadimine?
OCR-mootor (≈5 MB) ja iga valitud keele treenitud andmepakett (≈1–3 MB kumbki) peavad jõudma sinu brauserisse üks kord. Suurust näidatakse enne, kui midagi alla laaditakse, ja kõik pannakse kohalikku vahemällu — hilisemad käivitused töötavad kohe, isegi võrguühenduseta.
Milliseid keeli toetatakse?
Kakskümmend: inglise, hispaania, portugali, prantsuse, saksa, itaalia, hollandi, poola, ukraina, vene, türgi, araabia, hindi, indoneesia, vietnami, jaapani, korea, hiina (lihtsustatud ja traditsiooniline) ja eesti. Mitmekeelsete piltide jaoks saad korraga valida kuni kolm.
Kui täpne see on?
Puhaste ekraanipiltide ja skaneeringute puhul väga täpne. Fotod töötavad kõige paremini, kui tekst on terav, hästi valgustatud ja umbes horisontaalne. Iga tulemusega kuvatakse usaldusskoor ja väljund on redigeeritav, nii et saad enne kopeerimist parandada üksikud märgid.
Mida ma saan tulemusega teha?
Eraldatud tekst ilmub redigeeritavasse kasti — kopeeri see ühe klõpsuga või laadi alla .txt-failina, mis on nimetatud sinu pildi järgi.
Kas see suudab lugeda käekirja?
Ei — nagu enamik OCR-mootoreid, on see loodud trükitud ja ekraaniteksti jaoks. Korralikud trükitähed töötavad mõnikord, kuid seotud käekirja ei toetata.