Unlimited OCR: AI voor OCR, volledig lokaal op je computer

OCR is een techniek waarmee je tekst uit afbeeldingen en gescande documenten haalt. Je merkt pas hoe belangrijk dat is wanneer je een stapel oude documenten of een compleet boek wilt digitaliseren.
Voor een eigen project moest ik een gescand boek van 390 pagina’s omzetten naar bewerkbare tekst. Dat had ik eerder gedaan met Claude Opus 4.8 via een API. Het resultaat was goed bruikbaar, maar de pagina’s moesten daarvoor naar de cloud en het gebruik van het model kostte geld.
Daarom wilde ik weten of het ook volledig lokaal kon. Zonder kosten per pagina en zonder dat de documenten mijn computer verlaten. Mijn oog viel op Unlimited OCR, een nieuw open OCR-model van Baidu.
Ik installeerde het model met hulp van Claude Code en bouwde er een eenvoudige interface omheen. Hierna startte ik mijn test. Unlimited OCR verwerkte 390 pagina’s in ongeveer 84 minuten. Op de onderzochte aspecten van tekstherkenning deed het lokale model niet onder voor Claude Opus 4.8. Bij aan elkaar geplakte woorden presteerde het zelfs duidelijk beter.
Wat is Unlimited OCR?
Unlimited OCR is een gespecialiseerd AI-model voor het herkennen en structureren van tekst in afbeeldingen en documenten. Het kan onder meer gewone tekst, tabellen, formules en de leesvolgorde van een document herkennen.
Unlimited OCR is gemaakt door onderzoekers van het Chinese technologiebedrijf Baidu en bouwt voort op DeepSeek OCR.
Het model heeft in totaal drie miljard parameters. Dankzij een mixture-of-experts-architectuur worden tijdens de verwerking ongeveer 500 miljoen parameters geactiveerd. Daardoor vraagt het minder rekenkracht dan je op basis van de totale omvang zou verwachten.
Unlimited OCR is ontwikkeld voor lange documenten. Volgens het technische onderzoeksrapport kan het tientallen pagina’s binnen één verwerking uitlezen, waarbij het benodigde geheugen tijdens het genereren niet steeds verder groeit.
Dat betekent niet dat een boek van honderden pagina’s altijd in één keer kan worden verwerkt. De maximale uitvoerlengte is 32.000 tokens. Voor mijn test werden de pagina’s daarom achter elkaar verwerkt.
Hoe goed is Unlimited OCR volgens de makers?
De onderzoekers achter Unlimited OCR testten het model met OmniDocBench, een benchmark voor OCR en documentherkenning.
Unlimited OCR behaalde volgens het technische rapport een totaalscore van 93,23 op OmniDocBench v1.5 en 93,92 op versie 1.6. Op versie 1.5 scoorde het model ruim zes punten hoger dan DeepSeek OCR, waarop Unlimited OCR voortbouwt. Op algemene AI-ranglijsten vind je Unlimited OCR meestal niet terug; die vergelijken vooral generieke taalmodellen. De scores komen uit het technische rapport van de makers zelf.
Die cijfers zijn dus afkomstig van de ontwikkelaars zelf. Bovendien zegt een benchmark niet automatisch hoe goed een model presteert op je eigen documenten. De kwaliteit van de scans, de taal, de opmaak en het soort document hebben allemaal invloed.
Daarom wilde ik het model vooral in de praktijk testen.
Lokaal draaien op één videokaart
Ik installeerde Unlimited OCR op een Windows-computer met een NVIDIA RTX 5080 en 16 GB videogeheugen. Het modelbestand is ongeveer 6,4 GB groot.
Op mijn computer duurt het laden van het model ongeveer zes seconden. Het verwerken van een pagina kostte tussen de drie seconden voor een pagina met weinig tekst en dertien seconden voor een pagina met veel dichte tekst.
De volledige verwerking van 390 pagina’s duurde ongeveer 84 minuten.
Dit zijn metingen van mijn eigen installatie. Op andere computers kunnen de snelheid en het geheugengebruik afwijken.
De installatie vraagt technische kennis. Je hebt een geschikte NVIDIA-videokaart nodig en moet onder meer Python, CUDA en verschillende bibliotheken installeren.
Het is dus nog geen programma dat je eenvoudig downloadt en direct gebruikt.
Claude Code hielp mij bij de installatie en bij het bouwen van een interface in Gradio. De applicatie draait in een webbrowser.
Het OCR-werk zelf wordt uitgevoerd door Unlimited OCR. Wanneer alles eenmaal is geïnstalleerd, is Claude Code niet meer nodig voor het verwerken van documenten.
Met mijn interface kan ik nu:
- een afbeelding uploaden;
- een PDF selecteren;
- een complete map laten verwerken;
- honderden bestanden achter elkaar uitlezen;
- het resultaat opslaan als platte tekst, Markdown of Word-bestand.
Na het eenmalig downloaden van het model en de benodigde onderdelen kan deze opstelling zonder internetverbinding werken.

Mijn interface voor Unlimited OCR
Waarom lokale OCR interessant is
Voor bedrijven heeft lokaal verwerken drie belangrijke voordelen.
1. Documenten blijven op de eigen computer
Contracten, facturen, personeelsdocumenten en andere vertrouwelijke bestanden hoeven niet naar een externe AI-dienst te worden verzonden.
Dat betekent niet automatisch dat een lokale toepassing veilig is of aan de AVG voldoet. Je moet ook de computer, opslag, toegangsrechten, back-ups en verwijdering van bestanden goed regelen. Je voorkomt wel dat documenten voor de OCR-verwerking naar een externe API gaan.
2. Geen gebruikskosten per pagina
Unlimited OCR is beschikbaar onder een MIT-licentie. Dat maakt breed gebruik mogelijk, waaronder commercieel gebruik, zolang je je aan de licentievoorwaarden houdt.
Na installatie betaal je geen bedrag per pagina of token. Volledig kosteloos is lokaal werken natuurlijk niet. Je hebt geschikte hardware nodig en de computer verbruikt stroom. Als je regelmatig grote aantallen documenten verwerkt, kan lokaal werken desondanks voordeliger zijn dan een commerciële API.
3. Geen afhankelijkheid van een externe dienst
Een lokaal model blijft beschikbaar wanneer je internetverbinding wegvalt of wanneer een leverancier zijn prijzen, voorwaarden of modellen verandert.
Daar staat tegenover dat je zelf verantwoordelijk bent voor de installatie, updates en het oplossen van technische problemen.
Mijn praktijktest met 390 pagina’s
Voor de praktijktest gebruikte ik een Engelstalig boek dat ik eerder met Claude Opus 4.8 via een API had laten uitlezen.
Ik liet alle 390 pagina’s opnieuw verwerken met Unlimited OCR. Vervolgens vergeleek ik de twee resultaten. Daarbij keek ik onder meer naar het totale aantal woorden en naar een bekende OCR-fout waarbij de spatie tussen twee woorden verdwijnt. Zo kan of the bijvoorbeeld veranderen in ofthe.
Dit waren de resultaten:
| Onderdeel | Claude Opus 4.8 via API | Unlimited OCR lokaal |
| Verwerkte pagina’s | 390 | 390 |
| Gevonden aan elkaar geplakte woorden | 38 | 2 |
| Totaal aantal woorden | 133.474 | 133.646 |
| Gemeten verwerkingstijd | Niet vastgelegd | Circa 84 minuten |
| Verwerking | In de cloud | Op de eigen computer |
| Gebruikskosten | Betaalde API | Geen kosten per pagina |
Het verschil bij de aan elkaar geplakte woorden is duidelijk. In de uitvoer van Claude vond ik 38 gevallen. In de tekst van Unlimited OCR waren dat er slechts twee.
Bij dit specifieke type OCR-fout leverde Unlimited OCR dus een duidelijk schoner resultaat.
Ook het totale aantal woorden lag dicht bij elkaar. Unlimited OCR produceerde 172 woorden meer, een verschil van ongeveer 0,1 procent.
Een hoger aantal woorden bewijst op zichzelf niet dat een tekst completer is. Unlimited OCR neemt bijvoorbeeld ook terugkerende kopregels en paginanummers over. Daarnaast kwamen enkele herhalingen voor. Bij mijn vergelijking kwamen geen volledig ontbrekende zinnen naar voren.
Op de onderzochte aspecten van tekstherkenning presteerde Unlimited OCR daarmee minstens vergelijkbaar met de eerdere uitvoer van Claude. Dat betekent niet dat Unlimited OCR in iedere situatie beter zal presteren. Deze test betrof één boek met een vrij vaste opmaak.
In een korte test liet ik het model ook Nederlandse tekst met accenten (ë, é, ç) en het euroteken lezen. Het resultaat was foutloos, ook al is het model vooral op Chinees en Engels gebenchmarkt.
Claude volgt instructies beter
Een algemeen AI-model zoals Claude heeft een belangrijk voordeel: je kunt heel precies uitleggen wat het met een pagina moet doen.
Ik kon bijvoorbeeld aangeven dat het model:
- paginanummers en terugkerende kopregels moest weglaten;
- de oorspronkelijke spelling moest behouden;
- onleesbare woorden moest markeren;
- niets aan de inhoud mocht toevoegen;
- geen eigen correcties mocht uitvoeren.
Unlimited OCR is veel minder goed te sturen. Het heeft vooral één taak: de inhoud en structuur van een document zo nauwkeurig mogelijk omzetten.
Daardoor kwamen de paginanummers en terugkerende kopregels ook in de uitvoer terecht. Voor het boek heb ik daarom een opschoonscript toegevoegd dat deze vaste patronen verwijdert.
Bij een boek met een consequente opmaak is dat relatief eenvoudig. Bij documenten met sterk wisselende indelingen kan meer nabewerking nodig zijn.
Af en toe herhaalt het model tekst
Een automatische controle wees aanvankelijk op meerdere herhalingen. Een deel daarvan stond echter daadwerkelijk meermaals in het boek, bijvoorbeeld bij terugkerende aanbevelingsquotes. Uiteindelijk bleef slechts een handvol onterecht herhaalde regels over.
Het probleem was in deze test beperkt, maar het bevestigt dat een kwaliteitscontrole nodig blijft. Dat geldt overigens voor iedere OCR-oplossing.
Lokaal werken heeft scherpe randjes
Bij de installatie en verwerking liep ik ook tegen enkele technische problemen aan.
Op één pagina stond een bijzonder teken in de vorm van een ruit. Daardoor stopte het proces met een onduidelijke foutmelding. De oorzaak bleek niet het OCR-model zelf, maar de manier waarop Windows de herkende tekst probeerde op te slaan. Door de volledige toepassing in UTF-8-modus te laten werken, was het probleem opgelost.
Ook de bestandsverkenner in de eerste versie van mijn interface werkte niet betrouwbaar. Uiteindelijk verving ik deze door de gewone Windows-mapkiezer. Dat bleek eenvoudiger en stabieler.
Dit zijn geen onoverkomelijke problemen, maar ze laten wel een belangrijk verschil zien. Bij een commerciële clouddienst regelt de leverancier een groot deel van de techniek. Bij een lokale installatie moet je dat zelf doen of iemand inschakelen die daarbij kan helpen. In mijn geval gebruikte ik Claude Code.
Wanneer is Unlimited OCR interessant?
Unlimited OCR is vooral interessant wanneer:
- je regelmatig grote aantallen documenten verwerkt;
- documenten vanwege privacy niet naar een externe AI-dienst mogen;
- je over een geschikte NVIDIA-videokaart beschikt;
- de documenten een redelijk vaste structuur hebben;
- je een aanvullende opschoonstap kunt inrichten;
- je geen gebruikskosten per pagina of token wilt betalen;
- je bereid bent de installatie en het onderhoud zelf te regelen.
Een commerciële AI-dienst blijft waarschijnlijk praktischer wanneer je maar af en toe een document verwerkt, geen geschikte hardware hebt of heel specifieke instructies wilt meegeven.
Een combinatie is ook mogelijk. Je kunt Unlimited OCR gebruiken voor de eerste tekstherkenning en daarna een lokaal of online taalmodel inzetten voor het opschonen en structureren van de tekst. Bij vertrouwelijke documenten moet je uiteraard opnieuw beoordelen of verwerking via een externe dienst is toegestaan.
Mijn conclusie na 390 pagina’s
De volledige test bevestigt dat Unlimited OCR geen aardige technische demonstratie is, maar een serieus bruikbare OCR-oplossing.
Het lokale model verwerkte 390 pagina’s in ongeveer 84 minuten. De uitvoer bevatte vrijwel evenveel woorden als die van Claude Opus 4.8. Bij mijn vergelijking kwamen geen volledig ontbrekende zinnen naar voren. Ook de fout waarbij twee woorden aan elkaar worden geplakt, kwam veel minder vaak voor: twee keer tegenover 38 keer.
Daar staat tegenover dat Claude instructies beter opvolgde. Unlimited OCR nam kopregels en paginanummers over en produceerde enkele dubbele regels. Een opschoonscript en een kwaliteitscontrole blijven daarom nodig.
Voor dit boekproject zou ik bij een nieuwe verwerking voor Unlimited OCR kiezen. Niet omdat het model op ieder punt beter is, maar omdat het op de onderzochte aspecten van tekstherkenning minstens vergelijkbaar presteerde, lokaal werkte en geen API-kosten veroorzaakte.
De bredere les is dat je voor een specifieke taak niet altijd het grootste algemene AI-model nodig hebt. Een gespecialiseerd model van drie miljard parameters kan op één consumenten-videokaart honderden pagina’s verwerken en daarbij verrassend dicht in de buurt komen van een groot commercieel model.
Voor bedrijven die veel documenten verwerken of gegevens liever op hun eigen systemen houden, maakt dat lokale OCR een ontwikkeling om serieus te volgen.


Plaats een Reactie
Meepraten?Draag gerust bij!