AI & Analytics

Bodhan AI: nieuwe modellen voor OCR, vertaling en spraak

Analytics Vidhya
Bodhan AI: nieuwe modellen voor OCR, vertaling en spraak

Samenvatting

Bodhan AI brengt vier modellen uit voor OCR, vertaling en spraak in Indiase talen.

Bodhan AI en de vier modellen: wat er gebeurt

Bodhan AI en AI4Bharat publiceerden in september 2026 vier modellen voor documentverwerking, vertaling, spraakherkenning en spraakgeneratie. De modellen ondersteunen gemengde talen en schriften, zoals een Hindi-les met Engelse leenwoorden, gescande tabellen en handgeschreven vergelijkingen.

IndicOCR zet pagina-afbeeldingen om in gestructureerde tekst. IndicDocLayout, een model van 33 miljoen parameters, herkent paginablokken en leesvolgorde; IndicBlockOCR gebruikt Qwen3.5-0.8B en een Sarvam-tokenizer voor de tekstherkenning. Vergelijkingen worden LaTeX en tabellen behouden hun structuur. Het model verwerkt gedrukte documenten in het Engels en de 22 geplande Indiase talen, plus handschrift in het Engels en 12 Indiase talen.

Indic-Translate vertaalt volledige documenten en gebruikt een fine-tune van Gemma 4 E4B IT met 4 miljard effectieve parameters en een context van 32K. Indic-Transcribe biedt een Core- en Flexible-variant. Indic-Speak genereert spraak met 45 stemmen.

Waarom de vier Bodhan AI-modellen belangrijk zijn

De modellen behandelen een volledige keten: van pagina en tekst naar vertaling, transcriptie en gesproken output. Dat maakt het onderscheid met een losse OCR- of vertaaltool concreet. Mogelijke toepassingen die de bron noemt zijn het digitaliseren van studieboeken, het doorzoekbaar maken van regionale archieven en het voorbereiden van gescande pagina’s voor RAG.

De benchmarks vragen om een zorgvuldige lezing. IndicOCR behaalt 92,76 op OmniDocBench v1.6 en 82,20 op het Engelse olmOCR-Bench-subset. De interne IndicOCR-Printed-benchmark meldt 86,2 procent woordnauwkeurigheid over 22 Indiase talen en Engels. Die scores meten verschillende onderdelen; de Engelse documentparsing-score bewijst niet dat elke Indiase taal dezelfde nauwkeurigheid haalt.

Concrete takeaway voor Bodhan AI

Test elk model op je eigen documenten en taalcombinaties. Controleer bij IndicOCR afzonderlijk tekstherkenning, leesvolgorde, tabellen en handschrift, en baseer modelkeuzes niet op één benchmarkscore.

Lees het volledige artikel
Meer over AI & Analytics →