Odprti govorni model za slovenščino
Tehnično poročilo, avgust 2026. Pregled virov, metodologija in izvedbeni načrt za odprt model sinteze govora v slovenščini.
O čem govori poročilo
Slovenščina nima sodobnega, odprto licenciranega modela za sintezo govora. Slepi in slabovidni uporabniki so v praksi vezani na sintetizator eBralec z glasovno bazo iz leta 2015 ali na tuje oblačne storitve.
Poročilo popiše javno dostopne govorne in besedilne vire za slovenščino skupaj z licencami, pregleda sodobne odprte arhitekture in predlaga dvotirno metodologijo: lahek model za delovanje na napravah brez povezave in model studijske kakovosti.
Osrednja ugotovitev je, da glavnina dela ni v modelih, temveč v podatkih. Poročilo podaja izvedbeni načrt v štirih fazah (36 mesecev) in protokol evalvacije, ki standardne metrike dopolnjuje s panelom slepih in slabovidnih ocenjevalcev.
Pripravili: umetnainteligenca.ai (Noctocode d.o.o.) v sodelovanju z Medobčinskim društvom slepih in slabovidnih Nova Gorica.
Kaj lahko danes pričakujete od bralnika
PREBEREM danes uporablja komercialno sintezo govora, ne modela iz poročila. Poročilo opisuje izvedbeni načrt za odprt slovenski govorni model, ne izdanega modela.
- Branje slovenskega besedila z moškim ali ženskim glasom.
- Števila, datumi in kratice se pred branjem prevedejo v besede.
- Izgovorjava tujih imen in redkih kratic je lahko približna.
- Za govor je potrebna internetna povezava; branja brez povezave ni.
Odprite bralnik in preizkusite pripravljeni primer.
Prenesite poročilo
Datoteka PDF, približno 0,6 MB, 10 strani. Povezava se odpre v novem zavihku.