Informacija
iBiblioteka
DUK

Atvirai prieinami lietuvių kalbos šnekos atpažinimo modeliai „Ąžuolas“

Atvirai prieinami lietuvių kalbos šnekos atpažinimo modeliai „Ąžuolas“

Norime pasidalyti Ąžuolyno bibliotekos naujiena – tikimės, jog šis modelis pravers Jūsų komandos veikloje.

Biblioteka šiais metais parengė atvirus lietuvių kalbos automatinio šnekos atpažinimo modelius „Ąžuolas v1“ ir „Ąžuolas v2“. Jie skirti garso ir vaizdo įrašų lietuvių kalba pavertimui tekstu ir gali būti pritaikomi, pavyzdžiui, renginių, paskaitų, interviu, garso archyvų ar kitos garso ir vaizdo medžiagos transkribavimui.

Modeliai apmokyti naudojant beveik 10 000 valandų Vilniaus universiteto ir projekto „LIEPA-3“ lietuviškų garso įrašų. „Ąžuolas v1“ sukurtas „Whisper-large-v3“ pagrindu, o „Ąžuolas v2“ – „Qwen3-ASR 1.7B“ pagrindu. „Ąžuolas v2“ yra kompaktiškesnis modelis, pritaikytas greitesniam darbui ir gali būti naudojamas, pavyzdžiui, su nemokama subtitravimo programa „Subtitle Edit“.

Modeliai platinami pagal CC BY 4.0 licenciją ir yra prieinami „Hugging Face“ platformoje. Juos galima naudoti savo reikmėms, laikantis licencijos sąlygų.

„Ąžuolo“ modeliai gali būti aktualūs dirbantiems su lietuviška garso ir vaizdo medžiaga – nuo renginių ar paskaitų įrašų iki kultūros paveldo ir archyvinių garso įrašų. Automatinė transkripcija gali padėti greičiau parengti tekstinę įrašų versiją, ją toliau redaguoti, analizuoti ar pritaikyti subtitrams.

Modelius ir jų naudojimo informaciją rasite čia:

„Ąžuolas v1“ – „Hugging Face“

„Ąžuolas v2“ – „Hugging Face“