MCEBuddy kan automatisk konvertere billedbaserede undertekster (f.eks. DVB eller indbrændte undertekster) til en tekstundertekst (SRT) ved hjælp af OCR (Optical Character Recognition). Denne funktion kræver, at yderligere filer downloades, fordi OCR-behandling kræver meget store datafiler (~1 GB i størrelse), som ikke kan inkluderes i MCEBuddy-installationsfilen.
MCEBuddy Version 2.7.1 og nyere
OCR-filerne downloades og installeres automatisk, hvis der er en internetforbindelse tilgængelig, efter MCEBuddy-installationen er fuldført.
MCEBuddy Version 2.6.2 til 2.6.6
Under installationen er muligheden for automatisk at downloade og installere de nødvendige OCR-tilføjselsfiler aktiveret som standard. Du kan deaktivere det, hvis du ikke ønsker, at OCR-tilføjselsfilerne downloades og installeres automatisk.
Hvis downloadet mislykkedes på grund af manglende internetforbindelse, eller du ikke valgte automatisk installation under opsætningen, kan du til enhver tid udløse en automatisk geninstallation af OCR-tilføjselsfilerne ved at klikke på linket Install OCR add-on på siden Konverteringsopgave som vist nedenfor:
InstallOCR add-oni grå betyder, at tilføjselsfilerne er installeret. Klik på teksten for at downloade og geninstallere dem (~500 MB download)
Install OCR add-oni rød betyder, at tilføjselsfilerne endnu ikke er installeret. Klik på teksten for at downloade og installere dem (~500 MB download)
Sørg for, at Save subtitles eller Embed subtitles er aktiveret i Konverteringsopgave → Avancerede indstillinger for at udtrække og behandle undertekster ved hjælp af OCR.
MCEBuddy Versioner 2.4.7 til 2.6.1
Du skal manuelt downloade og installere OCR-filerne som beskrevet nedenfor.
Følg nedenstående procedure for at aktivere OCR og konvertering af billeder til tekstundertekster for at udtrække DVB og andre billedbaserede undertekster fra optagelser.
- Download OCR-filerne fra https://github.com/tesseract-ocr/tessdata/archive/3.04.00.zip
- Pak indholdet af zip-filen ud (
tessdata-3.04.00.zip). Det bør oprette en mappe kaldettessdata-3.04.00, inde i hvilken der vil være 100+ traineddata-filer. Sørg for, at der ikke er undermapper. Det bør se sådan ud:tessdata-3.04.00\\<100+ traineddata-filer>- Flyt mappen
tessdata-3.04.00ind i ccextractor-mappen, hvor MCEBuddy er installeret: _\ccextractor_
f.eks. Flyttessdata-3.04.00ind iC:\Program Files\MCEBuddy2x\ccextractor\- Omdøb mappen
tessdata-3.04.00tiltessdata. Vigtigt: Må ikke springe dette trin over, ellers virker OCR ikkeSå din endelige opsætning bør se sådan ud: \ccextractor\tessdata\<100+ traineddata-filer>
f.eks.C:\Program Files\MCEBuddy2x\ccextractor\tessdata\<100+ traineddata-filer>
Sørg for, at du har aktiveret muligheden Extract subtitles and closed captions i dine Konverteringsopgaves avancerede indstillinger, og så er du klar! Det vil udtrække og konvertere billedbaserede undertekster til en tekst-SRT-fil. God fornøjelse!
Versioner ældre end 2.4.7 understøtter ikke OCR
