- Galvenais dīvaino simbolu iemesls subtitros ir kodēšanas konflikts starp SRT failu un atskaņotāju.
- Subtitru kodējuma maiņa (UTF-8, UTF-8 ar BOM vai ANSI) parasti novērš kļūdas diakritiskajās zīmēs, ñ un īpašajos simbolos.
- Atskaņotājs un ierīce ietekmē subtitru attēlošanu un var pat ignorēt papildu stilus un pozīcijas.
- Izmantojot vienkāršus redaktorus, piemēram, Notepad, varat ātri novērst lielāko daļu problēmu, neizmantojot sarežģītus rīkus.
Ja kādreiz esat skatījies TV pārraidi vai filmu un subtitros sāka parādīties dīvaini simboli, salauzti diakritiskie punkti vai burts "ñ" tika aizstāts ar dīvainām rakstzīmēm , neuztraucieties, jūs neesat viens. Tā ir viena no visbiežāk sastopamajām problēmām, lejupielādējot subtitrus vai izmantojot SRT failus ar dažādiem multivides atskaņotājiem.
Labā ziņa ir tā, ka gandrīz vienmēr to var atrisināt, pielāgojot ļoti specifisku iestatījumu: subtitru faila kodējumu vai to, kā atskaņotājs tos interpretē. Veicot dažas vienkāršas izmaiņas, dažu minūšu laikā varat redzēt dialoglodziņu ar diakritiskajām zīmēm, jautājuma zīmēm, "ñ" un īpašajiem simboliem tā, kā tiem vajadzētu parādīties jau no paša sākuma.
Kāpēc subtitri parādās ar dīvainiem simboliem vai neparādās vispār?
Lai izprastu problēmu, ir svarīgi zināt, ka SRT fails ir vienkārši teksta fails ar ļoti vienkāršu formātu : rindiņu numuri, laika zīmogi un apakšvirsraksta teksts. Vienīgās lietas, kas to atšķir no parasta .txt faila, ir .srt paplašinājums un informācijas organizēšanas veids.
Problēma rodas, kad tiek izmantota rakstzīmju kodēšana . Pastāv dažādi standarti (ANSI, UTF-8, UTF-16, "UTF-8 ar BOM" utt.), kas nosaka, kā katrs burts, simbols vai diakritiskais simbols tiek saglabāts failā. Ja apakšvirsraksts ir saglabāts vienā kodējumā un atskaņotājs mēģina to lasīt tā, it kā tas būtu citā, bēdīgi slavenās dīvainās rakstzīmes parādās tur, kur vajadzētu būt diakritiskajiem simboliem, tildēm vai pieturzīmēm.
Spāņu valodā tas ir ļoti pamanāms ar tādiem burtiem kā ñ un akcentētajiem patskaņiem . Vārda "canción" (dziesma) vietā var redzēt kaut ko līdzīgu "canción" vai "español" (spāņu valodā), vai pat kvadrātus, rombus vai jautājuma zīmes. Tā ir tipiska pazīme, kas liecina par konfliktu starp faila kodējumu un to, ko atskaņotājs sagaida.
Mūsdienās subtitriem parasti ir UTF-8 formāts, jo tas ir mūsdienīgs standarts, kas bez problēmām atbalsta gandrīz visas valodas un simbolus. Tas labi darbojas ar lielāko daļu mūsdienu multivides atskaņotāju, piemēram, VLC , straumēšanas pakalpojumiem, teksta redaktoriem un operētājsistēmām. Labi izveidoti subtitri parasti būs UTF-8 formātā un lieliski tiks attēloti jaunākajos datoros un lietojumprogrammās.
Dažos īpašos gadījumos, īpaši ar vecākām programmām vai neparastām konfigurācijām, spēlētājs sagaida, ka fails būs kodēts ne tikai UTF-8 formātā, bet arī ar nelielu atzīmi sākumā, ko sauc par BOM (Byte Order Mark — baitu secības atzīme) . Saglabājot failu kā "UTF-8 ar BOM", mēs pievienojam šo sākotnējo parakstu, kas dažiem spēlētājiem ir nepieciešams, lai pareizi noteiktu kodējumu.
No otras puses, pastāv ANSI — vecāks un ierobežotāks kodējums, kas ir ļoti atkarīgs no sistēmā konfigurētās valodas vai reģiona. Daudzi vecāki atskaņotāji vai novecojusi televizoru programmaparatūra joprojām sagaida ANSI subtitrus, un, ja tiem piešķirat UTF-8 failu, tie to nepareizi interpretē, kā rezultātā rodas tipiski bojātas rakstzīmes, piemēram, diakritiskās zīmes un "ñ".
Svarīgi saprast, ka nav vienas opcijas, kas derētu visam. Atkarībā no atskaņotāja, programmas versijas un pat operētājsistēmas, labākā opcija varētu būt UTF-8, UTF-8 ar BOM vai ANSI . Tāpēc risinājums parasti ietver divu vai trīs variāciju izmēģināšanu, līdz atrodat tādu, kas atkal liek subtitriem parādīties pareizi.

Kā soli pa solim labot subtitrus ar dīvainām rakstzīmēm
Ātrākais un universālākais veids, kā labot bojātus subtitrus, ir atvērt SRT failu ar vienkāršu teksta redaktoru (piemēram, Notepad operētājsistēmā Windows) un saglabāt to vēlreiz, mainot kodējumu. Nav nepieciešams rediģēt dialoglodziņu rindas vai pielāgot laiku, vienkārši mainiet to, kā tas tiek saglabāts iekšēji.
Operētājsistēmā Windows standarta process būtu apmēram šāds: novietojiet kursoru virs .srt faila, ar peles labo pogu noklikšķiniet uz faila un izvēlieties "Atvērt ar" → Notepad . Tiks parādīts viss saturs: rindu numuri, laiki un dialoglodziņš. Jums nekas nav jārediģē iekšpusē, ja vien nevēlaties labot drukas kļūdu.
Kad esat atvēris SRT failu programmā Notepad, dodieties uz Fails → Saglabāt kā… . Parādītajā logā papildus nosaukumam un mērķa mapei redzēsiet nolaižamo izvēlni ar opciju "Kodēšana". Tur slēpjas visa procesa atslēga.
Pirmais loģiskais tests ir saglabāt failu UTF-8 kodējumā . Ja tas jau ir atlasīts, varat mēģināt to mainīt uz ANSI un, ja jūsu redaktors to atļauj, uz "UTF-8 ar BOM". Ir ļoti noderīgi pievienot kaut ko faila nosaukumam, piemēram, "Subtitri-UTF8.srt" vai "Subtitri-ANSI.srt", lai jūs zinātu, kuru versiju testējat savā atskaņotājā.
Pēc faila saglabāšanas ar jauno kodējumu vienkārši atkārtoti ielādējiet subtitrus atskaņotājā un pārbaudiet, vai diakritiskās zīmes, burts ñ un speciālie simboli tagad tiek parādīti pareizi. Ja tie joprojām tiek parādīti nepareizi, atkārtojiet procesu, izmēģinot citu kodējumu, līdz atrodat tādu, kas darbojas jūsu konkrētajā ierīcē.
Ko darīt, ja diakritiskās zīmes un ñ turpina nederēt?
Dažos gadījumos pat pēc kodējuma maiņas joprojām pastāv problēmas ar diakritiskajām zīmēm, apgrieztām jautājuma zīmēm vai burtu ñ . Tas parasti norāda uz konkrētu neatbilstību starp to, ko spēlētājs sagaida, un precīzo veidu, kā teksta redaktors saglabā failu.
Ja saglabāšana UTF-8 formātā situāciju neuzlabo, ir vērts izmēģināt opciju "UTF-8 ar BOM" , kas kļūst arvien nepieciešamāka noteiktās programmās. Daži multivides atskaņotāji, ja tie faila sākumā neatrod BOM, pieņem, ka rakstzīmes ir citā kodējumā vai jauc iekšējos iestatījumus, un tas izraisa bojātas rakstzīmes.
Var notikt arī pretējais: sākotnējais subtitru fails var būt pareizi formatēts UTF-8, bet jūsu vecākais atskaņotājs varētu sagaidīt ANSI failus, kas konfigurēti spāņu valodai . Šādos gadījumos faila konvertēšana uz ANSI, izmantojot teksta redaktoru, ļaus atskaņotājam pareizi interpretēt diakritiskās zīmes un burtu ñ.
Vēl viens noderīgs padoms ir salīdzināt, kuras ierīces subtitrus attēlo pareizi un kuras ne. Ja datorā ar modernu atskaņotāju, piemēram, VLC vai līdzīgu, viss izskatās perfekti, bet televizorā vai vecākā atskaņotājā parādās dīvaini simboli, visticamāk, jums būs jāģenerē ANSI SRT kopija tieši šai ierīcei.
Tomēr, ja fails jau no paša sākuma izskatās slikti dažādos atskaņotājos un platformās, iespējams, SRT fails jau no paša sākuma tika saglabāts nepareizi (piemēram, rediģēts kodējumā, kas neatbalsta spāņu rakstzīmes). Šādā gadījumā, iespējams, būs jāpārskata fails ar modernāku redaktoru, kas skaidri parāda tā kodējumu un ļauj to konvertēt bez zudumiem.
Atskaņotāja un ierīces ietekme uz subtitriem
Problēma ne vienmēr ir saistīta ar pašu failu: bieži vien problēmu rada atskaņotājs vai lietotne, kuru izmantojat video skatīšanai . Katra programma savā veidā interpretē teksta kodējumu, subtitru stilus un pat to pozīciju ekrānā.
Modernās sistēmās, atjauninātos atskaņotājos un populārās lietotnēs parasti ir laba saderība ar UTF-8 un subtitriem, kas iegulti MKV, MP4 vai līdzīgos video failos . Tomēr dažos viedtelevizoros vai uztvērēju lietotnēs (tipiskās TV "lietotnes uztvērējā") atbalsts ir daudz ierobežotāks, un tās uzspiež savu teksta attēlošanas veidu.
Tas ir īpaši acīmredzami anime, fanu subtitru vai subtitru "zīmēm un dziesmām " gadījumā , kur tekstam ir jāparādās blakus japāņu zīmēm, jāpārklāj attēls vai jāpaliek ekrānā, kamēr zīme joprojām ir redzama. Daudziem no šiem subtitriem ir precīzi definēti stili un pozīcijas failā.
Kad atskaņotājs nolemj ignorēt šos stilus un uzspiest savus, rezultātā subtitri sakrājas augšpusē, pārklājas, mirgo vai pārāk ātri pazūd . Pats fails varētu būt pilnīgi labs un labi izskatīties sarežģītākos atskaņotājos, taču konkrētā lietotne neievēro savus iestatījumus.
Diemžēl šādos gadījumos pašā SRT failā parasti nav brīnumrisinājuma, it īpaši, ja problēma ir saistīta ar ierīces subtitru programmu vai lietojumprogrammu . Dažreiz situāciju var nedaudz uzlabot, konvertējot subtitru veidu (piemēram, no uzlabotā formāta uz vienkāršu SRT), taču, ja uztvērējs uzstāj uz noteiktu stilu piespiešanu, visefektīvākais risinājums parasti ir mainīt atskaņotājus vai nosūtīt saturu uz televizoru citā veidā.
Īpašie simboli subtitros: &, %, @ utt.
Papildus klasiskajām problēmām ar diakritiskajām zīmēm un tildēm, pastāv vēl viena problēma, kas bieži vien satrauc tulkotājus un subtitru redaktorus: tādu īpašu simbolu kā &, $, %, @, # un līdzīgu rakstzīmju lietošana . Jau sen tiek diskutēts par to, vai šīs rakstzīmes var izraisīt kļūdas noteiktos atskaņotājos.
Daudzi sadarbības tulkošanas projekti ieviesa stingrus noteikumus, kas ierobežoja noteiktu simbolu izmantošanu, baidoties, ka tie sabojās subtitrus vecākās ierīcēs. Lietotājiem tika lūgts ziņot par visiem neparastiem simboliem, ko tie iekļāva, lai komanda varētu pārbaudīt, vai nav problēmu, un, ja nepieciešams, tās labot pirms galīgo versiju publicēšanas.
Pēdējo gadu pieredze rāda, ka lielākajā daļā mūsdienu multivides atskaņotāju standarta simboli, piemēram, & vai %, nerada nopietnas kļūdas un tos var izmantot bez nopietnām problēmām, ja vien fails ir pareizi kodēts (galvenokārt UTF-8 vai ANSI, atkarībā no gadījuma). Tomēr joprojām ieteicams tos nelietot pārmērīgi un ievērot pareizrakstības noteikumus.
Atsevišķs jautājums attiecas uz dažiem retāk sastopamiem simboliem, neparastām kombinācijām vai radošiem lietojumiem, kas atšķiras no normas. Tie var izraisīt neregulāru nesaderību, tāpēc daudzas subtitru veidošanas grupas dod priekšroku simbolu lietošanas vadlīnijām , iekļaujot simbolus tikai tad, ja tie sniedz pievienoto vērtību, un uzraugot, vai kāds lietotājs ziņo par kļūdām konkrētos atskaņotājos.
Atšķirīgi bieži tiek aplūkota arī sākuma daudzpunktu izmantošana (ko daži izvēlas lietot katras secības sākumā, lai norādītu uz nepārtrauktību) , jo nav skaidrs, vai tās varētu ietekmēt noteiktas sistēmas, un turklāt tās var vizuāli radīt pārblīvējumu subtitros, nepievienojot lielu vērtību. Šī tēma bieži tiek apspriesta iekšējos pavedienos un forumos, lai lemtu par to atļaušanu, regulēšanu vai aizliegšanu.
MKV failā iegultie subtitri un stili, kas netiek ievēroti
Vēl viens izplatīts scenārijs ir saistīts ar MKV video ar iegultiem subtitriem , kas lieliski tiek rādīti datora atskaņotājā, bet tiek sabojāti, ja tiek nosūtīti uz viedtelevizoru vai konkrētu lietotni. Šādos gadījumos mēs nerunājam tikai par teksta kodēšanu, bet arī par uzlabotiem stiliem un pozicionēšanu.
Daudzi iegultie subtitri, īpaši anime, filmās ar ekrānā redzamiem titriem vai ļoti vizuālā saturā, izmanto formātus, kas ļauj novietot tekstu noteiktās vietās , mainīt krāsas un izmērus, izmantot īpašus fontus un saglabāt noteiktas līnijas ekrānā, kamēr fonā notiek kas cits.
Ja MKV failu skatāt atskaņotājā, kas atbalsta šos stilus (piemēram, datorā ar programmu, kas pareizi atbalsta formātu), viss tiek parādīts pareizi. Tomēr, nosūtot to pašu failu uz viedtelevizora lietotni, uztvērējs var pilnībā ignorēt stilus un visu konvertēt vienkāršos subtitros , kas centrēti vai sakrauti virsū, ar nepareizu ilgumu un neievērojot sākotnējo nolūku.
Tipiska pazīme ir tāda, ka teksts, kam vajadzētu parādīties blakus japāņu valodas parakstam, viss parādās vienā rindā augšpusē , pārklājas viens ar otru vai uz sekundi mirgo un priekšlaicīgi pazūd. Tas nenozīmē, ka fails ir bojāts, bet gan to, ka atskaņotājs nav paredzēts šāda veida subtitru apstrādei, kā paredzēts.
Šādā situācijā visefektīvākais risinājums ir atrast atskaņošanas metodi, kas saglabā kontroli pār subtitriem : izmantot televizoram pievienotu ārēju atskaņotāju, citu lietotni, kas labāk atbalsta subtitru stilus, vai pat konvertēt subtitrus vienkāršākā formātā, ja nepieciešams. Diemžēl, ja televizora lietotne nolemj atspējot subtitru stilus, no paša SRT vai MKV faila maz ko var izdarīt.
SRT kodējuma maiņa, izmantojot Notepad
Atgriežoties pie praktiskās puses, viena no SRT failu lielākajām priekšrocībām ir tā, ka tos var rediģēt ar ļoti vienkāršiem rīkiem, piemēram, Notepad , bez nepieciešamības pēc specializētas subtitru programmatūras. Tas padara kodējuma maiņu par pieejamu procesu jebkuram lietotājam.
Atverot failu programmā Notepad, katrā blokā redzēsiet skaitli, laika diapazonu un vienu vai vairākas teksta rindas. Svarīgi ir nemaināt struktūru, ja vēlaties labot tikai neparastās rakstzīmes: laika maiņa vai skaitļu dzēšana var sabojāt visu failu.
Knifs ir doties tieši uz Fails → Saglabāt kā… un pievērst uzmanību divām lietām: nosaukumam (lai izvairītos no pārrakstīšanas, ja nevēlaties) un nolaižamajai izvēlnei "Kodējums". Tur var izvēlēties starp dažādiem formātiem, parasti ANSI, UTF-8 un, atkarībā no versijas, "UTF-8 ar BOM" vai līdzīgu.
Pirms eksperimentu uzsākšanas ieteicams izveidot oriģinālā subtitru faila dublējumu. Varat saglabāt tādas versijas kā "movie-is-utf8.srt", "movie-is-ansi.srt" vai "movie-is-utf8-bom.srt" un pēc tam izmēģināt katru no tām atskaņotājā, līdz atrodat tādu, kurā diakritiskās zīmes un citas rakstzīmes tiek attēlotas pareizi.
Ja pēc vairākiem mēģinājumiem ar dažādām kodēšanām subtitri joprojām netiek pareizi rādīti konkrētā ierīcē, problēma, visticamāk, ir saistīta ar pašu atskaņotāju vai sistēmas reģionālajiem iestatījumiem . Šādos gadījumos var palīdzēt valodas , reģiona vai subtitru avota iestatījumu pārbaude vai pat programmatūras atjauninājumu meklēšana .
Īsāk sakot, lielāko daļu subtitru kļūdu ar neparastiem simboliem var labot ar pāris ātrām kodēšanas izmaiņām un nedaudz pacietības, izmēģinot dažādas variācijas. Kad esat atradis formātu, ko jūsu parastais atskaņotājs saprot vislabāk, vienkārši atkārtojiet to pašu procesu ar nākamajiem subtitriem, lai uz ilgu laiku aizmirstu par problēmu.
Kaislīgs rakstnieks par baitu pasauli un tehnoloģiju kopumā. Man patīk dalīties savās zināšanās rakstot, un tieši to es darīšu šajā emuārā, parādot visu interesantāko informāciju par sīkrīkiem, programmatūru, aparatūru, tehnoloģiju tendencēm un daudz ko citu. Mans mērķis ir palīdzēt jums vienkāršā un izklaidējošā veidā orientēties digitālajā pasaulē.