Simpatie.ro - matrimoniale
Forum Romania Inedit
Romania Inedit - Resursa ta de Fun
Nou pe simpatie:
bella_sexy
Femeie
25 ani
Bucuresti
cauta Barbat
27 - 48 ani
Forum Romania IneditReguliInregistrareLoginPozeNu sunteti logat. Lista Forumurilor Pe Tematici
Forum Romania Inedit / Totul despre cărți - About e-books /

AutoCorect - reactualizare

Pagini:  1 2 3 4 5 6 7 ... 15 Moderat de Seven, Stelevadris, cuculean, naid, uncris
#76
Seven
Moderator
Din: Ţara Perfectului Simplu

          AUTOCORECT STANDARD - PRIMA INSTALARE


     AutoCorect OCR Plus nu se instalează ca atare, ci este o îmbunătăţire a programului AutoCorect standard.

     Mai întâi se instalează AutoCorect standard în varianta Contemporan sau Clasic.
     Programul este liber şi se poate downloada de pe pagina web de la adresa:
                 http://www.softset.ro/download_ac.html

      Trebuie să facem o descărcare a programului complet şi nu pe componente.

      INSTALAREA AUTOCORECT STANDARD

      Instalarea AutoCorect se face, ca orice program, în folderul Program Files [Fişiere program].
      Folderul sub care se instalează se va numi AutoCorect Contemporan sau AutoCorect Clasic, în funcţie de varianta aleasă.
      Notă: Se pot instala şi ambele variante.

      Folderul de instalare  AutoCorect Contemporan [Clasic] cuprinde 2 subfoldere şi 5 fişiere:
              - Subfolderul Dex în care se află 4 fişiere: dexb.dic, dexb.len, dexd.dic, dexd.len
              - Subfolderul Dictionare în care se află 55 de fişiere
              - Fișierele: AutoCorect.chm, AutoCorect.exe, AutoCorect.xlm, unins000.dat, unins000.exe

       Atenție! În subfolderul Dex și Dictionare se află fișiere ale dicționarelor DEX și alte dicționare ale limbii române și sunt necesare în funcționarea AutoCorect standard, în special pentru funcția ortografie.
       Subfolderul Dictionare din folderul de instalare nu are nici în clin, nici în mânecă cu folderul Dictionare în care copiem dicționarele OCR_DIC sau alte dicționare de înlocuire multiplă. Acel subfolder se află în cu totul altă parte, asupra căreia vom discuta în continuare.


       La instalarea AutoCorect în afară de subfolderele şi fişierele din Program Files,mai creează un folder numit după caz "AutoCorect Contemporan" sau "AutoCorect Clasic"în următoarea cale de căutare:

        ■ în Windows XP:
     „C:\Documents and Settings\NUME_USER\Application Data\AutoCorect Clasic
sau
     „C:\Documents and Settings\NUME_USER\Application Data\AutoCorect Contemporan

        ■ în Windows 7, 8, Vista:
     „C:\Users\NUME_USER\AppData\Roaming\AutoCorect Clasic
sau
     „C:\Users\NUME_USER\AppData\Roaming\AutoCorect Contemporan

      Acest folder AutoCorect Contemporan [AutoCorect Clasic] are la instalare un Subfolder
şi două fişiere:
              - Subfolderul Dictionare care iniţial este gol;
              - Fişierele AutoCorect.ini şi ListaDictionare.txt
      Pe parcurs după rulare vor mai apărea şi alte fişiere, precum: RulareAutomataOCRPlus.txt etc. etc.
 
       NOTĂ: în fişierul "ListaDictionare.txt" se va salva lista şi calea de căutare a dicţionarelor setate de noi să ruleze la opţiunea 9, iar în fişierul "RulareAutomataOCRPlus.txt" vor fi salvate opţiunile care rulează în mod automat.
       La fiecare modificare a setărilor, fişierele se modifică şi ele astfel încât să păstreze salvarea ultimelor modificări.

       Să ne întoarcem la subfolderul Dicţionare.
       Acesta este cel care ne interesează în mod special.
       În acest subfolder vom crea cel puţin două subfoldere:
                - Subfolderul OCR_DIC în care vom copia cele 39 de dicţionare care rulează automat.
                - Subfolderul Dictionare UZUALE [acest subfolder poate avea orice alt nume] în care se pun dicţionarele uzuale şi personale, orice alte dicţionare care pot rula automat la opţiunea 9. Se poate crea şi alt folder în care să punem dicţionare create de fiecare user în parte în funcţie de necesităţi care pot fi rulate tot automat la opţiunea 9 ori pot fi rulate fiecare în pşarte atunci când simţim nevoia.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#77
Seven
Moderator
Din: Ţara Perfectului Simplu

          AutoCorect OCR Plus - Actualizare executabil


       
      Deci, avem instalat AutoCorect standard care are folderul de instalare în Program Files  şi un folder pentru dicţionare de înlocuire şi alte dicţionare în AppData [Application Data], conform celor menţionate în postarea precedentă.
      Trebuie să reţinem că executabilul este cel al AutoCorect standard, deci în acest moment poate rula doar programul AutoCorect standard.
       
      Pentru a modifica AutoCorect standard în AutoCorect OCR Plus nu trebuie să facem decât un singur lucru: vom înlocui executabilul  Autocorect.exe din folderul de instalare cu unul din executabilele AutoCorect Plus [Contemporan sau Clasic, după caz] de la adresa:
         http://www.mediafire.com/?f12mry259atv9

      Atenţie! Un executabil AC OCR Plus Contemporan va trebui să înlocuiască numai un executabil AC standard Contemporan; Acelaşi lucru este valabil şi pentru varianta Clasic.
      Diferenţa dintre Contemporan şi Clasic o face nu numai pachetul de dicţionare OCR_DIC , ci şi dicţionarele DEX şi celelalte Dicţionare ale Limbii Române din folderul de instalare, care sunt editate diferit.

     Practic, trecerea la AC standard la AC OCR Plus sau reactualizarea unui executabil OCR Plus se face în următorii paşi:
           - download arhiva care conţine cel mai nou executabil din adresa menţionată mai sus;
           - dezarhivarea executabilului [şi, eventual, redenumirea lui în Autocorect.exe - dacă executabilul are un alt nume; de exemplu este însoţit de data reactualizării];
           - copierea noului executabil peste executabilul vechi.

     Reţinem că nu trebuie să facem o nouă instalare la reactualizarea unui executabil, ci pur şi simplu înlocuim doar executabilul vechi cu unul nou, toate celelalte fişiere rămânând neschimbate.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#78
Seven
Moderator
Din: Ţara Perfectului Simplu

          AutoCorect OCR Plus - Actualizare dicţionarel



      Să ne întoarcem acum la subfolderul Dicţionare din calea:

        ■ în Windows XP:
     „C:\Documents and Settings\NUME_USER\Application Data\AutoCorect Clasic\Dictionare
     „C:\Documents and Settings\NUME_USER\Application Data\AutoCorect Contemporan\Dictionare

        ■ în Windows 7, 8, Vista:
     „C:\Users\NUME_USER\AppData\Roaming\AutoCorect Clasic\Dictionare
     „C:\Users\NUME_USER\AppData\Roaming\AutoCorect Contemporan\Dictionare

   
      În subfolderul Dicţionare va trebui să creăm cel puţin două subfoldere:
            - un subfolder sau mai multe în care vom păstra dicţionarele uzuale şi personale ce pot rula la opţiunea 9. Folderul se poate numi oricum pentru că numele său nu este prevăzut în codul programului în mod special. Subfolderul se poate numi Dic_uzuale, Dic_Suplimentare, Dic_personale etc.. etc...
      menţionez că orice dicţionar de tip "imd" poate fi rulat manual cu opţiunea "Editare" → "Înlocuire multiplă", apoi încărcând dicţionarul dorit.

            - "OCR_DIC" - numele acestui subfolder este prevăzut în cod şi el nu poate fi modificat; aici se vor păstra cele 39 dicţionare; menţionăm că nici numele acestor 39 de dicţionare nu pot fi modificate.
      Primele 35 dicţionare deservesc cele 10 opţiuni şi pot fi rulate automat; de asemenea pot fi rulate doar unele dintre ele acţionând o singură opţiune dintr-un pachet; fiecare dicţionar poate fi rulat manual cu opţiunea "Editare" → "Înlocuire multiplă".
      Ultimele 4 dicţionare [CO_Vt1.imd ÷ CO_Vt4.imd] rulează cu opţiunea "Modificări speciale de text"

      În subfolderul OCR_DIC la această dată pentru programul AutoCorect OCR Plus v 5.1
trebuie să fie un număr de 39 dicţionare;
      Acestea sunt următoarele:

Stergere artefacte [răgălii] aflate oriunde în text
      01. CO_Apco.imd - şterge răgălii în cărţi obişnuite [are 39 de răgălii]
      02. CO_Apct.imd - şterge răgălii în cărţi tehnice [are mai puţine înregistrări decât precedentul]

Stergere automată răgălii care se află numai la începutul paragrafului la sfârşitul paragrafului
      03. CO_Artef.imd

Înlocuiri automate cuvinte întregi
      04-06 CO_CImf1.imd, CO_CImf2.imd, CO_CImf3.imd

Dicţionar care înlocuieşte automat litera mare cu literă mică după semnele ? şi ! în dialog francez.
      07 CO_DFr.imd

Înlocuieşte automat combinaţii de 3-4 puncte şi virgule cu elipsis
      08 CO_Elips.imd

Înlocuiri automate de expresii şi grupuri de cuvinte [ex: partea stingă >> partea stângă]
      09-10 CO_Expr1.imd, CO_Expr2.imd

înlocuieşte automat grupurile "cl" şi "rn" cu literele "d" şi "m" în diverse cuvinte
      11 CO_Gcl.imd
      12 CO_Grn.imd 


Înlocuiri automate în diferite combinaţii şi cuvinte a cifrelor 1 şi 0 cu litera L mic şi O mic.
      13-15 CO_L1.imd, CO_L2.imd, CO_L3.imd

Corectează automat linii de pauză şi linii de dialog
      16 CO_LinD.imd
      17 CO_LinP.imd


Majuscularea automată la început de frază, început de paragraf şi după linia de dialog.
      18 CO_Midp.imd

înlocuiri automate la cuvinte scurte [max 4 litere] cu şi fără cratimă:
      19-22 CO_Sc1.imd, CO_Sc2.imd, CO_Sc3.imd, CO_Sc4.imd 

Modificări automate secvenţe de cuvinte la începutul cuvintelor, la mijloc şi la sfârşit.
      23-24 CO_SInc1.imd, CO_SInc2.imd - secvenţe de început
      25-26 CO_SMed1.imd, CO_SMed2.imd - secvenţe mediane
      27-28 CO_STer1.imd, CO_STer2.imd - secvenţe terminale

Corectează automat unele cuvinte "rupte" la capăt de rând
      29-32 CO_Var1.imd, CO_Var2.imd, CO_Var3.imd, CO_Var4.imd

Corecţii cu CONFIRMARE  de cuvinte secvenţe de cuvinte şi elemente de punctuaţie:
      33-35 CO_Var5.imd, CO_Var6.imd, CO_Var7.imd

Dicţionare care rulează la opţiunea numită "Modificări speciale de text".
      36-39 CO_Vt1.imd, CO_Vt2.imd, CO_Vt3.imd, CO_Vt4.imd

      Notă: Această ultimă opţiune ["Modificări speciale de text"] ca şi celelalte două din final ["Eliminare linii de pauză exclusiv din Dialoguri" şi "Elimină TOATE liniile de pauză din text"], nu rulează automat şi nu este recomandată utilizatorilor obişnuiţi.
      Dicţionarele sunt cu confirmare şi se adresează persoanelor cu multă experienţă care fac modificări speciale de corectură şi care nu fac rularea automată a celor 10 opţiuni.
      Multe dintre modificări sunt deja realizate la rularea automată.

      Opţiunea a fost creată special pentru cei ce doresc să schimbe cuvinte, sensul lor etc. şi, de regulă modifică forme populare ale cuvintelor cu forme literare.
      Opţiunea este recomandată la corectarea de texte oficiale şi nu la corectarea cărţilor de beletristică. În beletristică acest lucru este periculos, deoarece un personaj simplu ar putea ajunge să vorbească într-un mod prea corect, ceea ce ar lăsa cu gura căscată pe însuţi autorul cărţii.

       În imaginea următoare ► Vezi IMG aici sunt evidenţiate cele 10 opţiuni care pot rula automat pentru curăţarea prealabilă a unui OCR şi cele 3 opţiuni suplimentare care nu rulează automat, ci doar fiecare în parte şi care nu sunt recomandate rulării OCR obişnuite, ci doar în cazuri speciale pentru prelucrări de limbă şi de sens al frazei.


      Mai jos redau imaginile a 3 subfolde care conţin dicţionare:

Subfolderul OCR_DIC pe care fiecare utilizator AC OCR Plus trebuie să-l aibă în computer.


Subfolderul cu dicţionare suplimentare [uzuale, personale] care pot rula automat cu opţiunea 9.


Acesta este un subfolder cu dicţionare în lucru:


       Notă: personal fac înregistrări într-un dicţionar numit TEMP.imd apoi mut înregistrările în astfel de dicţionare care pot avea orice nume [în acest caz iniţialele C4L înseamnă cuvinte 4 litere, G2C înseamnă grup două cuvinte. După testări, atunci când am timp distribui înregistrările în dicţionarele uzuale sau în OCR_DIC.

       Şi aceste dicţionare pot fi adăugate în lista care rulează la opţiunea automat, ori pot fi rulate separat prin opţiunea "Editare" → "Înlocuire multiplă"

       Este de preferat ca fiecare user să aibă un folder cu dicţionare în lucru, temporare, personale... deoarece fiecare font cu care a fost tipărit o carte poate crea erori specifice care nu se regăsesc în alte situaţii, fapt pentru care astfel de modificări nu apar în dicţionarele OCR_DIC.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#79
Seven
Moderator
Din: Ţara Perfectului Simplu

          DESPRE DICŢIONARELE AutoCorect OCR Plus



      Câteva cuvinte despre înregistrările din dicţionarele OCR_DIC:

      Există cel puţin două tipuri de dicţionare în folderul Dictionare din AppData:
         - dicţionare de tip "DIC", care au extensia "dic", sunt dicţionare create de program atunci când se face corectură în AutoCorect cu opţiunea Ortografie; aici vor fi înregistrate cuvinte adăugate de utilizator ca fiind cunoscute, cuvinte ignorate etc.
      NOTĂ:  dicţionarele de tip "dic" pot fi deschise cu NotePad şi alte editoare de text.

         - dicţionare de tip "IMD", care au extensia "imd" - de Înlocuire Multiplă;
ca să ne fie mai uşor ne gândim la iniţialele expresiei Înlocuire Multiplă Dicţionar = IMD

      Dicţionarele de tip "imd" nu se pot crea, deschide sau edita decât direct din programul AutoCorect. Ele nu se pot deschide cu NotePad sau alte editoare, aşa cum se poate proceda cu dicţionarele de tip "dic".
      Cu toate acestea, se poate face selectarea unui număr nedefinit de înregistrări consecutive sau "pe sărite" şi ştergerea, copierea, mutarea unor astfel de înregistrări dintr-un dicţionar în altul.
      Se poate face copiere/mutare de înregistrări dintr-un dicţionar "imd" deschis cu AC, într-un fişier deschis cu NotePad şi invers
      Se poate face o operaţiune mai compleaxă de genul AutoCorect - NotePad - Word şi invers: Word - Notepad - AutoCorect. Totuşi, nu recomand prelucrări în Word.
      Cea mai indicată operaţiune de acest gen este  AutoCorect - NotePad - Excel şi Excel- Notepad - AutoCorect. Teoretic funcţionează şi corespondenţa AutoCorect - Excel şi invers, dar apar în mod frecvent erori la mutare.
      Despre toate aceste lucruri vom intra în detalii la capitolul "JONGLERII cu dicţionare de Înlocuire multiplă de tip "imd"

      Toate dicţionarele din OCR_DIC, Dic Uzuale, suplimentare, personale sunt de tip "imd"
      Deci dicţionarele de înlocuire multiplă sunt cele care ne interesează în mod special.

      Sunt foarte multe corecturi posibile care nu se regăsesc în dicţionarele OCR_DIC.
      Principiul de bază pentru înregistrările din OCR_DIC este ca modificările să nu producă efecte secundare.

      De exemplu: frecvent cuvântul "mai" este recunoscut în mod eronat de Abbyy sub forma "mal". Nu vom putea face o înregistrare automată de genul "mal >> mai" deoarece vor fi modificate şi cuvintele care în mod real sunt "mal" cu sensul de marginea unei ape.
      Înregistrarea poate fi făcută doar cu confirmare sau poate fi evitată.
      În unele cazuri se pot folosi modificări de grupuri de cuvinte, dar şi aici pot apărea efecte secundare, deci trebuie să fim atenţi.
      Dacă "ochiul sting, cotul sting, piciorul sting... " pot fi modificate fără probleme în "ochiul stâng, cotul stâng, piciorul stâng... ", nu acelaşi lucru putem spune despre "mal mare, mal mic, mal bun, mal rău... ", care ar putea fi în majoritatea cazurilor corectate ca "mai mare, mai mic, mai bun, mai rău... ", dar, la fel de bine, în unele cazuri ar putea fi vorba chiar de un MAL care este mic, mare, bun sau rău.
      Discuţia poate fi continuată cu "luminare >> lumânare" etc... etc...

      De aceea multe dintre erorile frecvente nu pot fi corectate de AutoCorect,iar uneori înregistrările cu confirmare ne dau mari dureri de cap.
      OCR_DIC nu poate impune unui utilizator să rişte modificări nedorite sau să-l ţină prea mult în faţa computerului pentru a accepta sau nu modificările cu confirmare.

      Cu toate astea putem să ne creăm nişte dicţionare personale în care putem pune tot ce ne interesează la un moment dat. Suntem singurii care hotărâm dacă o anume înregistrare ne foloseşte sau nu, dacă folosirea ei ne avantajează sau ne dezavantajează.

     Din motivele arătate mai sus, putem concluziona:

          ■ Dicţionarele OCR_DIC sunt nişte dicţionare care se vor a fi valabile în cât mai multe dintre cazuri; multe erori nu vor apărea în aceste dicţionare OCR_DIC pentru a nu avea efecte secunadre nedorite, deci nu vor fi corectate de AutoCorect; principalele înregistrări s-au făcut deja şi deşi dezvoltarea acestor dicţionare va continua, nu trebuie să ne aşteptăm să apară foarte multe înregistrări noi faţă de ceea ce avem în acest moment; probabil cele mai multe înregistrări vor fi făcute pentru cuvinte întregi de 4 litere şi a unora de 5 cuvinte, precum şi a unor cuvinte mai lungi cu frecvenţă mare în limba română.

          ■ Dicţionarele UZUALE urcate pe host sunt mai degrabă nişte modele de dicţionare personale. Dintre acestea, cele 3 dicţionare care se referă la cuvinte care încep cu litera "î" sunt singurele care au fost dezvoltate în timp; e vorba de dicţionarele: Uz_Î1 - diverse.imd, Uz_Î2 într- [208].imd şi Uz_Î3 [i - î] 682.imd.
      Celelalte dicţionare, de la Uz_A.imd la Uz_Z.imd, nu au mai fost reactualizate de mult timp, deoarece am folosit frecvent dicţionare temporare sau personale.
      Practic nu am dorit să impun altor persoane înlocuiri care mi-au folosit mie la un moment dat şi care, poate, în unele cazuri pot realiza înlocuiri nedorite.
      Este bine ca fiecare utilizator, plecând de la structura existentă, să verifice înregistrările din fiecare dicţionar, să elimine dacă fdoreşte unele înregistrări care nu-i sunt de folos şi să adauge altele pe măsură ce găseşte cuvinte care pot fi corectate.
      Ideea principală este să se meargă pe cât posibil pe înregistrări de cuvinte întregi la ambele capete sau cuvinte întregi la început.

      Hai să vedem care e problema cu aceste "cuvinte întregi" în sensul programului autocorect:
      Să luăm ca exemplu cuvântul binecuvintarc/binecuvântare.

             - dacă vom face înlocuirea binecuvintare >> binecuvântare înseamnă că în limbajul AutoCorect avem un "Cuvânt întreg la ambele capete", ceea ce în limbajul obişnuit înseamnă cuvânt întreg; Modificarea se va face doar în cazul acestui cuvânt şi nu va produce modificări pentru cuvintele "binecuvintarea", "binecuvintări" binecuvintările" etc... 
       
             - dacă vom face înlocuirea binecuvint >> binecuvânt înseamnă că în limbajul AutoCorect avem un "Cuvânt întreg la început", ceea ce în limbajul obişnuit înseamnă aproximativ rădăcină de cuvânt; dacă vom pune condiţia "cuvânt întreg la început" toate cuvintele care încep cu "binecuvint" vor fi modificate, deci atât "binecuvintare", cât şi "binecuvintarea", "binecuvintări" binecuvintările" etc... 
      Presupunem că am pus înlocuirea binecuvintare >> binecuvântare cu condiţia "cuvânt întreg la început"; în acest caz modificarea se va face la cuvintele "binecuvintare" şi "binecuvintarea" - pentru că au acelaşi început, dar nu şi la  "binecuvintări" binecuvintările" - pentru că au formă modificată în final.

             - dacă vom face o înlocuire de genul ....ănd >> ...ând sub forma ănd >> ând, avem de-a face cu un "cuvânt întreg la sfârşit", deci cu o terminaţie în limbaj obişnuit.
      În cazul de mai sus absolut toate verbele la gerunziu care se termină în "ând", cum ar fi "alungând, autoproclamând, conectând, dedublând, erijând, felicitând, forfecând, idolatrizând, inserând, interferând, înseninând, marcând, mizând, reciclând, redând, secerând" şi care au fost scrise eronat cu litera "ă" în loc de"â" vor fi corectate.
      Cu toate acestea cuvintele care au terminaţiile ...ăndu-mă, ...ăndu-te, ...ăndu-se, ...ăndu-ne etc. nu vor fi modificate, deoarece deşi conţin "ând",ele nu se termină cu "ând".
      Dacă am dori ca orice cuvânt care are în componenţă secvenţa "ănd" să fie modificat în "ând" atunci am folosi doar condiţia "potrivire perfectă" fără altă condiţie, doar că înlocuirea nu ar fi corectă deoarece există suficiente cuvinte care au în mod corect secvenţa "ănd" în componenţă [dăndănaie, hăndrălău, măndel, săndăluţe, smărăndel, tăndăni, ţăndărea...]
      DE ŢINUT MINTE! Dacă vom activa doar opţiunea "cuvânt întreg" fără să stabilim dacă acesta este cuvânt întreg la ambele capete, cuvânt întreg la început sau cuvânt întreg la sfârşit, programul AutoCorect OCR Plus este realizat astfel încât să seteze automat varianta "cuvânt întreg la ambele capete", deci cuvânt întreg în sensul obişnuit al limbajului.
      În concluzie vom umbla la setarea variantei de cuvânt întreg doar dacă e vorba de un început de cuvânt, deci "cuvânt întreg la început" sau de un sfârşit de cuvânt, adică "cuvânt întreg la sfârşit".


          ■ Dicţionarele personale...
      Fiecare utilizator poate crea pentru uz personal dicţionare sau pachete de dicţionare.
      Nu trebuie să acceptăm să gândească alţii pentru noi; suntem cei mai în măsură să constatăm şi să hotărâm ce anume erori ne interesează să fie corectate.

      Fiecare tip de font folosit la tipărirea unei cărţi poate da erori specifice, care nu sunt încă rezolvate de AutoCorect.
      Cu cât un font pare mai elegant, cu cât are nişte caractere ce par mai artistice, cu atât el are şanse ca la recunoaşterea în Abbyy să dea erori. Pot fi fonturi la care diferite litere sunt mai late decât de obicei şi în poziţii aproape lipite de litera următoare; această poziţie foarte apropiată a două litere, transformă pur şi simplu grupul de două litere într-un caracter nou, ceva comparabil cu situaţia literelor ae sau oe care formează caracrele ć şi ś în limba franceză.
      De exemplu: la unele fonturi [foarte plăcute ochiului] litera < f > este un pic mai lată, partea de sus din dreapta lungindu-se deasupra literei următoare, astfel că grupurile de litere fr, fi, fl, ft sunt pentru Abbyy nişte caractere noi pe care le interpretează adeseori greşit.
      Ne amintim că Abbyy "citeşte" caracterele în suprafeţe utile sub formă de dreptunghi, deci fiecare caracter este încadrat într-un dreptunghi. În aceste cazuri Abbyy ori nu va încadra litera "f" în totalitate, lipsind din literă un pic din partea de sus dreapta, ori va încadra toată litera şi în acest caz va "ciupi" un pic din litera următoare, iar litera următoare la citire va avea lipsă bucăţica ce a fost incorect repartizată literei "f".
     Din aceste motive şi din alte 1000 de motive este util ca fiecare utilizator să încerce să-şi facă dicţionare proprii.

     PONT: În AutoCorect există facilitatea marcării cu font colorat a modificărilor făcute de dicţionare.
     Dacă dorim să urmărim/verificăm efectele unor înlocuiri în text, respectiv corectitudinea lor se poate seta ca la rularea unui dicţionar, toate modificările să fie marcate cu font colorat.
     În acest fel, dacă vom constatat că o înlocuire produce mai multă pagubă, deci pe lângă modificările corecte face şi modificări nedorite, atunci pur şi simplu deschidem dicţionarul şi ştergem înregistrarea cu pricina sau căutăm să-i punem nişte condiţii care să-i reducă variantele de căutare şi înlocuire.

     


     Culoarea se poate stabili pentru fiecare sesiune de modificări în parte.
     ATENŢIE: Opţiunea "Marchează modificările" nu se transmite doar dicţionarului la care s-a activat opţiunea, ci este o setare care se transmite tuturor dicţionarelor din AutoCorect, inclusiv celor din OCR_DIC.
     Din acest motiv, după ce rulăm un dicţionar personal pentru testare, vom avea grijă să dezactivăm de îndată această opţiune "Marchează modificările", pentru că dacă o vom uita activată, la rularea automată a unui OCR în AC OCR Plus vom opţine un text foarte colorat.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#80
Seven
Moderator
Din: Ţara Perfectului Simplu

          JONGLERII cu dicţionare de Înlocuire multiplă de tip "imd"



      ■ Despre funcţia Înlocuire multiplă

      Următoarele câteva fraze pot fi considerate pe lângă subiect, dar cred că sunt necesare.
      Am descoperit AutoCorect standard creat de Daniel Morlova şi Cosmin Ciupercă în urmă cu vreo 5 ani, pe vremea versiunii 2.3.
      La momentul respectiv, cel mai mult m-a impresionat funcţia "Înlocuire Multiplă".
      Era pentru prima dată când întâlneam posibilitatea realizării unui număr mare de înlocuiri de tip Find&Replace cu o singură comandă, şi în plus înlocuirile se puteau salva spre a fi folosite şi cu altă ocazie.
      În Word şi nu numai, exista posibilitatea realizări de înlocuiri Find&Replace una câte una, iar despre salvarea lor nici nu se putea discuta.
      E drept, în versiunea AC 2.3 putea fi rulat un singur dicţionar care se numea "implicit.dic", deci era un dicţionar de tip "dic" şi nu unul de tip "imd", dar salvasem mai multe dicţionare şi copiam câte unul în folderul de instalare după care îl redenumeam în "implicit.dic" după care îl rulam, apoi copiam şi redenumeam următorul dicţionar şi tot aşa...
      Poate părea foarte complicat, dar realizarea unui număr teoretic infinit de înlocuiri cu o singură comandă mi se părea şi mi se pare şi astăzi ceva cu totul deosebit.

      Chiar dacă AutoCorect ar avea doar această funcţie şi tot ar fi unul dintre instrumentele cele mai importante în corectura de carte electronică.
      Din acest motiv cred că fiecare utilizator este obligat să ştie să jongleze cu astfel de dicţionare.
      Şi o ultimă frază: faţă de fereastra "Înlocuire multiplă" din AC standandard, Cosmin Ciupercă a perfecţionat şi dezvoltat atât de mult fereastra "Înlocuire Multiplă" din AC OCR Plus, încât în acest moment se poate înregistra un complex de înlocuiri cu o gamă largă de condiţii, astfel că doar această funcţie a "Înlocuirilor Multiple" ar putea fi un program independent foarte puternic.


      ■ Deschiderea ferestrei Înlocuire multiplă

      În orice versiune de AutoCorect se poate ajunge în fereastra "Înlocuire Multiplă", acţionând "Editare" → "Înlocuire Multiplă"
      Doar în AutoCorect OCR Plus [deci nu şi în AutoCorect standard] există şi un icon "Înlocuire Multiplă" care se află ultimul din dreapta pe prima bară de iconuri [vezi imaginea de mai jos].

      Vezi imaginea la dimensiune originală ► IMG Original


      Oricare ar fi varianta de accesare a ferestrei, programul va deschide la început dicţionarul gol numit "implicit.imd"
      Dacă suntem în timpul unei sesiuni în care am rulat deja un dicţionar, atunci la deschidere ferestrei se va deschide ultimul dicţionar folosit. La închiderea programului AutoCorect, acesta "uită" ultimul dicţionar folosit, astfel că la o nouă deschidere va apărea din nou dicţionarul gol "implicit.imd".
      Atenţie! Totdeauna dicţionarul "implicit.imd" trebuie să fie gol, să nu aibă nicio înregistrare. Dacă din nebăgare de seamă şi distragerea atenţiei în dicţionarul "implicit.imd" au rămas înregistrări, atunci ducem mausul pe o înregistrare, facem click-dreapta, alegem "Selectare toate" şi apoi "Ştergere", după care face click pe semnul "X" din partea de sus-dreapta a ferestrei şi închidem dicţionarul "implicit.imd". În acest mod se face salvarea rapidă a dicţionarului, în cazul nostru în varianta gol.

      Să revenim:
      Deschidem fereastra "Înlocuire Multiplă" şi programul deschide dicţionarul "implicit.imd".
      În principiu, avem doauă variante de lucru:
               ● ori creăm un nou dicţionar şi în acest caz acţionăm butonul "Salvează dicţionar" şi vom da un nume pe cât posibil sugestiv noului dicţionar creat,în funcţie de ce anume modificări ne propunem să facem;
               ● ori dorim să deschidem un dicţionar deja creat şi în acest caz acţionăm butonul "Deschide dicţionar", căutând apoi dicţionarul dorit. Remarcăm că în dreapta butonului "Deschide dicţionar" există semnul ▼. Acţionând asupra acestui semn vom găsi ultimele 5 dicţionare folosite, astfel că dacă dicţionarul căutat este unul dintre acestea 5, putem să-l activăm rapid fără a mai căuta prin diverse foldere. Nu contează dacă dicţionarele se găsesc în foldere diferite, ele se vor deschide rapid dacă se găsesc în lista pe care o deschide semnul ▼ aflat în dreapta butonului "Deschide dicţionar".


      ■ Editare dicţionare de Înlocuire multiplă

      Asupra acestui subiect, a condiţiilor de căutare ce se pot stabili pentru fiecare modificare în parte am spus câteva cuvinte în postarea de mai sus despre condiţia "Cuvânt întreg", am discutat detaliat fiecare condiţie pe topicul [AC] AutoCorect OCR Plus - Instructiuni de folosire şi probabil vom mai reveni pe acest topic, dacă va fi nevoie.
      Presupunând că avem suficiente cunoştinţe despre modul în care se fac înregistrările, să încercăm să dicutăm câteva lucruri despre operaţiuni ce se pot face în şi cu dicţionarele de tim "imd".


      ● Operaţiuni ce se pot face într-un dicţionar "imd"

      ► Reeditarea unei înregistrări existente:
      O înregistrare a unei înlocuiri nu este ceva definitiv; ea poate fi reeditată oricând şi de câte ori este necesar.
      Pentru a reedita o înregistrare, o selectăm şi apoi apăsăm butonul "Editează" sau facem dublu click pe înregistrarea respectivă; indiferent de varianta folosită, înregistrarea se va deschide automat în fereastra de editare-reeditare.
      După realizarea modificărilor dorite, aceste modificări trebuiesc obligatoriu salvate, acţionând asupra butonului "Salvează" din dreapta ferestrei de editare.
      Se poate face salvarea şi dacă acţionăm tasta "Enter" după executarea modificărilor. Salvarea cu tasta Enter, ca şi cea cu butonul "Salvează" se poate face indiferent dacă avem cursorul în fereastra "Caută" sau în fereastra "Înlocuieşte cu".
      Dacă nu mai dorim reeditarea, dar înregistrarea s-a deschis deja în fereastra de reeditare, chiar dacă am executat deja unele modificări, putem folosi butonul "Renunţă" şi astfel înregistrarea va rămâne în forma iniţială.

      ► Sortarea în ordine alfabetică a înregistrărilor:
      Se realizează cu ajutorul butonului "Sortează".
      La acţionarea butonului "Sortează" se deschid două variante de sortare: după coloana "caută" sau după coloana "Înlocuieşte cu"; utilizatorul alege varianta de sortare care i se pare mai convenabilă.
      ATENŢIE!  Nu recomand folosirea funcţiei de sortare la cele 39 de dicţionare din OCR_DIC, deoarece înregistrările din unele dicţionare au o ordine prestabilită de rulare care nu ţine cont de ordinea alfabetică, ci de cronologia executării fiecărei modificări în parte. Sortarea alfabetică a unora dintre dicţionarele OCR_DIC le poate face să funcţioneze incomplet sau să producă erori.

      ► Deplasarea cu mausul în sus sau în jos a înregistrărilor:
      Se poate schimba poziţia unei înregistrări, deplasând-o mai sus sau mai jos în cadrul dicţionarului, fără a folosi funcţia de sortare ori cea de Copy&Paste.
      Se selectează una sau mai multe înregistrări şi pur şi simplu se pot trage cu mausul în sus sau în jos până la poziţia dorită.
      Apar situaţii când acest lucru este necesar, de regulă, atunci când se îmbunătăţeşte un dicţionar prin adăugarea de noi înregistrări. E posibil ca o înregistrare veche să trebuiască să rămână pe ultima poziţie a dicţionarului sau în diverse alte poziţii şi să nu fie indicată sortarea.
      E de preferat ca pentru început să se facă astfel de manevre cu câte o singură înregistrare şi mai apoi să se treacă la deplasarea unui grup de înregistrări.
      În imaginea următoare se poate vedea poziţia înregistrării "alut- >> ajut-" înainte [când se afla pe poziţia 15] şi după deplasarea în sus prin tragerea/agăţarea cu mausul [când a ajuns în poziţia 1]

     Vezi imaginea la dimensiune originală ► IMG Original


      ► Selectarea unui grup de înregistrări consecutive sau aflate în diverse poziţii:
      Dacă în AutoCorect standard asupra înregistrărilor se pot face un număr limitat de operaţiuni, în AutoCorect OCR Plus 5.1 se pot face toate operaţiunile [de selectare, copiere, mutare, ştergere] care sunt cunoscute în editoarele de text şi nu numai.
      Selectarea mai multor înregistrări se poate face atât la înregistrări consecutive [folosind tasta SHIFT], cât şi înregistrări din diverse poziţii [folosind tasta CTRL] aşa cum se procedează în diverse programe.
      Selectarea tuturor înregistrărilor se poate face acţionând butonul click-dreapta al mausului şi selectând apoi opţiunea "Selectare totală".

      ► Operaţiuni diverse cu înregistrări selectate:

      Iată în imaginea de mai jos meniul care de desfăşoară la acţionarea click-dreapta a mausului:


      Cred că meniul este suficient de sugestiv şi operaţiunile ce se pot executa sunt uşor de înţeles, deoarece ele sunt operaţiuni clasice, foarte cunoscute, folosite în foarte multe editoare.

      DECUPARE: click dreapta şi "Decupare" sau Ctrl X.

      COPIERE:  click dreapta şi "Copiere" sau Ctrl C.

      PASTE:  click dreapta şi "Paste" sau Ctrl W

      ŞTERGERE: Înregistrările diverse selectate pot fi şterse prin mai multe metode:
                 - folosind butonul "Stergere" de pe panoul din dreapta a ferestrei;
                 - click dreapta şi folosirea opţiunii "Ştergere";
                 - folosind tasta Delete.

      ► Salvarea modificărilor făcute într-un dicţionar:
      Salvarea cea mai frecventă a modificărilor este metoda rulării dicţionarului, prin apăsarea butonului "Rulează".
      Altă variantă de salvare a tuturor modificărilor este prin acţionarea butonului "X" din colţul dreapta-sus a ferestrei de Înlocuire Multiplă.
      ATENŢIE: Dacă după executarea unor modificări într-un dicţionar nu facem niciuna dintre operaţiunile de mai sus, dar deschidem un alt dicţionar cu ajutorul butonului "Deschide dictionar", ei bine, în acest caz modificările nu vor fi salvate.


      ● Operaţiuni cu două sau mai multe dicţionare "imd"


Copiere grup de înregistrări în alt dicţionar

     Vezi imaginea la dimensiune originală ► IMG Original




Copiere Dic.imd → NotePad → Excel şi invers

     Vezi imaginea la dimensiune originală ► IMG Original


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#81
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Mulţumesc tuturor pentru semnalări.
      Voi proceda astfel: voi şterge postările care nu conţin semnalări de erori; la postările care conţin semnalări de erori, voi păstra doar semnălările la care voi adăcuga stadiul rezolvării.

      Şi, da, ai dreptate ZC: AC nu converteşte toate tipurile de bullets, ci doar pe cele ce pot fi interpretate ca linie de dialog.

      Putem găsi un mod de rezolvare pentru problemă pentru că am un Doc-Template care conţine câteva macrocomenzi, dintre care prima este cea care converteşte TOATE bullets în caractere. Am verificat acum exact cu testul tău şi funcţionează foarte bine.

      Într-un template de acest fel poate fi rulat un OCR înainte de rularea prin AC, iar timpul consumat cu rularea prin template se câştigă la viteza de rulare în AC.
      Acest template mai face şi alte lucruri care ar veni în ajutorul AC, elimină spaţii multiple, converteşte tab în spaţiu etc., dar are şi macrocomenzi speciale pentru că eu îl folosesc pentru perierea OCR-urilor franceze de la  La jeunesse du roi Henri [Juneţea regelui Henric].
     Trebuie ca mai întâi să elimin sau să modific unele macrocomenzi, astfel încât în template să rămână numai modificările care ne interesează, dar cum nu sunt foarte priceput la macrouri, treaba asta va dura două-trei zile.
     
    Ca să vezi despre ce e vorba şi să poţi face testări, am pus originalul în variantă arhivată şi nearhivată la adresa:
      http://www.mediafire.com/?9maijqq4h604q

    Se deschide template prin dublu click şi se deschide fişierul.
    Apare un mesaj de avertizare că fieşierul conţine macro şi se apasă butonul "Enable Macros".
     La deschiderea fişierului apare în plus o bară cu 6 butoane pentru macrouri.
     Se inserează fişierul cu pricina şi se apasă doar pe butoanele 1 şi 3 [la 1 se face conversia bullets-caratere şi la 3 elimină spaţii multiple şi converteşte tab în spaţiu.
     După asta se dă Save As... şi se alege formatul RTF pentru ca documentul să nu mai păstreze macrourile, respectiv se dă un nume fişierului OCR.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#82
Seven
Moderator
Din: Ţara Perfectului Simplu
***
     Am să şterg şi postările cu dicuţii punctuale ZVONACFIRST, Seven, meridiane, utilitasetveritas.
     Trebuie doar să găsesc o formulare pentru problema legată de faptul că la op.1.1. nu se convertesc toate caracterele bullets, ci doar cele care reprezintă linii de dialog.

      Acum vreau să vă propun o operaţiune simplă de corectare a unui dicţionar.
      Pentru că nu e ceva complicat, ar fi bine să încercăm să realizăm această operaţiune.


     Am revizuit doua dicţionare care aveau înregistrări ce produceau modificările incorecte semnalate în postările de mai sus.
     Este vorba despre dicţionarul  CO_Midp.imd [CL_Midp.imd] din pachetul OCR_DIC şi de dicţionarul Uz_Î3 [i - î] 682.imd din dicţionarele Uzuale. În ambele am făcut corecţiile semnalate şi am făcut verificări în plus; sper că am rezolvat cam tot. Aştept dacă sunt şi alte semnalări.

     Bun. Am urcat deja în folderul TEMP de pe Mediafire variantele revizuite la CO_Midp.imd [CL_Midp.imd] şi urmează să mai fac o verificare şi apoi să urc şi ultima variantă de la Uz_Î3 [i - î] 682.imd
     
     Înainte de a face download aş vrea să vă propun să încercaţi mai întâi să faceţi fiecare modificările la dicţionarul CO_Midp.imd., apoi pentru siguranţă puteţi face şi downloadul.

     Să reamintim: orice dicţionar de tip "imd" poate fi vizualizat şi editat în AutoCorect.
     Folosim opţiunea "Editare" → "înlocuire Multiplă" sau click pe iconul din dreapata sus; ajungeam în fereastra Înlocuire multiplă în care se află în mod obişnuit dicţionarul gol "imiplicit.imd", acţionăm butonul "Deschide dicţionar" şi încărcăm dicţionarul dorit, în cazul nostru CO_Midp.imd.

      Avem următoarele variante de înlocuiri:
             Insera >> Însera    Ci  Ic  Pp  Pi   
             Insere >> Însere    Ci  Ic  Pp  Pi   
             Inseria >> Înseria    Ci  Ic  Pp  Pi   
             Inserie >> Înserie    Ci  Ic  Pp  Pi   
ţi ele se află laurmătoarele coordonate:  2422-2425, 1769-1772, 1116-1119 şi 463-466.

      Ştergerea înregistrărilor o vom face în mod obligatoriu de la sfârşitul dicţionarului spre începutul lui, pentru că dacă am face ştergerea de la începutul dicţionarului, coordonatele date nu ar mai fi valabile.

      Deci, derulăm dicţionarul până în zona înregistrărilor cu nr.  2422-2425. Vom făsi acolo cele 4 înregistrări însoţite de —^s, ceea ce înseamnă linie de dialo urmată de spaţiu neseparabil.
      Selectăm cele 4 înregistri şi le ştergem, folosind tasta Delete, ori Ctrl X, sau click dreapta şi opţiunea Ştergere.
      După ştergere defilăm în sus până la înregistrările 1769-1772 unde vom găsi cele 4 înregistrări într-un alt format; facem ştergerea şi defilăm spre următoarele coordonate.
      După ce am făcut ştergerea şi de la poziţiile 1116-1119 şi 463-466, defilăm până la sfârşitul dicţionarului şi ne uităm câte înregistrări au rămas în dicţionar. Dacă au rămas un număr de 2630 de înregistrări înseamnă că ştergerea a fost corectă.
     
      Atenţie! la dicţionarul CL_Midp.imd am constatat că lipsesc în acest moment două înregistrări, astfel că cele 4 coordonate nu sunt valabile; dacă dorim să facem o ştergere şi aici, atunci coordonatele ar trebui să fie următoarele: 2420-2423, 1767-1770, 1114-1117 şi 461-464.

      Dacă am făcut aceste modificări, atunci putem constata că pe viitor se pot face astfel de ştergeri, corecturi, editări atunci când sunt semnalate de alţii sau atunci când constatăm noi singuri că o înregistrare ar trebui ştearsă ori modificată...

      Dacă aţi greşit ceva la ştergere, nu-i nicio problemă pentru că am adus la zi ambele dicţionare: CO_Midp.imd, respeciv CL_Midp.imd şi ele se găsesc în:
             folderul temporar TEMP
             de la adresa: http://www.mediafire.com/?484moske4vc9t

      Celelalte dicţionare de tip Midp.imd, modificate în urmă cu câteva zile au fost şterse.
      Pentru că modificarea dicţionarul Uz_Î3 [i - î] 682.imd este mai complexă, voi urca direct varianta reactualizată pe host şi voi menţiona despre acest lucru în această postare.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#83
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Diacritice cu virgula Vs. diacritice cu sedila

      1. AutoCorect poate lucra cu ambele tipuri de diacritice.
      De altfel, există opţiunea "Editare" → "Conversie diacritice" care permite convertirea din diacritice cu virgula în diacritice cu sedila şi invers.

      2. Toate, dar absolut toate, dicţionarele "imd" sunt editate cu diacritice cu SEDILA, aşa cum toate cărşile corectate de mine de-a lungul timpului sunt editate cu diacritice cu sedila..
      Personal folosesc doar diacritice cu sedila şi format doc [nici măcar docx] dintr-un motiv simplu de ordin tehnic: toată lumea, indiferent de sistemul de operare şi editor poate "vedea" un doc care are are diacritice cu sedila, timp în care nu toţi posesorii de computere pot "vedea" diacriticele cu virgulă.
      Eu merg pe principiu că dacă tot am migălit la corectarea unei cărţi, atunci s-o poată citi oricine îşi doreşte fără să întâmpine dificultăţi de ordin tehnic şi să fie nevoit să apeleze la conversii care adeseori dau erori.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#84
Seven
Moderator
Din: Ţara Perfectului Simplu

          ÎNLOCUIRI CARACTERE REPRODUSE ERONAT



     Notă: pentru a face o notare mai simplă a dicţionarelor, în această postare şi următoarea nu am mai pus particula CO_ [CL_] de la începutul dicţionarelor, care face doar diferenţa dintre variantele Contemporan şi Clasic, şi nici extensia „imd” care se subînţelege, ci am notat doar numele lor concret, asfel că dicţionarele CO_L1.imd ÷ CO_L4.imd, au fost notate cu L1 ÷ L4 şi aşa mai departe.

     Există o serie de caractere sau grupuri de caractere pe care Abbyy le confuncă şi le recunoaşte în mod frecvent eronat, printre care: cifra 1 = l, cl = d, rn = m, c = e, l = i, ă = â etc…

     Înlocuirea cifrei 1 cu litera L mic a fost prima preocupare şi s-a încercat rezolvarea acestei probleme cu înregistrările din dicţionarele L1÷ L4, care iniţial au rulat cu o opţiune separată, iar acum rulează la pachetul nr.4 „Corectare caractere reproduse eronat”, opţiunea „4.2 Corectarea literelor l, d si m reproduse eronat”.

     Confuzia perechilor „cl = d” şi „rn = m” a fost următoarea preocupare şi pentru corectare au fost create dicţionarele Gcl şi Grn, primul făcând o serie de înlocuiri de tipul „cl >> d”,iar cel de-al doilea înlocuiri de tipul „rn >> m”
Ambele dicţioare rulează în cadrul opţiunii amintită mai sus, „4.2 Corectarea literelor l, d si m reproduse eronat”.

     Cu toate acestea au rămas o serie de confuzii nerezolvare,printre care cele mai importante sunt „c = e, l = i”, dar nu numai acestea.
     Corectarea prin formula înlocuire de cuvinte întregi, chiar încercând să modificăm doar rădăcinile cuvintelor şi nu întreg pachetul de cuvinte dintr-o familie, devine aproape imposibilă, deoarece ar necesita zeci de mii de înregistrări doar pentru confuzia „c = e”.

     Din acest motiv a apărut ideea de înlocuire a unor secvenţe de cuvinte şi nu a unui cuvânt întreg.
     Despre astfel de situaţii vorbim pe larg în postarea următoare.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#85
Seven
Moderator
Din: Ţara Perfectului Simplu

          ÎNLOCUIRI SECVENŢE DE CUVINTE



     Secvenţa de cuvânt este o succesiune scurtă de litere [de regulă de 3-4 litere şi foarte rar un număr mai mare de litere], care pot apărea oriunde într-un cuvânt sau doar la începutul, în interiorul ori la sfârşitul cuvintelor.
     Secvenţele de început au fost înregistrate în dicţionare numite SInc; secvenţele din interiorul cuvintelor, deci mediane, au fost notate cu SMed, iar secvenţele finale, de la terminaţia cuvintelor, au fost notate cu STer.

     Cel mai simplu ar fi fost ca dicţionarele să fie numite SInc, SInt şi SFin; S-au folosit numele de SInc, SMed şi STer pentru ca diferenţa de nume să fie uşor vizibilă, să poată fi sortate alfabetic şi să fie cât de cât sugestive.

     Modificarea secvenţelor de cuvinte se realizează în pachetul de opţiuni nr.4 „Corectare caractere reproduse eronat”, opţiunea nr. 4.5. „Corectare secvenţe cuvinte”

     Accesarea opţiunii 4.5 pune în mişcare rularea automată în ordine prestabilită a 6 dicţionare.
     Pentru fiecare tip de secvenţă există câte 2 dicţionare, iar ordinea de rulare este chiar ordinea de sortare, deci SInc1, SInc2, Smed1, SMed2, Ster1 şi Ster2.


     Cred că înlocuirile secvenţelor de la interiorul cuvintelor sunt cele mai multe şi un pic mai dificile.
     Să încercăm câteva explicaţii despre funcţionarea lor, folosindu-ne de câteva exemple:

     Să luăm în calcul confuzia dintre literele „e” şi „c”; Abbyy poate pune atât „e” acolo unde în mod real există „c”, cât şi invers.
     Dacă vorbim de secvenţe mediane, înseamnă că „e” sau „c” trebuie să se afle obligatoriu între două litere, altfel spus între perechi de litere, aşa că s-a făcut căutarea fiecărei situaţii posibile.

     Pornind de la perechile AA, AB, AC, AD, AE… Până la ZU, ZV, ZX, ZZ, am introdus la mijlocul fiecărei perechi litera e şi am făcut o căutare în dicţionare, apoi litera c şi am reluat căutarea, astfel că am făcut căutări începând cu AEA-ACA, AEB-ACB, AEC-ACC… ZEV-ZCV, ZEX-ZCX, ZEZ-ZCZ.
     Căutarea s-a realizat în dicţionarele de limbă română [DEX şi celelalte], existente în folderul de instalare a AutoCorect.

     La căutare au existat 3 mari variante de rezultate:

     a. La căutare au rezultat un număr foarte mare de cuvinte, atât în secvenţa cu litera E, cât şi în secvenţa cu litera C; în astfel de situaţii nu s-a făcut nicio înregistrare.

     b. La căutare, a rezultat că în limba română între anumite două litere exista doar una dintre secvenţe; în acest caz, pur şi simplu s-a făcut înregistrarea, de regulă înregistrarea modificând succesiunea care conţinea litera „C” în succesiune care conţinea litera „E”.

     c. La căutare au rezultat un număr mare de cuvinte pentru o anumită succesiune [am numit această succesiune REGULA] şi un număr foarte mic de cuvinte pentru cealaltă succesiune pe care am numit-o EXCEPŢIA DE LA REGULĂ [în principal este vorba de cuvinte împrumutate din alte limbi, ori cuvinte specifice unui domeniu cum ar fi cel medical].

     Această situaţie va trebui explicată mai detaliat.
     Să luăm de exemplu succesiunile de 3 litere „MCL” – „MEL”.

     La o căutare în dicţionarele de limba română aflate în folderul de instalare a AutoCorect, rezultă că un număr de 10 cuvinte din familia „Adamclisi” şi „circumcluzie” conţin această succesiunea „MCL”, timp în care un număr de 1919 cuvinte conţin succesiunea „MEL”.

     Aveam posibilitatea să nu fac nicio înregistrare, timp în care o serie dintre cele 1919 cuvinte ar fi putut rămâne cu erori sau puteam să aleg modificarea cu beneficiul cel mai mare şi să fac înregistrare „mcl >> mel”;

     Mai exista o variantă un pic mai complicată, dar pe care o consider un pic mai corectă, aşa că am recurs la ea:
          – pasul 1: am făcut înregistrarea „mcl >> mel”
          – pasul 2: am făcut următoarele două înregistrări care să readucă cele două grupuri de cuvinte la forma iniţială:
           „adamclisi >> Adamclisi”
           „circumcluz >> circumcluz”
ambele cu condiţiile: „Cuvânt întreg la început” + „Păstrează capitalizarea”
     Putem spune că am recurs la un fel de „modificare a modificării”.

     Acest gen de situaţii au apărut şi în alte succesiuni şi acolo unde recorectarea se putea face printr-un număr mic de înregistrări, am procedat similar, astfel că o serie de înregistrări din dicţionarele SMed par foarte aiurea; acestea sunt cele care „modificarea primei modificări” şi par aiurea pentru că sunt cuvinte foarte rare şi foarte puţin cunoscute.

     Să mai dăm un scurt exemplu cu secvenţele „MLL” – „MIL” şi „MLI”
     La căutări au rezultat următoarele:

     Secvenţa „MLL” = zero cuvinte
     Secvenţa „MIL” = 4111 cuvinte
     Secvenţa „MLI” = 60 cuvinte din 5 familii de cuvinte şi anume:
          atomliză = efuziune
          drumlin = formă de relief de origine glaciară, având un contur eliptic.
          Kremlin = oraş rusesc
          omlitui = verb – a face marcotaj, procedeu de înmulţire a unei plante prin marcote.
          şimli = cozoroc la o şapcă

     Mod de rezolvare:
          – pasul 1: am făcut înregistrările „mll >> mil” şi „mli >> mil”
          – pasul 2: am făcut următoarele înregistrări care să readucă cele două grupuri de cuvinte la forma iniţială:
           „kremiln >> kremlin”
           „atomilz >> atomliz”
           „drumiln >> drumlin”
           „omlitui >> omiltui”
           „şimil >> şimli”


     Probleme posibile

     Există o mare problemă dacă ele rămân în acelaşi dicţionar şi o detaliem.

     Ordinea executării înlocuirilor din primul exemplu de mai sus este ordinea în care s-au făcut înregistrările:
           „mcl >> mel”
           „adamclisi >> Adamclisi”
           „circumcluz >> circumcluz”

     Dacă cineva, dintr-un motiv sau altul, face o sortare a înregistrărilor din dicţionar, ordinea va deveni:
           „adamclisi >> Adamclisi”
           „circumcluz >> circumcluz”
           „mcl >> mel”

     În acest caz, primele două înregistrări nu vor avea niciun efect pentru că la momentul în care ele rulează nu s-a făcut încă modificarea,iar cele două grupuri de cuvinte vor rămâne scrise greşit.

     Pentru evitarea unor astfel de situaţii am hotărât ca în dicţionarul „SMed1” să existe numai modificările succesiunilor de cuvinte, iar în „SMed2” vor fi mutate toate acele înregistrări ce par fără sens şi care fac ceea ce am numit „modificarea modificării”.

     Dacă vor apărea astfel de situaţii şi la secvenţele de început de cuvânt sau de sfârşit de cuvânt, voi proceda la fel şi în cazul dicţionarelor „SInc” şi „STer”, astfel că dicţionarele „SInc2” şi „STer2” vor conţine înregistrări de tip „modificarea modificării”.

     Este important de reţinut faptul că oricât de aiurea ni se vor părea înregistrările din dicţionarele „SInc2”, „SMed2” şi „Ster2”, ele nu trebuie şterse, iar dacă facem totuşi ştergerea unei înregistrări, acest lucru trebuie făcut doar după ce am înţeles care este rolul ei.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#86
Seven
Moderator
Din: Ţara Perfectului Simplu

            IMPORTANT: UPDATE 23.04.2013



       1. Rezolvare probleme legate de opţiunea 1.1 

       Opţiunea 1.1 face conversia bullets >> caracter text, doar pentru semnele care ţin loc de linie de dialog.
       Pentru rezolvarea conversiei în caracter text a tuturor tiourilor de bullets şi pentru a scurta timpul de rulare a unor opţiuni, am realizat un Doc-Template simplu care poate rula [la acest moment] 4 macrocomenzi.
       Macrocomenzile sunt următoarele:
            "1 Bullet > text" - face conversia tuturor tipurilor de bullets în caractere text.
            "2 Del Spatii multiple" - face conversiua taburilor în spaţii simple şi reduce spaţiile multiple consecutive la un singur spaţiu.
            "3 Del page Break" - şterge marcajele Section Break sau Manual Page Break şi le înlocuieşte cu marcajul Parahraph Mark, adică înlocuieşte trecerea forţată la pagina următoare cu un paragraf [rând] gol.
            "4 PUNCTUAŢIE" - elimină spaţiile din faţa principalelor 6 semne de punctuaţie < , ; . : ! ? >

       Nume template:     Precuratare 2013.04.23.dot
       Adresa template:   http://www.mediafire.com/?p63t6mn7e6pm229

       MOD DE FOLOSIRE:
           - se face dublu click pe template pentru deschidere.
           - după deschiderea automată în Word apare un mesaj care avertizează că fişierul conţine macros şi se apasă butonul "Enable Macros"
           - în mod normal trebuie să apară o bară formată din 4 butoane + text. În WORD 2010 bara apare la afişarea ribonului "Add-Ins". Dacă nu apare bara se deschide Toolsbars şi se activează pachetul numit "TEMP7", care conţine cele 4 butoane.
          - se inserează în document OCR-ul aşa cum rezultă din Abbyy;
          - se rulează macrourile apăsând pe rând butoanele în ordine. În partea de jos a ferestrei se observă o mişcare a contorului de pagini; când contorul s-a oprit înseamnă că macrocomanda şi-a încheiat execuţia şi se apasă butonul următor.
          - după rularea celor 4 macrocomenzi se salvează OCR-ul modificat în format RTF pentru a nu mai păstra macrourile şi fişierul se poate rula normal în AC OCR Plus;
          - la rularea în AC nu trebuie să eliminăm din opţiuni, deoarece macrourile sunt mai simple decât opţiunile şi au doar rolul să reducă timpul de rulare a 2-3 opţiuni.


       1. Rezolvare conversie ghilimelele sus de tip 66 cu ghilimele sus de tip 99.
       Ghilimele româneşti de sfârşit de citat sunt poziţionate sus şi ar trebui să fie de forma numărului 99. Dacă aceste ghilimele sunt bine poziţionate, dar au forma numărului 66, la rularea opţiunii 2.3 Punctuaţie / Functii obişnuite, programul va trece în lista cu semnalări erori toate situaţiile în care ghilimele sunt de tip 66,ceea ce îngreuează verificarea sugestiilor.

        Am rezolvat cel puţin temporar situaţia adăugând o înregistrare în dicţionarul CO_Artef.imd care face conversia ghilimelelor 66 în ghilimele 99, la ghilimele aflate în poziţia SUS.
        Dicţionarul rulează înaintea punctuaţiei, aşa că ghilimele sunt deja modificate la rularea punctuaţiei şi nu vor mai apărea în lista de sugestii.

        PROBLEMĂ: Înregistrarea este ultima în dicţionarul Artef, dar deocamdată am setat-o să ruleze cu confirmare, urmând ca după ce vom constata efectele rulării să stabilim dacă modificarea poate funcţiona automat sau nu va funcţiona şi va trebui eliminată.
        Dicţionarul CO_Artef.imd care conţine modificarea se poate downloada de la adresa:
                 http://www.mediafire.com/?1gonhbh3anzasuh

        Pentru utilizatorii AC Clasic, dicţionarul trebuie doar redenumit din "CO_Artef.imd" în "CO_Artef.imd", deoarece conţinutul dicţionarelor este identic.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#87
printzuska
Membru Gold
Din: Constanta
- în mod normal trebuie să apară o bară formată din 4 butoane + text. În WORD 2010 bara apare la afişarea ribonului "Add-Ins". Dacă nu apare bara se deschide Toolsbars şi se activează pachetul numit "TEMP7", care conţine cele 4 butoane.
       

Nu am gasit cele patru butoane in Add-ins. Si nu gasesc Toolsbars de unde sa activez pachetul acela?


 
   
#88
ZVONACFIRST
MEMBRU DE BAZA
Din: Bucuresti

MOD DE FOLOSIRE

In Office 2010 nu se intampla la fel cum scrie Seven, sau la mine nu se intampla la fel.
Eu am procedat astfel:
- se activeaza mai intai ribbonul Developer, in caz ca nu este activat deja. Pentru cei care nu stiu cum: File --> Options --> Customize ribbon --> Se bifeaza in lista din dreapta Developer --> OK
- se deschide template-ul pus la dispozitie de Seven. nu va aparea mesajul de avertizare de care aminteste Seven asa ca va trebui sa activam Macros (default sunt dezactivate din motive de securitate). Pentru cei care nu stiu: Developer --> Macro security --> Macro Setings --> Se bifeaza Enable all macros --> Ok
- se deschide ocr-ul brut
- in ocr se selecteaza textul pe care dorim sa-l prelucram (eventual tot documentul) --> Copy
- in template se da Paste. Daca vom deschide documentul direct din template se va deschide ca document de sine statator fara sa poata fi rulate acele macro.
- se ruleaza macrourile folosind butoanele din Add Ins. daca nu apar butoanele rulam "manual" macrourile, pe rand: Developer --> Macros --> Se alege macro dorit --> Run
- se salveaza documentul ca rtf.
Sper sa nu fi uitat ceva. Eu asa am procedat si a mers.


 
   
#89
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Eu am Ms Office 2003 instalat pe care îl folosesc permanent şi un Ms Office 2010 portabil pe care-l folosesc doar pentru realizarea PDF din text pentru că rezultă un PDF mai mic şi uneori pentru deschiderea unor fişiere docx care nu sunt compatibile cu doc.

      Am constatat şi eu că deşi Template rula bine în Word 2003, erau probleme în 2010 şi când în sfârşit l-am găsit pe unde era ascuns, am crezut că aceea este varianta universal valabilă.

      Rog pe cei ce se pricep la lucrul cu macro Word-uri superioare să se "milească" de noi şi, poate, face o prelucrare astfel ca cele 4 macros să ruleze mai simplu şi în Word 2010... 2012... şi ce a mai apărut.
      Dacă e nevoie pot urca fişier TXT cu conţinutul macrocomenzilor.

      Până atunci, sper să fie de ajutor explicaţia postată de ZVONACFIRST.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#90
ZVONACFIRST
MEMBRU DE BAZA
Din: Bucuresti

Seven a scris:


      Rog pe cei ce se pricep la lucrul cu macro Word-uri superioare să se "milească" de noi şi, poate, face o prelucrare astfel ca cele 4 macros să ruleze mai simplu şi în Word 2010... 2012... şi ce a mai apărut.
   


@Seven, am facut un tutorial despre cum pot fi integrate macrourile din template-ul tau in Word 2007 si 2010.
Avantajul este ca avem acele macrocomenzi direct in Word fara a fi nevoie sa deschidem de fiecare data un template separat.
Sper ca am reusit sa fiu cat se poate de riguros, de exact si de explicit.
Este posibil sa fie destul de complicat pentru unii mai incepatori dar am pus aproape exlusiv print-screenuri cu pasii enumerati ... sper sa fie simplu.
Pentru intrebari sau nelamuriri... sunt prin zona.

Tutorial

Cam asa arata ceea ce obtinem, un ribbon nou si patru butoane, cate unul pentru fiecare macro. Poate nu am fost foarte inspirat la alegerea iconurilor pentru butoane, dar fiecare poate sa aleaga ce buton doreste.


LE: Nu a incercat nimeni? Sunt curios daca a reusit cineva. Sau poate este prea complicat sau inutil tutorialul?


 
   
#91
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Îmi pare rău că din nişte motive legate de proasta funcţionare a computerului meu a trebuit să scanez şi rescanez computerul cu tot felul de AV şi pentru că rezultatele au fost nemulţumitoare a trebuit să reinstalez de câteva ori Win.
      Înainte de ultima instalare Win am uitat să-mi salvez dicţionarele OCR_DIC, cele la care am lucrat în perioada februarie-mai, astfel că în urmă cu două săptămâni am făcut download dicţionarelor care se aflau pe mediafire.
      Între timp am periat din nou dicţionarele, dar nu pot recupera ceea ce lucrasem în timp de 3 luni.
      Este posibil să reiau lucrul la ele, pentru că eu chiar cred în acest program, dar nu ştiu când voi reuşi să urc ceva mai bun.

      Dacă voi avea noutăţi, ele vor apărea pe un folder deschis pe mediafire:
      Nume folder: Folder: Z1 Noutăti AC OCR Plus
      Adresă folder: http://www.mediafire.com/?xek25d3diee4z


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#92
ZVONACFIRST
MEMBRU DE BAZA
Din: Bucuresti
Stiu ca sunt persoane care nu reusesc sa actualizeze dictionarele in AutoCorect din cauza ca nu gasesc folderul Roaming.
Descriu in continuare o metoda simpla si rapida, aplicabila in Windows 7, pentru a ajunge la folderul Roaming:
1. Click dreapta pe Desktop
2. New - Shortcut
3. In campul Type the location of the items se scrie: %appdata% si apoi se da Next
4. In campul Type a name for this shortcut se scrie Roaming (este posibil sa fie deja scris) si apoi Finish.
Veti avea pe desktop un shortcut catre folderul buclucas.
Sper sa fie de folos.


 
   
#93
utilitasetveritas
Pe lista neagra
Merci beaucop.

 
   
#94
Seven
Moderator
Din: Ţara Perfectului Simplu
***
     Am constatat în ultimul timp că una dintre marile probleme nerezolvate încă de AC este rămânerea în text a cratimei de la cuvintele rupte la capăt de rând.
     După rularea AC a unui OCR [şi cred că e vorba în primul rând de OCR obţinute cu Abbyy11] rămân o serie de succesiuni de genul literă_mică-cratimă-spaţiu-literă_mică.

     Sunt 3 situaţii:
        1. în primul rând, este vorba de cuvânte despărţite la capăt de rând şi în aceste cazuri ar trebui să ştergem cratima şi spaţiul de după cratimă, astfel încât cuvântul să se unească.
        2. poate fi vorba de cuvinte scrise corect cu cratimă, dar la care a apărut în plus un spaţiu eronat; în această situaţie trebuie şters spaţiul şi păstrată cratima, astfel că vom avea unirea unui cuvânt care conţine cratimă.
        3. mai poate fi vorba de o cratimă fără niciun sens/rol care apare eronat în spaţiul dintre două cuvinte; în acest caz va trebui să ştergem doar cartima şi să păstrăm spaţiul dintre cuvinte.

     Am încercat să rezolv problema cu un dicţionar în glumă, care conţine 6 înregistrări. Nu este un dicţionar în modul obişnuit, ci unul cumva mai altfel.
     Dicţionarul se numeşte "Cratimă eror - cu avertizare.imd"
     În realitate conţine doar 3 modificări, dar la care am adăugat şi 3 înregistrări cu rol de avertizare.
     Al doilea dicţionar,cel care se numeşte "Cratimă eror - simplu.imd", conţine doar înregistrările care fac modificările, dar este mai dificil de rulat.
     Mai fac două precizări: reamintesc că în AC OCR Plus, inclusiv în dicţionare se pot folosi coduri. Codul  ^_ este codul pentru spaţiul obişnuit. Este important de reţinut acest lucru, deoarece acest cod apare în dicţionarul propus.

      Arhiva care conţine cele două dicţionare poate fi downloadată de la adresa:
                     http://www.mediafire.com/?im4seli9l6d6jxq

      Dicţionarul poate fi salvat oriunde şi va fi rulat pur şi simplu după rularea automată, direct din meniul "Editare" -> "Înlocuire multiplă" şi încărcarea dicţionarului.

      Rezolvarea problemelor cratimei-eroare trebuie făcută printr-o metodă profesionistă, dar până la găsirea acestei metode, sunt curios dacă cineva consideră utilă improvizaţia propusă.
      Bineînţeles că aş dori şi propuneri pentru îmbunătăţirea metodei.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#95
Seven
Moderator
Din: Ţara Perfectului Simplu

    DICŢIONAR 4 LITERE



     Am prelucrat de curând în AutoCorect o carte la care am constatat o eroare de mare frecvenţă făcută de Abbyy, cu următoarele caracteristici:
          — eroarea era de fiecare dată de forma „â” final, în loc de „ă” final; toate corecturile au fost de forma „â” >> „ă”;
          — eroarea era determinată de caracteristicile fontului folosit la tipărire, dar nu apărea şi în alte poziţii ale literei, ci doar la final;
          — eroarea a avut apariţii, atât la cuvinte scurte de 4÷5 litere, dar şi la cuvinte lungi şi foarte lungi.

     Atenţie! O astfel de eroare poate apărea la unele cărţi, dar poate să nu aibă nicio apariţie la alte cărţi.

     Înlocuirea cu confirmare pusă la dispoziţie de dicţionarele de la opţiunea „10.3 Înlocuiri cu confirmare”, oferă posibilitatea corectării complete, dar este dificil de folosit ca urmare a numărului mare de confirmări ce trebuie făcute, respectiv a timpului mare necesar.

     Nu am mai întâlnit o astfel de eroare cu o frecvenţă atât de mare, astfel că până acum aveam doar o înregistrare cu confirmare care putea modifica pe „â” final în „a, ă sau î”.

     Pentru că, aşa cum am arătat, în cazul meu toate „â” finale erau în realitate „ă” final, m-am gândit să rezolv problema la cuvintele scurte cu frecvenţă mai mare din limba română, prin rularea modificărilor într-un dicţionar cu înlocuire automată, pentru a nu mai pierde timpul cu confirmările.

     De exemplu, cuvinte scrise eronat de forma „tatâ, tavâ, taxâ, tezâ, tijâ, tisâ, tobâ, tocâ, tonâ, tubâ, turâ, tuşâ, tuvâ”… se modifică automat în forma corectă „tată, tavă, taxă, teză, tijă, tisă, tobă, tocă, tonă, tubă, tură, tuşă, tuvă”…

     Pentru ca numărul de cuvinte înregistrate în dicţionare să nu fie prea mare, am ales să mă ocup, cel puţin pentru moment, doar de cuvinte formate din 4 litere şi cuvinte formate din 5 litere.
     Pentru a preveni eventualele înlocuiri neprevăzute, am ales ca toate modificările să fie înregistrate cu condiţiile „Cuvânt întreg la ambele capete” plus „Păstrează capitalizarea”

     Condiţia „Cuvânt întreg la ambele capete” înseamnă că există o singură formă a cuvântului de căutat; astfel „altâ >> altă”, va face modificarea doar asupra cuvântului întreg „altă”, neafectând cuvintele de genul „ailaltă, alaltăieri, asaltări, baltă, exaltări, saltă, tresaltă” care conţin secvenţa „altă”

     Condiţia „Păstrează capitalizarea” înseamnă că înlocuirea va păstra modul de scriere cu litere mici sau mari a cuvântului de modificat, corectând atât cuvântul „altâ > altă”, cât şi „Altâ > Altâ”, dar şi „ALTÂ > ALTĂ”.

     După cum se ştie, dacă aş fi pus condiţia „Potrivire perfectă” în locul condiţiei „Păstrează capitalizarea”, atunci s-ar fi realizat doar modificarea „altâ > altă”, iar cuvintele scrise sub forma „Altâ” şi „ALT” ar fi rămas nemodificate.


     Căutarea este una destul de migăloasă, cu un consum mare de timp, cel puţin în prima fază, astfel că reactualizarea completă pentru cuvintele de 4 şi 5 litere va necesita ceva timp.

     Am făcut căutări de cuvinte cu 4 litere cu ajutorul funcţiei clasice de căutare din AutoCorect, care oferă posibilitatea folosirii codului < ^l > pentru orice literă, astfel că folosind formula de căutare < a^l ^l ă >, ceea ce înseamnă <litera a - orice literă – orice literă – litera ă >, deci toate cuvinte de 4 litere care încep cu litera „a” şi se termină cu litera „ă”, indiferent care sunt literele de pe poziţia 2 şi 3.
     După găsirea unui număr de 4÷5 cuvinte, le-am trecut într-un dicţionar temporar şi am înlocuit aceste 4÷5 cuvinte cu secvenţe de genul „xxxx”, „yyyy” sau „zzz”, astfel că la următoarea căutare aceste cuvinte nu mai existau în text şi am căutat următoarele 4÷5 cuvinte, procedând în acest mod până la epuizarea tuturor cuvintelor de 4 litere care încep cu litera „a” şi se termină cu litera „ă”

     Pentru prima fază a căutării am folosit un fişier text al romanului „Gheişa”.

     Pentru găsirea altor cuvinte de 4 litere [dar şi pentru cele cu 5 litere, la care lucrez] am continuat căutarea în încă 7 fişiere, care conţineau fiecare câte un ciclu format din 3-9 volume, fiecare ciclu fiind comprimat în câte un singur fişier text.
     Este vorba despre ciclurile: Floris = 4 vol., Mizerabilii = 3, Război şi pace = 4, Torente = 6, Winnetou = 2, Ramses = 5 şi Juneţea = 9 vol [6 episoade de pe forum + 3 episoade noi traduse, care sunt în curs de corectare].

     Verificarea în câte un ciclu nou este destul de simplă în comparaţie cu prima fază, deoarece după încărcarea fişierului în AutoCorect, rulez dicţionarul de înlocuire a cuvintelor găsite cu una dintre secvenţele menţionate „xxxx sau yyyy”, urmând la la căutarea „a^l^lă” să apară doar cuvinte noi, care nu mai sunt în număr mare. Se întâmplă bineînţeles, ca la unele dintre cicluri, căutarea să nu mai returneze niciun rezultat, semn că toate cuvintele de patru litere cu condiţia de mai sus să fi fost deja găsite.

     Am continuat cu căutarea cuvintelor de acest gen care încep cu litera b, c, d, e, ….  x, y, z.

     Am găsit în acest mod 325 de cuvinte din 4 litere care se termină în litera „ă”. În dicţionare mai existau deja câteva, astfel că numărul total este un pic mai mare… undeva între 340 şi 350.
     Sunt convins că mai există şi alte cuvinte, dar dacă ele nu se regăsesc în cele 34 de volume folosite la căutare, înseamnă că frecvenţa lor este destul de mică şi nu vor afecta în mod serios textul.

     Toate aceste cuvinte au fost înregistrate în dicţionarul CO_Sc4.imd, care a fost dezvoltat de la 388 la 700 înregistrări.

     Dicţionarul CO_Sc4.imd reactualizat l-am urcat pe mediafire sub formă de arhivă RAR neparolată.


     Nume fişier:  [2013.11.13] CO_Sc4.rar
     Adresa:         http://www.mediafire.com/?4c1dzasxn9hk750

     La cuvintele de 5 litere care se termină în litera „ă” sunt în acest moment în faza de căutare a cuvintelor. Probabil că înregistrarea modificărilor acestor cuvinte se va face în dicţionarul CO_CImf2.imd, dar mai durează câteva săptămâni.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#96
Seven
Moderator
Din: Ţara Perfectului Simplu

    DICŢIONAR 5 LITERE


     Am încercat să mă ţin de cuvânt şi am realizat un dicţionar cu cele mai frecvente cuvinte de 5 litere care se termină în „ă” şi pe care Abbyy le-ar putea recunoaşte eronat cu „â” ca literă finală.
     După găsirea şi selecţionarea cuvintelor am verificat dacă vreunul dintre aceste cuvinte poate exista în forma corectă cu litera „î” în final.
     Pentru căutare, selecţionare şi verificare am folosit 11 fişiere de tip TXT şi RTF, formate fiecare din 3 la 14 volume; am folosit fişierele amintite la dicţionarul anterior, la care am mai adăugat:
         — MUSCHETARII [Cei trei muschetari; După douăzeci de ani; Vicontele de Bragelonne];
         — P. ERDMAN [Filiera Elveţiana; Panica din 89; Ultimele zile ale Americii];
         — Nora ROBERTS [1 Îmblânzitoarea de suflete; 2 Iubire peste timp; 3 Jurnalele unei prostituate de lux; 4 Mai îmbătător decât vinul; 5 Paşi spre fericire; 6 Păcate sacre; 7 Păstrează visul; 8 A fost odată o stea; 9 Trilogia cercului - 3vol; 10 Triumful dragostei; 11 Treptele iubirii; 12 Visuri împlinite];
         — BALZAC [1 Eugénie Grandet; 2 Faimosul Gaudissart; 3 Iluzii pierdute; 4 Ursule Mirouët; 5 Vicarul din Tour].

     Dicţionarul conţine un număr de 856 de cuvinte.
     În funcţie de dorinţa fiecărui user, el poate fi folosit în două moduri:
          ■ ca dicţionar de tip OCR_DIC care rulează automat, sub numele „CO_CImf2.imd”. La înregistrările existente în CO_CImf2.imd am adăugat noile înregistrări, astfel că dicţionarul are în noua formă un număr de 871 înregistrări.
          ■ ca dicţionar independent care se poate rula în grup la opţiunea „9 Rulare grup dicţionare ÎM”, sub numele de „Cuvinte 5 Lit â-ă final.imd”.

     În principiu, dicţionarul CO_CImf2.imd cu îmbunătăţirile aduse nu va prelungi prea mult durata rulării automate, dacă nu vor fi modificări de făcut, fapt pentru care eu recomand folosirea dicţionarului CO_CImf2.imd în forma îmbunătăţită.
     Pentru userii care nu doresc asta, atunci vor păstra vechiul CO_CImf2.imd şi în funcţie de numărul de apariţii al situaţiilor în care „ă” final apare în text ca „â” la opţiunea „10.3 Înlocuiri cu confirmare”, vor stabili dacă rulează suplimentar dicţionarul  „Cuvinte 5 Lit â-ă final.imd”.
     E adevărat, în timpul căutărilor făcute de mine am avut şi situaţii de rulare de lungă durată, dar menţionez că am folosit şi fişiere care aveau în jur de 2500 de pagini, şi toate cuvintele din dicţionar erau înlocuite cu grupul  de caractere „zzz” sau „x-x” ca să elimin cuvintele şi să pot căuta altele noi neînregistrate încă.

     Reamintesc faptul că rularea AutoCorect are eficienţă maximă la rularea cărţilor de circa 200, maxim 250 de pagini. Dacă avem cărţi mai mari este mult mai bine ca să fie împărţite în 2 sau 3 fişiere mai mici.
     Subliniez că dacă rulăm un text de circa 250 de pagini, vom avea o anume durată. Dacă vom rula un fişier de 500 de pagini, deci de două ori mai mare, durata de rulare nu va fi de două ori mai lungă, ci de 2×2=4 mai lungă, adică 2 la pătrat. Dacă vom rula un fişier de trei sau patru ori mai mare, mi-e şi frică să spun care este pătratul lui 3 sau al lui 4.
     Deci, o carte de 800 de pagini va rula într-un timp de 4 ori mai mare decât timpul total necesar pentru rularea a 4 fişiere de câte 200 de pagini.
     Din acest motiv recomand rularea fişierelor pe bucăţi ceva mai mici, chiar dacă avem impresia că vom pierde timp mult la confirmările de la ultima opţiune. În realitate timpul total va fi mai scurt la rularea unui text mare împărţit pe bucăţi decât în cazul rulării sale într-un singur şi mare fişier.


     Am urcat pe mediafire dicţionarele în cele două variante: ca dicţionar separat [„Cuvinte 5 Lit â-ă final.imd”] şi ca dicţionar  „CO_CImf2.imd” îmbunătăţit.
     Pentru studierea de către cei interesaţi, am urcat şi un fişier „doc” ce cuprinde transpunerea în format doc a dicţionarului, sub numele de „Corectură â-ă final cuv. 5 litere.doc”

     Fişiere urcate pe mediafire şi adrese:
     [2013.11.22] Cuvinte 5 Lit â-ă final.rar   https://www.mediafire.com/?bm3pyxq75dqm17o
     [2013.11.22] CO_CImf2.rar                 https://www.mediafire.com/?y1dkk175rdqa7ua
     Corectură â-ă final cuv. 5 litere.doc    https://www.mediafire.com/?oowvaroc52du3do


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#97
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Intenţia mea este să micşorăm la maxim numărul de intervenţii ale utilizatorului pe timpul rulării.
      Mă refer la ultima opţiune, "10.3 Înlocuiri cu confirmare".

      Prefer ca în locul unei înregistrăru cu confirmare la care utilizatorul ar acţiona de 10-15 ori, să fac un dicţionar cu câteva sute de înregistrări, dar să-i uşurez munca utilizatorului. problema este că în puţine cazuri se poate face acest lucru.

      Cred că ar fi de preferat ca utilizatorul să intervină în mai puţine cazuri, chiar dacă programul va rula ceva mai mult.

      Menţionez un lucru, spre liniştirea utilizatorilor.
      Erorile de genul celor corectate în ultimele două dicţionare, în care ă final este recunoscut în mod eronat ca â final sunt erori ce ţin în mod exclusiv de recunoaşterea optică făcută de Abbyy sau alt program de tip recognito.

      Astfel de erori nu pot apărea sub nicio formă la convertirea din limbajul clasic în limbaj contemporan sau la altă opţiune rulată de AutoCorect.
      Acest "â" final eronat nu a fost niciodată "î ".

      Intenţionez deocamdată să mă ocup tot de litera finală, dar de data aceasta de "î" final care apare eronat în locul lui "i", ca în cazurile: căcî, decî, scriî, deviî...


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#98
Seven
Moderator
Din: Ţara Perfectului Simplu
***
     Am afirmat într-o postare anterioară, dar şi în alte situaţii, că rularea optimă a AutoCorect OCR Plus se face pentru texte rezultate din 200 de pagini de carte tipărită, maxim din 250 de pagini şi că nu este indicată rularea unei cărţi de mari dimensiuni.

     Pentru a nu părea că e vorba despre o simplă speculaţie, ori o afirmaţie gratuită, am încercat să demonstrez acest lucru şi am făcut câteva teste care pot fi reluate de oricare user interesat.

     Am făcut mai multe testări AutoCorect cu un număr de 5 fişiere de 200, 400, 600, 800 şi 1000 de pagini.
     Practic, am pornit de la un OCR brut rezultat din 200 de pagini de carte tipărită, pe care l-am numit "T200 pg.rtf".

     Copiind acest OCR de două până la cinci ori, am obţinut încă 4 fişiere [T400, T600, T800 şi T1000] care sunt mai mari de 2, 3, 4, respectiv de 5 ori decât fişierul iniţial.

     Am rulat aceste texte prin AutoCorect, folosind absolut aceleaşi opţiuni, urmărind timpul total de rulare pentru fiecare fişier în parte.
     La unul dintre teste am activat un număr de 21 de opţiuni din cadrul celor 10 pachete. Timpul total necesar pentru experiment a fost de câteva ore şi nu am prelucrat încă rezultatele. Totuşi, aceste rezultate pot fi văzut în imaginile notate 20 ÷ 25.

     Un experiment mult mai simplu ce poate fi reluat sau dezvoltat de oricare dintre useri a constat în activarea unui număr foarte mic de opţiuni [cinci opţiuni] şi rularea fiecărui fişier în AC.
     Este vorba de 4 opţiuni relativ simple care nu rulează dicţionare, la care am adăugat opţiunea „9 Rulare grup dicţionare”, care în cazul meu are un număr de 28 de dicţionare cu un total de circa 1550 de înregistrări, opţiune ce a produs 73 de modificări la fişierul T200.
În imaginea următoare se regăsesc rezultatele testării.



     Imaginea cred că este suficient de sugestivă.
     Menţionez că toţi timpii au fost convertiţi în secunde.

     Aş dori să observăm că dacă la fişierul T400 care este exact de 2 ori mai mare decât T200, timpul de rulare total este de doar 2,57 de ori mai mare, ajungem la fişierul T1000 care este de 5 ori mai mare decât fişierul T200, în timp ce timpul total de rulare este de 13,36 ori mai mare.

     Mai departe: urmărind opţiunea „1.3 Elimin tab” [numele complet: Eliminare tab şi spaţii multiple], constatăm că rulează primul fişier în timp de ≈ 31 secunde, iar fişierul T1000 în timp de 8 minute şi 46 de secunde [526 secunde], timp care este de ≈ 17 ori mai mare decât în cazul primului fişier, deşi T1000 este doar de 5 ori mai mare decât fişierul T200.

     Aceste valori nu trebuie luate ca adevăr absolut, deoarece ele nu au aceeaşi valoare în toate situaţiile;  ele depind de numărul de opţiuni, de complexitatea lor, de numărul de căutări şi numărul de modificări făcute etc. valoarea lor diferă, dar tendinţa este aceeaşi.

     Oricare ar fi opţiunile activate, duratele de rulare şi diferenţele de mărime dintre fişierele de diferite dimensiuni, tendinţa este una singură: cu cât este mai mare un text, cu atât rularea sa într-un singur fişier va consuma mai mult timp.
     Este mai rentabilă rularea în pachete de câte 200÷250 de pagini, deoarece timpul total necesar pentru rularea a trei fişiere componente va fi mult mai mic decât timpul necesar pentru rularea textului întreg într-un singur fişier.

     Am urcat pentru cei interesaţi o arhivă RAR neparolată în care pot fi găsite cele 5 fişiere text şi imaginile cu rezultatele celor două testări.

     Nume arhivă:   Test rulare T200-T1000.rar
     Adresă arhivă:  http://www.mediafire.com/?eu5t1kwqfalt6wa


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#99
Seven
Moderator
Din: Ţara Perfectului Simplu

                Dicţionare OCR_DIC - ultima reactualizare  07.12.2013



      Aşa cum am mai menţionat, scopul meu principal a fost să micşorăm la maxim numărul de intervenţii ale utilizatorului pe timpul rulării opţiunii  „10.3 Înlocuiri cu confirmare”.

     Am considerat că este mai comod pentru utilizator să lase programul să „ronţăie” în linişte dicţionare automate mai mari, decât să fie nevoit să confirme sau nu zeci de situaţii pe care i le oferă dicţionarele cu confirmări.
     Este posibil ca unii utilizatori să considere că mărirea numărului de înlocuiri automate va mări durata de rulare a programului, ceea ce este relativ corect, dar menţionez că durata de rulare a unui dicţionar este influenţată în mod special de numărul de înlocuiri făcute şi mai puţin de numărul de căutări.

     Am făcut diverse modificări, dar m-am ocupat în mod special de corectarea unor cuvinte formate din 4 şi 5 litere, care se termină în mod corect în „i” sau în „ă” şi care sunt reproduse eronat de către Abbyy în „î” sau „â”. De asemenea am urmărit corectarea cuvintelor de 3 litere în care „î” apare în mod eronat în locul lui „i”, atât în poziţie iniţială, cât şi mediană şi finală.
     Am făcut modificări în majoritatea dicţionarelor OCR_DIC, dar principalele dicţionare la care s-au adus un număr mare de înregistrări sunt: CO_Sc3.imd pentru cuvinte formate din 3 litere, Co_Sc4.imd pentru cuvinte formate din 4 litere şi Co_Cimf2.imd pentru cuvinte formate din 5 litere.

     Pentru prevenirea eventualelor efecte secundare, am verificat toate înlocuirile sub forma:
     Cuvânt eronat >> „zzz”  cu condiţiile „Cuvânt întreg” + „Păstrează capitalizare” + „Confirmare”, ceea ce înseamnă că am putut vedea orice existenţă în text a unui cuvânt definit iniţial ca eronat.
     Acolo unde au apărut cazuri în care cuvântul considerat eronat apărea în formă corectă, am eliminat modificarea. De exemplu: pentru că există bir – bâr, fin – fân, mir – mâr – măr, pir – pâr – păr, rid – râd, rit – rât, sir – săr, vid – văd, vâri – vârî… astfel de situaţii şi multe altele, nu au fost prinse în dicţionare.

     Textele în care am făcut verificările sunt următoarele:
     ■ 01. A.Golden – Memoriile unei gheişe = 1 vol.
     ■ 02. J.Monsigny - Ciclul FLORIS = 4 vol.
     ■ 03. V.HUGO - Mizerabilii = 3 vol.
     ■ 04. L.N. TOLSTOI – Război şi pace = 4 vol.
     ■ 05. A.M. Desmarest – Ciclul TORENTE = 6 vol.
     ■ 06. Karl May – Winnetou = 2 vol.
     ■ 07. Christian Jacq – Ciclul RAMSES = 5 vol.
     ■ 08. Ponson du Terrail – Juneţea regelui Henric = 9 vol.
     ■ 09. Al.Dumas – MUSCHETARII [Cei trei muschetari; După douăzeci de ani; Vicontele de Bragelonne];
     ■ 10. P. ERDMAN [Filiera Elveţiana; Panica din 89; Ultimele zile ale Americii];
     ■ 11. Nora ROBERTS [1 Îmblânzitoarea de suflete; 2 Iubire peste timp; 3 Jurnalele unei prostituate de lux; 4 Mai îmbătător decât vinul; 5 Paşi spre fericire; 6 Păcate sacre; 7 Păstrează visul; 8 A fost odată o stea; 9 Trilogia cercului - 3vol; 10 Triumful dragostei; 11 Treptele iubirii; 12 Visuri împlinite] = 14 vol.
     ■ 12. BALZAC [1 Eugénie Grandet; 2 Faimosul Gaudissart; 3 Iluzii pierdute; 4 Ursule Mirouët; 5 Vicarul din Tour]. = 5 vol.
     ■ 13. J. Grisham – [Şi vreme e ca să ucizi, Firma, Cazul Pelican, Clientul, Camera morţii, Juriul, Avocatul străzii, Testamentul] = 8 vol.
     ■ 14. G.R.R. Martin – CGF [Urzeala tronurilor, Încleştarea regilor, Iureşul săbiilor, Festinul ciorilor, Dansul Dragonilor]


     Dicţionarele OCR_DIC reactualizate la 07.12.2013 au fost urcate în folderul cunoscut de pe mediafire în format arhivă RAR neparolată.

     Nume arhivă: OCR_DIC [Contemporan] 2013.12.07.rar
     Adresa folderului:  https://www.mediafire.com/?aozlgwpimcpqt

     Menţionez că acestea sunt ultimele modificări pe care le aduc Dicţionarelor AutoCorect OCR Plus. În acest moment îmi închei şi eu activitatea în echipa AutoCorect.

     Sper ca dicţionarele să fie de folos!
     Sănătate şi toate cele bune!


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
#100
Seven
Moderator
Din: Ţara Perfectului Simplu
***
      Ştiu că o serie de persoane evită rularea opţiunii „10.3 Înlocuiri cu confirmare”.

      Referitor la op. „10.3 Înlocuiri cu confirmare” care rulează dicţionarele CO_Var4.imd – CO_Var7.imd informez că am reorganizat dicţionarele astfel încât confirmările agasante să fie în ultimul dicţionar [Var7.imd], aşa încât să se poată ieşi din opţiune, dar să fie făcute deja cele înlocuirile importante.

      În acest sens modificările legate de cifra 1 sau numere de genul 11, 111, 1111 de genul „11 > îl, îi, Îl, Îi, un, nu”… vor fi undeva la finalul opţiunii.
      Dicţionarele sunt încă în lucru şi caut în continuare ca înlocuirile care au multe refuzuri să fie mutate în ultimul dicţionar, aşa cum ar fi şi „ele >> de”, dar şi altele.

      Încerc să stabilesc o înregistrare care să fie cea care-l poate informa pe utilizatorul cu mai puţină răbdare, că din acel moment se poate renunţa la rularea opţiunii.
      Nu am stabilit-o încă, dar ar putea fi ceva de genul „11 >> II”. Utilizatorul va şti că din acel moment urmează înlocuiri la care poate renunţa, urmând ca situaţiilerespective săle rezolve direct la corectarea manuală.

      În maxim două săptămâni voi urca o nouă versiune a dicţionarelor [Var1 – Var7] şi după aceea m-ar interesa nişte constatări, astfel încât să facem ca dicţionarele să fie cât mai eficiente.
      Deocamdată discuţiile pe această temă nu ar fi eficiente, deoarece nu ştim încă despre ordinea în care rulează modificările în dicţionare.


_______________________________________

     Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.


     | TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK |
     | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA |
     | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY |
     | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |

 
   
Pagini:  1 2 3 4 5 6 7 ... 15  
Mergi la