Forum Romania Inedit
Romania Inedit - Resursa ta de Fun
|
Nou pe simpatie: andrum94
 | Femeie 24 ani Galati cauta Barbat 27 - 80 ani |
|
|
Forum Romania IneditReguliInregistrareLoginPozeNu sunteti logat. Lista Forumurilor Pe Tematici
|
| #101 |
|
|
Seven, din toate ideile cu care am venit eu legat de Autocorect, cam care se merita sa ramana?
|
|
| |
|
| #102 |
|
|
Si legat de dictionarele tale.... Le-am rulat aseara pe un rtf in ordinea in care au fost notate. Primul dictionar rulat a modificat textul, urmatoarele nu. E ok chestia asta?
Si totodata, desi aici poate ca nu am eu dictionarele puse acolo unde trebuie, la rularea optiunii OCR > Corectarea literei L mica, primesc eroare de dictionar, nu gaseste dictionarul L1.imd
Restul optiunilor de la OCR, le-am rulat pe text, nu au facut probleme, dar nici nu au modificat nimic. O fi textul bun, poate 
Cosmin, se poate ca atunci cand se ruleaza fereastra de diacritice si cea de ortografie, sa putem avea acces la textul din spatele ei? La dacritice, de exemplu, mai vad uneori diverse greseli de text. Daca vreau sa le corectez trebuie sa ies din diacritice, sa corectez si apoi sa revin in fereastra de diacritice.
|
|
| |
|
| #103 |
|
|
Dictionarele trebuie puse asa cum am zis in primul post din topic: in "c:\Documents and Settings\Nume_utilizator\Application Data\AutoCorect Contemporan\Dictionare" respectiv "c:\Documents and Settings\Nume_utilizator\Application Data\AutoCorect Clasic\Dictionare".
Referitor la cele 2 ferestre: ortografia are acces la textul din spate. In ce priveste la diacritice: am mai fost intrebat de acest lucru si aceasta e raspunsul: spre deosebire de ortografie, adaugarea de diacritice e facuta sa lucreze sincron cu textul modificat (adica e facuta sa avanseze numai dupa modificarile pe care le face utilizatorul in acea fereastra). In acest fel e mai stabila si mai rapida. Ca sa o modific sa lucreze precum ortografia, va trebui sa o refac practic de la 0. Si e o gramada de lucru... La momentul cand am inceput s-o fac in versiunea 3+ (acum cativa ani) nimeni nu-mi ceruse asa ceva asa ca m-am gandit ca n-are rost s-o implementez si s-o fac mai instabila si mai inceata. O sa ma gandesc totusi la o solutie de implementare.
|
|
| |
|
| #105 |
|
|
Da, tine de ortografie, deoarece la diacritice de regula se adauga diacritice, nu se scot cele puse incorect. Aceasta se intampla la cuvintele care cand sunt scrise corect nu au diacritice. Dar de exempu daca scrii "învaţăt" in loc de "învăţat", adaugarea de diacritice il va vedea si va vrea sa puna versiunea corecta.
Referitor la sugestiile din a doua imagine, par sa fie ceva cuvinte ce nu au ce cauta in dictionar. O sa verific si le scot daca e cazul...
|
|
| |
|
| #107 |
|
|
Nu era, l-am adaugat. Evident, din dictionare mai lipsesc cuvinte, nu multe. Precum stii e imposibil sa faci un program sa stie absolut toate cuvintele. Nici Word cu ultimele actualizari nu le stie pe toate...
Ortografia e facuta deocamdata sa semnaleze cuvinte cu litere schimbate sau cuvinte lipite nu pe cele taiate. Oricum in imagine se vede ca totusi te-a dus la bucata respectiva unde o poti edita manual, deci tot a facut ceva bun...
Mai ai imagini, ca vad ca esti pe "val" ? 
|
|
| |
|
| #108 |
|
|
Acum am terminat textul. Deci cam atat cu pozele.
Dar sa stii ca s-a simtit ca ai umblat la dictionare. Am o colectie de autor, Brussolo, facuta integral pe Autocorect. Acum 2 zile cand am incarcat, dintr-un moft, unul din acele texte mi-a gasit iarasi greseli in ele, desi am rulat ortografia pana la capat pe ele.
Pe Win7, s-ar putea sa fie probleme cu calea de dictionar. Eu nu reusesc sa o accesez.
Am reusit. Bifat Show Hidden Files si debifat Hide Protected Operating Sistem Files.
C:\Users\Toshiba\AppData\Roaming
|
|
| |
|
| #109 |
|
|
Da, in Windows 7 trebuie sa le bifezi sa se vada. Daca o iei pe calea aratata de mine mai sus, acolo ajungi, dar in Windows 7 unele foldere din acea cale sunt de fapt link-uri la alte foldere. Le observi dupa iconita diferita, de sageata, in loc sa fie galbenul de folder. Eu nu ma complic cu Windows Explorer, folosesc Total Commander la care de ani de zile e bifat sa vada fisierele ascunse.
Oricum, dupa ce dictionarele vor ajunge la versiunea finala, ma gandesc sa le bag direct in kitul de instalare, ca sa nu mai existe asemenea situatii...
|
|
| |
|
| #110 |
|
|
Apropo.... daca rulez acele dictionare folosind fereastra de inlocuiri multiple, nu cred ca mai e nevoie sa mut dictionarele la calea de care vorbeam mai sus, nu?
|
|
| |
|
| #111 |
|
|
Nu, dar ideea e sa le rulezi rapid folosind 2 comenzi din meniu printr-un simplu click pe fiecare in loc sa folosesti Inlocuire Multipla de 7 ori incarcand fiecare dictionar in parte.
|
|
| |
|
| #112 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
Salutări! Deşi nu am mai participat la discuţie, am încercat să mai testes câte ceva. Mai întâi subliniez că folosesc pentru dialoguri caractere şi nu bulett, iar acest caracter este Em dash. Am întâlnit în ultimele OCR situaţii în care dialogul este însoţit de mai multe tipuri de răgălii, ca în poza următoare:
Pe acestea le-am adunat într-un dicţionar "imd", care e setat să caute numai la început de paragraf. Deocamdată nu pun la dispoziţie dicţionarul, pentru a mai adăuga la el şi alte situaţii în următoarele două zile, apoi pot să-l pun la dispoziţie pentru duscuţii şi eventual pentru implementare.
Dacă apar în OCR şi alte situaţii, aş prefera să primesc astfel de situaţii, dar în în fişier de tip .doc Word.
Cosmin, Apropo de butoanele cu setări de început de paragraf din fereastra dicţionarelor de Înlocuiri multiple, cred că trebuie să ne mai gândim cum ar fi mai bine să fie numite, pentru că la momentul actual, cel puţin mie îmi crează ceva confuzii.
Apropo, menssana, la mine în Win 7, dcţionarele se află în calea: Disc local ► Utilizatori ► ZZZZZ ► Appdata ► Roaming ► AutoCorect Contemporan ► Disctionare unde: ZZZZZ este nume utilizator
Toate cele bune! Seven
LE: M-am răzgândit; am urcat pe mediafire versiunea de azi a dicţionarului. 02 Linii dialog 2011.09.21.imd http://www.mediafire.com/?abjyv9x6qdcksej
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #114 |
|
|
Seven, ai dreptate in privinta denumirilor dar e cam greu sa gasesti denumiri bune si scurte  Dar poate cineva are o idee mai buna, cine stie...
Menssana, multumesc, am adaugat la dictionar.
|
|
| |
|
| #115 |
|
|
Seven, printre acele dictionare ale tale, crezi ca au putea sa te ocupi si de un dictionar de convertirea a tuturor tipurilor de linii posibil in cratima si apoi in baza unor conditii in convertirea lor in dialog si pauza? Dupa ce te lamuresti cu problema ta, evident. Nu e graba.
Sau poate ai alte alternative.
|
|
| |
|
| #116 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Menssana, subliniez, chiar dacă s-a înţeles că dicţionarul de mai sus caută doar liniile de la început de paragraf, practic doar dialogurile. El trebuie rulat după rezolvarea celorlalte liniuţe.
Exact în ordinea spusă de tine trebuie făcute modificările: - mai întâi toate să treacă în cratimă; - apoi rezolvate dialogurile - ultimile liniile de pauză sau explicative.
Acum, eu un fel de nedumerire: practic eu nu am întâlnit situaţii în care cratima adevărată să fie văzută de Abbyy ca fiind alfel de liniuţă; de fapt am întâlnit câteav situaţii, dar ceva de genul a 5-6 exemple într-un volum; e vorna de cuvinte foarte scurte de genul: l-am care apărea scris sub forma l—am. Pentru astfel de situaţii putem folosi un Dicţionar de înlocuiri multiple - mi se pare cel mai uşor.
Liniile de pauză [explicative] apar de regulă în varianta < spaţiu-liniuţă-spaţiu > ori în varianta < spaţiu-liniuţă-virgulă >; aceste pot fi înlocuite pe loc; dacă există astfel de liniuţe lipite de text, deja înlocuirea este riscantă, pentru că poate să "prindă" în convertire şi cratime adevărate.
Eu merg pe principiul corectării prin folosirea mai multor instrumente. Unele dintre modificări le-am implementat într-un template mai simplu, dar la care mai lucrez pentru că produce "pagube colaterale".
De exemplu, am întâlnit cuvinte lipite de semnul de punctuaţie din faţa sa; atunci am introdus în template câteva secvebţe care făceau următoarele: mai întâi adăugau câte un spaţiu după fiecare tip de semn de punctuaţie, apoi ştergea spaţiile duble şi respectiv spaţiile de la sfârşit de paragraf. Asta părea corect la prima vedere şi ar fi trebuit să rezolve situaţiile în care cuvintele erau lipite de semnele de punctuaţie din faţa lor. "Pagube colaterale": acolo unde erau numere scrise sub forma < anul 25.000 î.e.n. > a ajuns sub forma < anul 25. 000 î. e. n. >, deci spaţii după puncte în situaţii unde nu trebuie să fie spaţiu; Deci nu merge în cazul punctului, dar nu merge nici după < ! ? ; ... >, pentru că dacă un citat cu ghilimele se termină cu astfel de semne în interiorul ghilimelelor, atunci apare spaţiu între semn şi ghilimelele de închidere, astfel că acestea [adică semnul de închidere ghilimele] la convertire nu mai rămâne sus, ci coboară jos şi trebuie rezolvare individual. Deocamdată efectul pare să fie benefic doar în cazul virgulei şi poate al semnului două puncte. Deci, o chestie de acest gen rezolvă ceva, dar poate deranja altceva. De aceea ziceam că nu orice regulă poate fi implementată. Atunci când opţiunea recurge la dicţionare "imd", avem avantajul că putem edita aceste dicţionare şi că atunci când o înregistrare produce efecte secundare, putem să o eliminăm sau s-o modificăm.
În concluzie, putem încerca şi un astfel de dicţionar, dar putem merge şi pe combinata template, apoi AutoCorect.
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #118 |
|
|
Astea sunt caractere care le pune un editor in locul diacriticelor atunci cand calculatorul nu era setat sa lucreze bine cu diacritce la programele Nonunicode si textul a fost transformat in rtf.
Cine spune ca nu gaseste textul sa-l incarce? AutoCorect? Spune asta doar daca, de exemplu, Windows e setat pe engleza la programele nonunicode si numele fisierului contine diacritice romanesti. In acest caz nu are cum sa-l incarce.
Referitor la inlocuire: e simplu sa o faci cu Inlocuire Multipla. Copii fiecare caracter in casuta de cautare, la inlocuire pui diacritica aferenta (pui chiar majuscula daca e cazul) si bifezi Potrivire perfecta. Probabil sunt 4 cazuri: ş, Ş, ţ, Ţ.
|
|
| |
|
| #119 |
|
|
A... cu potrivire perfecta. Mai exact ce inseamna asta? Dar cuvant intreg?
|
|
| |
|
| #120 |
|
|
Potrivire perfecta si cuvant intreg sunt echivalentele in limba romana la "Match Case" si "Match hole word only" din Wordpad. La prima se considera potrivire doar daca se gaseste cuvantul exact cum a fost scris (litere mici si majuscule). De exemplu daca se cauta "Mare" si in text e "mare", nu il considera potrivire. La a doua se cauta, asa cum spune titlul, cuvant intreg. Daca se cauta "ţi" si intr-un loc e "ţi-aduc", nu considera potrivire.
|
|
| |
|
| #121 |
|
|
Sa incerc sa dau o sugestie pentru cele doua optiuni noi de la Inlocuire multipla: "la inceput de paragraf" "la sfarsit de paragraf" E mai bine...?
|
|
| |
|
| #122 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
|
| |
|
| #123 |
|
|
Da, e bine. Am modificat si am actualizat cele 2 linkuri din prima postare din topic (prima pagina).
|
|
| |
|
| #124 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Am constatat şi eu, dar şi alţi useri faptul că după rularea dicţionarelor care încearcă să rezolve problema cifrei 1 şi a cuvintelor scurte, apare frecvent < să-l > în locul lui < să-i >, dar şi < că-l, dă-l, fă-l > în loc de < că-i, dă-i, fă-i >; Dicţionarul care cuprinde aceste cuvinte este "L1.imd". În orincipiu am folosit acest dicţionar cu un număr mai redus de cuvinte şi nu a făcut probleme; presupun că înregistrările "vinovate" sunt unele adăugate în ultimul timp; mă refer la cuvinte care sunt scrise iniţial < că-I, dă-I, fă-I, să-I > pe care le-am transformat în < că-l, dă-l, fă-l, să-l >, deci e vorba de cuvinte care iniţial au după cratimă litera i mare.
Aceste dicţionare trebuie să fie îmbunătăţite prin scoatere sau adăugare de cuvinte; aştept în continuare astfel de propuneri. În principiu aceste dicţionare pot fi modificate de către fiecare utilizator.
Pe de altă parte, personal nu sunt deranjat de acest lucru, deoarece fac corectura în Word, iar după rularea în AutoCorect, mai fac o serie de modificări Find&Replace la o serie de cuvinte care au cel puţin două variante de forme corecte, cum ar fi: sting-stâng, clar-dar, lingă-lângă, ai-al, la-ia, dar şi altele. Tot aici verific situaţiile în care la început de paragraf şi început de dialog există litera I mare în loc de Î mare... - biensur, tot cu confirmare.
Deocamdată am stabilit nişte etape de precorecturi automate şi semiautomate cu diferite unelte, pentru o versiune care ar putea fi numită [V0.5]. Menţionez că eu consider OCR brut ca nefiind versionat sau dacă ar trebuie să poarte o versiune, ea ar putea fi doar [V0.0]; Notez cu [V0.1] un text rulat prin template, cu [V0.2] - unul rulat prin opţiunile AutoCorect, cu [V0.3] unul prelucrat în Word cu Find&Replace cu confirmare şi aşa mai departe...
LE: Pentru Cosmin Aş vrea să ştiu cum se rulează modificările într-un dicţionar ".imd" Modificările se fac în ordinea înregistrărilor? adică prima înlocuire se face în tot documentul, apoi urmează a doua înlocuire în tot documentul, după care a treia în tot documentul, a patra... etc., sau pur şi simplu toate înregistrările din dicţionar rulează în acelaşi timp?
Ideea era următoarea: Voiam ca într-un dicţionar pentru liniuţe, ca mai întâi toate tipurile de liniuţe să fie transformate în cratimă, apoi corectarea tuturor liniilor de la început de paragraf [cu toate situaţiile în care apar însoţite de alte caractere] să fie transformate în linie de dialog de tip Em dash... şi în final, liniuţele de tip <spaţiu-cratima staţiu> şi <spaţiu-cratima-virgulă> să fie transformate în <spaţiu-horizontal bar-spaţiu>, respectiv <spaţiu-horizontal bar-virgulă>.
Practic mă intresează, dacă aceste toate modificări pot fi înregistrate într-un singur dicţionar sau în două ori trei dicţionare
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #125 |
|
|
Da, in ordinea inregistrarilor, fiecare inlocuire se face in tot documentul. Deci ar merge de exemplu ce vrei tu sa faci cu liniutele.
|
|
| |
|