Forum Romania Inedit
Romania Inedit - Resursa ta de Fun
|
Nou pe simpatie: Profil Alesiandra
 | Femeie 24 ani Cluj cauta Barbat 28 - 58 ani |
|
|
Forum Romania IneditReguliInregistrareLoginPozeNu sunteti logat. Lista Forumurilor Pe Tematici
|
| #151 |
|
|
Seven a scris:
Revin asupra răgăliilor: încerc să fac o listă cu câteva semne care apar mai des pe lângă numărul de pagină... ele vor fi într-un număr redus... nu mai mult de zece cazuri. Mai există 10 cifre... plus maxim 10 răgălii... ar fi un total de 20 de caractere. În acest caz poţi găsi o formulare în care un paragraf să conţină doar aceste caractere, fie ele separate [numai cifre sau numai răgălii] sau combinate cifre cu răgălii? |
Nu pot sa fiu 100% sigur decat daca incerc dar daca cunosc ce caractere intra in compozitia acestor paragrafe pot sa spun ca probabilitatea de reusita creste mult.
Seven a scris:
Poate şi lungimea acestui tip de paragraf ar trebui să o mai reducem... Am propus maxim 10 caractere, pe considerentu că avem deja exemple de cărţi cu peste 1000 de pagini, deci cu 4 cifre la numărul de pagină, la care dacă se adaugă un spaşiu sau o răgălie devin deja 5 caractere. Numărul "5" mi se pare cam mic, dar parcă şi "10" e cam mare... poate ceva între 5 şi 10 ar fi mai bine. |
Punem media 7,5  7 sau 8 e bine, te las pe tine sa decizi ca tu ai experienta mai multa cu asa ceva. Oricum dupa implementare se pot face niste teste si se poate "regla fin"....
|
|
| |
|
| #152 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** 7,5? Dacă e după mine... n-aş putea alege niciodată opt, ci doar şapte... cum ar fi ca unul pe care-l cheamă "şapte" să aleagă numărul "opt"?...
Lista cu răgălii va cuprinde câteva caractere de genul: ■ ♦ Trebuie să mai umblu prin nişte OCR brut să văd ce mai apare... Probabil cel mai bine este să le trec într-un fişier "doc" sau "txt"
Ar mai fi o soluţie... În urmă cu câteva zile am stabilit că dacă se pune la "Înlocuiri multiple" un caracter cu condiţiile "Început paragraf" + "Sfârşit paragraf" şi la "înlocuieşte cu" nu punem nimic, în final va rezulta un rând gol, deci un paragraf gol.
E posibil să scăpăm de câteva situaţii de paragrafe care conţin răgălii, dacă înainte de Punctuaţie rulăm un dicţionar cu astfel de paragrafe foarte scurte care conţine numai răgălii şi care se vor transforma în paragrafe goale.
Acest dicţionar nu va necesita un timp prea lung de rulare, pentru că va avea puţine înregistrări şi va face foarte puţine modificări. Practic va dura mai mult scanarea textului decât înlocuirile ce vor fi făcute.
În această situaţie "paragraful întrerupt, va fi unul care vine după un "Paragraf Gol" sau un "Paragraf Cifre"... şi vedem ce facem şi cu cele răgălii...
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #154 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
|
| |
|
| #155 |
|
|
Am inteles, Equinox.
Seven, daca esti sigur ca va merge mai bine cu dictionar facem asa... O sa bag cele 2 conditii respectiv si conditia ca textul obisnuit in paragraful anterior sa se termine cu .?! si elipsis.
|
|
| |
|
| #156 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
|
| |
|
| #157 |
|
|
Am implementat toate optiunile. Cred ca ar fi bine sa fie testat temeinic si abia dupa aceea, daca totul e in ordine, pus in topicul principal...
Intrebare: acum ca punctuatia implicit nu mai schimba dialogurile franceze, mai e necesara "4.5 Conversie majuscula in minuscula la dialog francez"?
|
|
| |
|
| #158 |
|
|
Teoretic nu.
Dar e mai bine sa ramana in ambele locuri.
Odata la Punctuatie pentru se lucreaza si cu texte ce nu necesita rularea Ocr_Plus-ului, a doua oara (inutila pentru mine ) pentru ca POATE cei ce ruleaza OCr_Plus fac tot atunci si Punctuatia. Oricum pe un ocr, dupa rularea Ocr_Plus-ului, a Punctuatiei si a Ortografiei, o sa fie nevoie iarasi de o rulare a Punctuatiei pentru ca s-au facut schimbari maricele in text.
|
|
| |
|
| #159 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
|
| |
|
| #160 |
|
|
Da, trebuie sa ramana si 4.5 dar ma gandeam sa fie totusi debifata implicit. Intre timp am mai facut cateva mici ajustari la exe, ca de exemplu redenumirea 4.6 in 4.5. Am si debifat implicit 4.5 pentru a se testa. Daca se decide totusi bifarea implicita e usor de modificat inapoi.
|
|
| |
|
| #161 |
|
|
Seven, cum sa fie denumita optiunea care scoate acele ragalii inainte de punctuatie, cum sa se denumeasca dictionarul si pe ce pozitie sa fie pusa..?
|
|
| |
|
| #162 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Debifate implicit: 4.5 - Da - Să fie devifat implicit. 1.6 - Rupere rânduri... - mai trebuie testat, dar deocamdată pare să rupă acolo unde n-ar trebui. Abbyy pune Em dash în locul unora dintre liniile de pauză, iar AC face rupere acolo, crezând că linia de pauză este un dialog. Să rămână şi el implicit debifat.
Opţiunea care scoate răgălii... Poziţia în meniu. Cred că prima poziţie la pachetul 2 despre punctuaţie e cel mai bine. Numele?... Cam dificil... "Eliminare paragraf-artefact" - ar fi o denumire scurtă, dar nu ştiu dacă e suficient de sugestivă. Nume dicţionar: DEPA sau DArtef... ceva de genul ăsta... parcă DArtef ar părea mai sugestiv un pic. E bine să aibă un nume astfel ca la indexare să fie printre primele.
Deci, "2.1 Eliminare paragraf-artefact", rulează dicţionarul CO_DArtef.imd / CO_DArtef.imd [sau CO_DEPA.imd / CO_DEPA.imd].
Mai sint câteva aspecte de discutat la meniul OCR_Plus... unele mai simple, altele mai complicate... dar am aşteptat să definitivăm punctuaţia.
Cea mai simplă dintre ele, dar necesară, este o modificare la "1.2. Setare text la font şi mărime unică" Avem acolo o bifă pentru Font Bold+Italic = Font Italic... Cred că înţelegi la ce mă refer. Se simte nevoia a încă unei opţiuni de genul ăsta şi anume: Font Bold = Font Drept. Fontul Bold apare în multe locuri unde Abbyy nu a fost foarte sigur pe recunoaştere, dar şi pe la numere de pagină etc. ceea ce este destul de enervant... Cu toate acestea uneori poate fi folositor, aşa că nu aş înclina spre eliminarea definitivă din formatarea finală, ci doar în posibilitatea de păstrare sau nu.
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #163 |
|
|
4.5 ramane debifata. 1.6 e facuta cu cod si nu cu dictionar. Cand determina ca e dialog nu se uita la tipul liniutei ci la ce e in jurul liniutei. Poti te rog sa-mi dai exemple de situatii in care nu "rupe" bine? De preferat sa-mi arati paragrafele nu doar fraza. Am sa adaug "2.1 Eliminare paragraf-artefact" ce ruleza CO_DArtef.imd.
As inclina totusi ca denumire spre "Bold >> Normal". La cealalta e mai usor de inteles ca se aduna si rezulta Italic, la asta din '=' se intelege mai mult "egalitate". Iar optiunea va fi debifata implicit. PS: vrei ca bold-ul sa fie scos numai din formatarile ce au doar bold sau vrei sa fie scos din formatarile ce au ori numai bold ori bold + altele?
|
|
| |
|
| #164 |
|
|
Vreau sa cer si eu nelamurire 
Exista sau nu o optiune care sa transforme toate tipurile de linie orizontala in cratime simple?
Daca toate liniile s-ar face cratime, din 3-4 inlocuiri simple am rezolva o droaie de probleme.
^pCratimaSpatiu > ^pEmDash^s
SpatiuCratimaSpatiu > SpatiuEndashSpatiu
SpatiuCratimaVirgulaSpatiu > SpatiuEndashVirgulaSpatiu
Si cred ca s-ar rezolva si problema ruperii de randuri.
|
|
| |
|
| #165 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** utilitasetveritas, Te nelămuresc eu, ca să fie o nelămurire completă. Nu există o astfel de opţiune, cel putin deocamdată. Eu mă tot gândesc la un ceva ce ar mai rezolva din cuvintele despărtite la sfârsit de rând si care apar în OCR scrise cu cratimă. Ca să fie un număr mai mic de căutări, aş prefera să existe pentru căutare doar cratimele initiale; dacă transformăm toate liniuţele în cratime, s-ar mări numărul de situaţii la căutare şi cred că ar fi mai complicat de găsit cuvintele ce trebuie "unite". E doar un punct de vedere, dar pot renunţa dacă e nevoie si găsim un argument solid.
Despre ruperea eronată a rândurilor... Am constatat asta la cărţile lui James Fenimore Cooper. Cărţile folosesc în mod abundent linii de pauză, în foarte multe situaţii: atât în dialog pentru introducerea comentariului de autor de genul "zise, spuse, zbieră, şopti X", dar şi în interiorul frazelor spuse de personaje, pentru că personajele mai fac câte i paranteză în dialog.
N-am făcut o analiză a situaţiilor constatate... doar le-am corectat si am trecut mai departe. Cum mai am câteva volume bune de corectat, voi "nota" situaţiile, ca să poată fi analizate.
Cosmin, Despre bold... Da, e mai bine semnul > în loc de egalitate. Deci, initial m-am gândit că ar fi bine să păstrăm 3 fonturi: Drept, Italic şi Bold simplu, fără alte combinaţii. Mai departe am propus ca Bold+Italic să rămână Italic simplu... iar acum am constatat că si Bold simplu dă mult de lucru.
Repet, nu cred că ar trebui renunţat definitiv la bold, dar e bine să putem avea posibilitatea ca la unele texte să renunţăm.
Într-o variantă de formatare aş vrea să renunţăm la toate bildurile, fie ele simple sau în combinaţii. În principiu, avem următoarele variante de bold: - Bold simplu >> Drept simplu - Bold+Italic >> Italic simplu - Bold plus orice altceva în afară de italic >> Drept simplu. În final ar rămâne doar Drept şi Italic.
Ştiu... e o problemă cu exponenţii de la notele de subsol, dar Abbyy transforma în indice si exponent mult text obişnuit pentru că i se "părea" lui că e mai mic. Cred că e mult mai bine ca să păstrăm doar "Drept" şi "Italic", iar atunci când avem neapărat nevoie să putem păstra şi "Bold", respectiv "Bold+Italic".
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #166 |
|
|
A... inteleg. Sutam la porti diferite.
Eu ma gandeam la o metoda de uniformizare a liniilor din text. Dar asta nu avea legatura cu liniile tale de la cap de rand.
|
|
| |
|
| #167 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Cosmin, Mă gândeam să te las să mai iei o pauză după definitivarea punctuaţiei... Acum că ai terminat treaba asta, mă gândesc să nu-ţi ieşi din ritm şi, că, poate ar trebui să te ţinem în tensiune ridicată...
Am două probleme: una personală şi una pentru marele public.
Încep cu cea personală: Mi-ai făcut un utilitar de căutare cuvinte şi secvenţe de cuvinte în dicţionarele încărcate de AutoCorect. L-am folosit la maxim şi mi-a fost de mare folos. Dacă aş putea căuta cu un astfel de utilitar secvenţe doar la început de cuvânt sau doar la sfârşit de cuvânt căutările făcute de mine ar fi mult uşurate. M-ar interesa dacă s-ar putea face un astfel de utilitar. Mă descurc şi acum, doar că duc toate rezultatele de la o căutare într-un document word, le indexez şi apoi încep să şterg ceea ce nu mă interesează, ca să-mi rămână doar căutările care îndeplinesc condiţia "la început" sau "la sfârşit" de cuvânt.
A doua problemă are legătură cu astfel de dicţionare de înlocuire secvenţe. Trebuie să-i găsim un loc la o astfel de opţiune. Aici am doar o întrebare: undeva în pachetul 4 ar fi posibilă o opţiune similară cu cea de la 11. Rulare grup de dicţionare? Adică, ar fi mult mai uşor dacă aceste dicţionare nu ar trebui să le numesc într-un mod anume. Aş vrea ca numele să cuprindă secvenţa respectivă ca să fie mai uşor de modificat.
Apăi... deocamdată e suficient. Nu-i nicio grabă; dacă se poate, e bine atunci când se poate.
Cu stimă, Seven
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #168 |
|
|
Ce s-a mai facut: - implementare "Bold >> Normal"; - optiune "2.1 Eliminare paragraf-artefact" ce ruleza CO_DArtef.imd; - am debifat 1.6 implicit pe moment pina imi dai cateva exemple ca sa pot incerca sa o imbunatatesc.
O sa incerc sa imbunatatesc acel utilitar.
Probabil in 4 ar merge. Dar vrei exact o fereastra ca la 11 (sa poti adauga/scoate)? Vrei ca utilizatorul sa aleaga ce sa ruleze manual si sa dea click pe "Ruleaza"? Eu ma gandesc la ceva semiautomat, unde utilizatorul are de ales dintr-o lista predefinita de dictionare + poate chiar cand alege sa se si ruleze automat... E doar o idee... O intrebare: sunt situatii in care se vor utiliza doar o parte din aceste dictionare? Daca da, cum va sti utilizatorul care din ele sa le utilizeze..?
|
|
| |
|
| #169 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** O clipă... să "probez" noul executabil şi revin. Pentru ca să poată rula tot meniul OCR_Plus, m-am grăbit să editez dicţionarul necesar, în cele două variante: pentru AC Contemporan şi AC Clasic. Am urcat cele două dicţionare CL_DArtef.imd şi CO_DArtef.imd, la adresa cunoscută, în folderul: http://www.mediafire.com/?55d9z4rn383zn
După ce am să mai fac nişte îmbunătăţiri la aceste dicţionare şi la cele de cuvinte scurte, am să urc o arhivă actualizată.
Despre opţiunea nouă de la pachetul 4... Problema nu mi-e foarte clară nici mie deocamdată, pentru că sincer nu m-am preocupat în special cum ar fi mai bine pentru utilizator. Despre ce e vorba? Am început de mai mult timp editarea unor dicţionare de Înlocuiri multiple care realizează înlocuiri de secvenţe de câte 3-4 litere, atât din interiorul cuvintelor, cât şi dintr-o margine... de regulă de la sfârşit, deci terminaţii de cuvinte. Aceste dicţionare sunt realizate deocamdată pe tipuri de secvenţe; de exemplu pentru transformarea lui "c" aflat între consoane în "e" şi "l" aflat între consoane în "i", am 36 dicţionare a circa 20-25 înregistrări. După ce aceste secvenţe vor fi verificate şi paraverificate, vor rămâne doar două dicţionare sau chiar unul pentru aceste secvenţe. Până la definitivare, lucrez cu foarte multe. Atunci când mai apare o situaţie în textul pe care-l corectez, caut dicţionarul văd dacă se poate adăuga înregistrarea... Dacă dicţionarele au nume suficient de sugestive pot căuta, respectiv edita mai uşor. Dacă aş nota câteva dicţionare Secv1, Secv2 ... SecvX... ar fi foarte greu de verificat prin ele.
În concluzie, deocamdată... [şi va mai dura o lună-două pentru că mai am foarte multe secvenţe de verificat şi editat] m-ar interesa o funcţie cât mai apropiată de cea de la 11, adică exat asta: să pot adăuga şo şterge dicţionare.
Varianta semiautomată o putem lăsa pentru momentul când aceste dicţionare vor fi gata. Ideea este ca în final, TOATE aceste dicţionare să fie rulate automat, aşa cum rulează cel ce corectează litera L în loc de 1... deci utilizatorul nu va avea prea mult de ales...
Pentru acest moment, dacă ţi se pare mai bine, putem duce opţiunea şi în afara meniului, aşa cum este cea de demarcare, iar când va fi gata va ajunge la pachetul 4.
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #170 |
|
|
Am modificat acel programel: http://www.mediafire.com/?8095ulyv9olmn6k Referitor la adaugarea unei optiuni in 4 asemanatoare celei din 11: de curiozitate, daca tot zici ca va fi temporar, de ce nu incarci momentan dictionarele in 11 si le rulezi de acolo? Daca conteaza si locatia - sa fie rulat neaparat pe la 4, atunci il poti chiar muta acel 11 mai sus in Rularea automata (mouse drag'n'drop sau taste Shift + sageti sus/jos). Daca crezi ca totusi e intr-adevar necesar sa se faca separat o sa incerc sa implementez.
|
|
| |
|
| #171 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Săru'mâna pentru executabilul de căutare. Mi-e mult mai uşor să fac acum căutări de secvenţe doar la început sau doar la sfârşit de cuvânt.
Opţiunea înlocuiri secvenţe de cuvânt. Ea va trebui implementată şi locul cel mai nimerit e în pachetul 4. În final va cuprinde un număr redus de dicţionare şi cu nume clar stabilite.
Ceea ce am vrut să spun este că nefiind definitivată nu pot să spun acum câte dicţionare vor rula şi cum s-ar numi ele, astfel încât să fie implementată într-o formă finală. Aş putea să spun că am nevoie de 10 dicţionare şi să le cheme Secv1.imd... Secv10.imd, doar că asta mă încurcă foarte tare acum pe timpul editării.
Îmi este mult mai simplu să mă folosesc de denumiri care încep cu SI_ SM_ şi SF_ pentru secvenţe de început, de mijloc si finale, la care adaug chiar numele secvenţei. În timp ce fac înregistrări în legătură cu secvenţele finale -mi-le, -mi-se ori -mi-te verific dacă o anume situaţie este valabilă şi la secvenţele finale -ţi-le, -ţi-ne ori -ţi-se; verific dacă am prins astfel de înregistrări şi adaug atunci când este cazul. Atât timp cât ele sunt în dicţionare separate, găsesc mai uşor înregistrările. În plus mă pot folosi de Cop&Paste între dicţionare şi apoi o reeditare sumară...
Da, la acest moment lucrez cu opţiunea de la 11, doar că am 2 variante de ListaDictionare.txt şi trebuie să activez câte una dintre liste pentru o curăţare completă şi cealaltă listă pentru testele de secvenţe. Oricum având posibilitatea de căutare la început de cuvânt şi mai ales la sfârşit, cred că va dura mult mai puţin timp până la definitivare.
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #172 |
|
|
Scuze Seven ca n-am raspuns mai repede dar am intrat iar intr-o perioada in care am mai putin timp liber  Adaugarea acelei optiuni nu e asa de usoara ca modificarea programului de cautat secvente dar daca inca iti mai trebuie doar spune si o sa incerc...
|
|
| |
|
| #173 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Nu e o problemă.
Între timp am mai cugetat şi eu... şi m-am gândit că: - Setarea punctuaţiei este perfect funcţională în forma actuală şi nu e cazul să mai intervenim la ea decât peste un timp mai lung şi, numai dacă vom considera că se mai poate adăuga ceva pentru perfecţionare. Deci, problema asta o putem considera închisă, cel puţin temporar.
- Meniul OCR_Plus: va fi necesar ca în viitor [dar nu în viitorul imediat] să se mai facă niste implementări şi modificări. Voi reveni cu niste propuneri.
- Înlocuiri multiple: Rămâne de văzut dacă se va putea implementa condiţia aia cu "marginile" despre care s-a făcut discuţie în urmă cu ceva timp. După câte îmi amintesc era zona lui Daniel, deci putem să mai aşteptăm, până va avea timp să lucreze la această opţiune. Cred că aceasta va fi ultima îmbunătăţire ce mai poate fi făcută la capitolul ăsta.
- Promovarea programului AutoCorect OCR_Plus: este cea mai importantă problemă acum. După atâta efort depus pentru realizarea unui instrument foarte util, este necesar să fie utilizat de cât mai mulţi useri. În fond, asta ar fi cea mai bună recompensă pentru munca făcută timp de peste 6 luni. La momentul ăsta încerc să pregătesc tutoriale... am deschis un topic special pentru prezentarea programului....
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #174 |
SevenModeratorDin: Ţara Perfectului Simplu
|
|
*** Acum să revin la ceea ce cred că mai poate fi avut în vedere la Meniul OCR_Plus: ■ IMPLEMENTĂRI NOI: - va trebui implementată opţiunea de modificare secvenţe - dar aici nu e nicio grabă, deoarece mai am de lucru încă foarte mult la editarea dicţionarelor. Cred că cel mai bine ar fi dacă se face un cod în care se spune că se rulează dicţionarele următoare: "......." Dacă se poate implementa opţiunea astfel încât cu efort minim să se permită adăugarea în timp a dicţionarelor atunci ar fi cea mai bună variantă. Adică: adun într-un singur dicţionar secvenţele care au dicţionarele gata şi îi dau numele SMed1.imd sau SM_cl.imd pentru că se referă la secvenţe care modifică literele c şi l. Implementăm opţiunea care va rula acest dicţionar. Pe parcurs mai lucrez nişte dicţionare cu secvenţe la început de cuvânt şi realizez un nou dicţionar numit SIni1.imd sau altfel. Dacă se poate face modificarea codului foarte uşor şi se poate să se adauge şi acest dicţionar la cod, astfel ca în acest moment să ruleze ambele dicţionare... atunci ar fi perfect. Problema este că în timp s-ar putea ajunge la mai multe modificări. Nu ştiu dacă dicţionarele respective vor fi în număr de 5 ori 7 sau 10, dar oricum nu vor fi mai puţine de 3 şi nici mai multe de 10. Trebuie văzut care ar fi codul care să permită adăugarea de noi dicţionare cu cât mai puţine modificări de cod.
Să mergem mai departe: ■ MODIFICĂRI DE OPŢIUNI: - trebuie studiată problema 1.6 Rupere rânduri... Deocamdată am doar o constatare: problemele pe care le-am găsit eu au apărut în situaţii care sunt atipice şi puţin folosite în literatură; este vorba de linie de pauză între propoziţii, în cazul meu e vorba de propoziţii care se termină în ! sau ?; deci linia de pauză apărea după ! sau ?, iar Ac a considerat că e linie de dialog. Mai trebuie studiată problema... poate găsim o soluţie similară cu cea de la repararea rândurilor, procedând la setarea diferitelor situaţii.
- la 1.2 Setare text la font si mărime unică. Am constatat că transformarea Bold în Drept consumă foarte mult timp la rulare. Problema eliminării formatărilor bold se poate face în 3 secunde în Word, aşa că nu e o problemă foarte importantă... Mă gândesc dacă în viitor se poate găsi o altă abordare a conversiei.... E o problemă care trebuie studiată mai mult.
- e posibil să există o problemă la demarcare text [ultima opţiune din meniul OCR_Plus]. Nu sunt foarte sigur, dar am avut un OCR care arăta că textul are fundal alb, deşi ar fi trebuit să nu aibă niciun fel de fundal. Mai mult decât atât, nu am reuşit în word să scap de o astfel de problemă.
_______________________________________
Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
| TORENTE | Tăunul | ROCAMBOLE+ | FLORIS | VRACIU | Victor HUGO | J.F. COOPER | PAPILLON | POLDARK | | Dictionare Lba RO | | Gramatica RO | D. Stănoiu | Zaharia STANCU | H.Y. STAHL | V.CORBUL & E.BURADA | | Ultimul regat | Millennium | Shantaram | Pearl BUCK | Anchee MIN | Amy TAN | C. LÄCKBERG | Ph.GREGORY | | Extraterestrii şi Intraterestrii | RUFOR | Demonul Roşu | Vraja milioanelor | Cărţi audio |
|
|
| |
|
| #175 |
|
|
2002 - 2012 = 10 ani.
10 ani din viaţa mea pentru AutoCorect, pentru a fi ce este acum, pentru un start, un colac de salvare ce va salva pe ici pe colo pe unu şi pe altul...
Acum, eu renunţ complet la ce înseamnă AutoCorect, las moştenire tot ce înseamnă AutoCorect colaboratorului şi prietenului meu Cosmin Ciuperca cu care am petrecut momente deosebite dezvoltând aplicaţia mai sus menţionată, chiar dacă nu ne-am întâlnit niciodată face-to-face.
Doresc şi voi trece în uitare aşa cum am început dezvoltarea AC, în linişte, fără susţinători.
Succes în continuare Cosmin, de acum tot greul va fi pe umerii tăi. Sună ciudat, dar îmi este inima grea, simt că mă despart de ceva drag... cu bine..., tuturor.
Daniel Morlova.
|
|
| |
|