Sa implementez 0.41 sau se va face un 0.42 cu modificarile discutate dupa 0.41?
Modifică ce este de modificat si ce s-a discutat apoi pui versiunea sa o testam. Vedem atunci ce probleme mai sunt.
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
*** Lucrez acum la o versiune de Listă a meniurilor. Lista ia în considerare şi modifică meniul ultimului executabil, având menţiuni de stergere şi mutare de opţiuni, de modificare nume sau de introducere de noi opţiuni, toate raportate la meniul ultimului executabil şi nu la ultima listă.
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
*** Dacă ai implementat 0.41 e foarte bine; după ce văd noul executabilul, pot reveni mult mai repede cu un 0.51, care să fie în concordanţă cu meniul real al executabilului.
Am adăugat un nou pachet de opţiuni care se referă la marcare şi ştergere de caractere eronate, unde am pus tot ce s-a propus pe forum pentru marcare sau ştergere [sper că n-am sărit peste ceva]. Am făcut şi alte modificări de mutare a opţiunuilor.
Cosmin, nu vreau să dau peste cap munca de programare făcută; dacă se pot face mutările opţiunilor - e bine, dacă implică prea multă muncă - pot rămâne şi în varianta deja implementată.
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
*** Am văzut noul meniu. Mă apuc de o Listă 0.51, reactualizată la ultimul executabil, doar că aştept părerea voastră despre noul pachet de opţiuni care se referă la marcare şi ştergere de caractere eronate. Le-am grupat astfel, considerând că opţiunile au cât de cât legătură între ele.
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
*** Pentru ca modificările să fie mai uşor de urmărit, am urcat o nouă listă de meniuri reactualizată, care cuprinde doar modificări faţă de ultima versiune a executabilului AutoCorect. MENIU OCR_PLUS [V0.5].doc: http://www.mediafire.com/?euzgy7ec85o7d
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
Meniul "Convertire linii de dialog" nu este în versiunea ta 5.0 - probabil va fi la pc. 10
Ai propus pt. punctul 5 următoarele:
"5. MARCARE ŞI ŞTERGERE CARACTERE ERONATE: [NEIMPLEMENTAT] 5.1. – Eliminare Cratimă în format: "Cratimă_spaţiu" şi "Spaţiu_Cratimă 5.2. – Eliminare Apostrof în format: "Spaţiu_ Apostrof _Spaţiu” 5.3. – Eliminare răgălii independente în format „Spaţiu_Ragalie_Spaţiu”--------------> GREŞIT: răgăliile se înlocuieşte cu "nimic" nu este condiţionat de precedare şi urmare de spaţiu. Răgălie = caracter eronat. Doar apostroful precedat şi urmat de spaţiu este răgălie. 5.4. – Marcare ghilimele cu roşu – mutat de la 2.4 5.5. – Marcare consoane independente în format „Spaţiu_Consoană_Spaţiu” 5.6. – Marcare caracterele: ~ @ # $ % ^ & * ( ) _ + } { [ ] | \ / > < --------------> GREŞIT: caracterele @ # $ % ^ _ + | > < trebuiesc ELIMINATE, se marchează cu roşu doar ~ & * ( ) } { [ ] \ / 5.7. – Marcare/Ştergere răgălii lipite de alte caractere – Se trec toate marcările şi evidenţierile propuse"
Eu aş propune aşa:
- La 5.1, 5.2, 5.3, cred că se poate face cu un singur dicţionar [acela pus de mine ieri, mai conţine şi un semn ca un cercuţeţ plin care este eroare de OCR pentru eliminare răgălii] - La 5.4, 5.5 şi 5.6 ar trebui unite şi titlul ar trebui redenumit, pt. că nu va marca numai ghilimele, ci şi consoanele precedate şi urmate de spaţiu, precum şi caracterele:~ & * ( ) } { [ ] \ / evident şi apostroful simplu. Atenţie! Acest meniu trebuie pus după Eliminarea răgăliilor pentru că avem răgălie "spaţiu""apostrof""spaţiu" - 5.7 nu îşi mai are rostul [deocamdată]
Propusesem ca acolo unde există 2 sau mai multe rânduri aceste să fie transformate într-unul singur - acum eu aş vedea locul acestuia ca fiind ultimul din "Convertiri preliminare".
O altă problemă nediscutată este "sfârşitul de pagină" adică acolo unde se termină textul şi el continuă pe pagina următoare. Am văzut unele OCR-uri care au astfel de "sfârşituri de pagină" frecvent. Propunerea mea ar fi dacă considerăm necesar să eliminăm acest sfârşituri de pagină pentru că locul lor este îmtr-o versiune v1.0 şi nu în OCR.
Am observat că dacă colorez textul, Autocorectul nu îl reformatează ca Automat, este o scăpare sau nu a fost implementat deloc. OCR-uri cu culoare nu am văzut dar este posibil ca un OCR să aibă mai multe nuanţe de negru-automat. Cum este acum Autcorectul "vede" aceste diferenţe de negru-automat şi le uniformizează ca fiind culoarea Automat?
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
In ce priveste culoarea nu a fost implementat nimic ca s-o uniformizeze. Nu-mi amintesc sa fi mentionat cineva de asta pina acum. Dar se poate implementa, nu-i greu.
PS: doar o intrebare: culoarea textului sa fie setata implicit la negru, sa fie utilizata culoarea predominanta din text sau sa se poata seta in acea fereastra?
In ce priveste culoarea nu a fost implementat nimic ca s-o uniformizeze. Nu-mi amintesc sa fi mentionat cineva de asta pina acum. Dar se poate implementa, nu-i greu.
PS: doar o intrebare: culoarea textului sa fie setata implicit la negru, sa fie utilizata culoarea predominanta din text sau sa se poata seta in acea fereastra?
Cred că ar trebui ca indiferent de culoare-nuanţa textului, el să fie setat pe culoarea Automat. Dacă se poate implementa o fereastră care să permită alegerea nuanţei-culorii pentru tot textul ar fi bine - asta dacă nu este prea complicat, cred că se poate face în fereastra accea cu font deja implementată.
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
CULOAREA - propun să rămână neimplementată uniformizarea culorii sau dacă se implementează, să poată fi debifată, şi am să mă explic de ce: Înainte de a face trecerea textului prin AutoCorect, eu fac trecerea de la Section Break la Paragraph Break, eliminarea numelui titlului şi autorului, atunci când ele apar în antet şi... de foarte multe ori evidenţiez numele capitolelor în câte o culoare specifică, pentru a-mi fi mai uşor la formatarea de după rularea în AutoCorect. Dacă avem un text deja formatat la rularea prin AutoCorect se pierde formatarea; dacă încercăm să-l reformatăm la fel după rularea prin AutoCorect, atunci culorile ne-ar putea fi de folos.
La pachetul 5 am pus mai multe opţiuni, pentru că m-am gândit că cineva ar putea avea o carte care conţine informaţii în cifre, monedă etc... la care ar fi bine să se păstreze caractere precum: - + % & / etc... dar vrea să dispară caracterele care seamănă cu cele grafice de tip bullets: ■ □ ▪ ▫ ● .... etc. Sau, poate cineva ca mine vrea să-şi păstreze consoanele independente, acare uneori pot apărea în locul literelor a, e o... Din aceste cauze am încercat să fie menţionate mai multe opţiuni care să poată fi activate sau nu.
Dacă prin Meniul "Convertire linii de dialog" te referi la posibilitatea ca liniile de dialog să poată fi transformate din orice linie în "Em dash" sau "En dash" sau "Horizontal bar", atunci ea nu este prinsă deocamdată, dar poate fi implementată la ■ 10 sau oriunde, după ■ 5. Eu am încercat să prindem în AutoCorect ceea ce nu se poate face în Word, iar o astfel de convertire necesită în Word o singură comandă...
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
CULOAREA - propun să rămână neimplementată uniformizarea culorii sau dacă se implementează, să poată fi debifată, şi am să mă explic de ce: Înainte de a face trecerea textului prin AutoCorect, eu fac trecerea de la Section Break la Paragraph Break, eliminarea numelui titlului şi autorului, atunci când ele apar în antet şi... de foarte multe ori evidenţiez numele capitolelor în câte o culoare specifică, pentru a-mi fi mai uşor la formatarea de după rularea în AutoCorect. Dacă avem un text deja formatat la rularea prin AutoCorect se pierde formatarea; dacă încercăm să-l reformatăm la fel după rularea prin AutoCorect, atunci culorile ne-ar putea fi de folos.
De acord. Dacă Cosmin poate face cu bifare sau debifare atunci este bine. Dacă nu merge atunci Cosmin nu va mai face uniformizarea culorilor.
Seven a scris:
La pachetul 5 am pus mai multe opţiuni, pentru că m-am gândit că cineva ar putea avea o carte care conţine informaţii în cifre, monedă etc... la care ar fi bine să se păstreze caractere precum: - + % & / etc... dar vrea să dispară caracterele care seamănă cu cele grafice de tip bullets: ■ □ ▪ ▫ ● .... etc. Sau, poate cineva ca mine vrea să-şi păstreze consoanele independente, acare uneori pot apărea în locul literelor a, e o... Din aceste cauze am încercat să fie menţionate mai multe opţiuni care să poată fi activate sau nu.
Atunci propun altceva, mai larg ca cerinţe pt. fiecare user:
"5. MARCARE ŞI ŞTERGERE CARACTERE ERONATE: [NEIMPLEMENTAT] 5.1. – Eliminare Cratimă în format: "Cratimă_spaţiu" şi "Spaţiu_Cratimă 5.2. – Eliminare Apostrof în format: "Spaţiu_ Apostrof _Spaţiu” 5.3. – Marcare ghilimele cu roşu – mutat de la 2.4 5.4. – Marcare consoane independente în format „Spaţiu_Consoană_Spaţiu” 5.5. – Marcare caractere. Se marchează de obicei pt. cărţi obişnuite: ~ & * ( ) \ / precum şi apostroful simplu. 5.6. – Marcare caractere. Se marchează de obicei pt. cărţi tehnice: ~ & = + - [semnul minus] $ [semnul dolarului], Ł [semnul lirei sterline], %, &, #, {, }, [, ], (, ), /, \, > [adică semnul mai mare], < [adică semnul mai mic], * [adică semnul înmulţirii]. 5.7. – Ştergere răgălii pentru cărţi obişnuite: @ # $ Ł % ^ _ + = | > < {, }, [, ] precum şi: ■ □ ▪ ▫ ● .... etc - evident bazat pe un dicţionar. 5.8. – Ştergere răgălii pentru cărţi tehnice: @ ^ & _ | precum şi: ■ □ ▪ ▫ ● .... etc - Evident bazat pe un dicţionar.
Evident toate pot fi bifate şi debifate în funcţie de text. Sper că aşa satisface cât mai multe cerinţe. Dacă mai sunt propuneri de adăugare de caractere la unul din puncte, le vom analiza. Sper să nu-mi sfi scăpat ceva.
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
- Setare culoare font = DA, default=neactivat - Opţiunea 5 - aşa cum e acum , doar că am o problemă cu asteriscul, care apare frecvent în cărţile de beletristică pe post de indice-marcator de note de subsol. Nu cred că ar fi bine să fie prins în opţiunile de ştergere. - la apostrofoasele astea e o problemă... cred că înainte de marcare, undeva în dicţionarele L1-L3.imd ar trebui ca toate tipuri de apostrofuri să convertească într-un singur mod... dar nu ştiu exact dacă merge, pentru că în dicţionare ale apar la fel...
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
Atunci rămâne aşa: - Opţiunea 5 - aşa cum e acum , doar că am o problemă cu asteriscul, care apare frecvent în cărţile de beletristică pe post de indice-marcator de note de subsol. Nu cred că ar fi bine să fie prins în opţiunile de ştergere.
În niciuna din opţiunile de ştergere nu este implementat ca să şteargă asterixul.
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
Dar, daca asta nu va merge, poate exista alta solutie (mai greu de implementat dar care are sanse): codul va scana textul si, cand gaseste ceva de genul "consi- deram", cauta "consideram" in dictionarul de ortografie, il gaseste si atunci uneste cele 2 bucati.
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."
*** - astersisc - ai dreptate, nu e propus pentru ştergere; am încurcat eu rândurile.
- în legătură cu propunerea lui Cosmin: pentru că e mult de muncă pentru o astfel de implementare [programul nu rulează cu module de cod, ci cu cod separat cap-coadă pentru fiecare opţiune în parte], pentru că la ora asta este încă de lucru la actualele opţiuni, propun să finalizeze actuala versiune în forma propusă până acum, ca să poată implementa rularea automată, iar apoi să se facă îmbunătăţiri la versiunea finalizată; vor fi mai uşor de tras concluzii după ce se finalizează versiunea.
PROBLEMĂ NOUĂ Pentru ca o parte dintre opţiuni să poată fi implementate cât mai bine, este necesară implementarea unor coduri pentru unele semne şi caractere, printre care cele mai importante sunt: spaţiu, spaţiu neseparabil, ghilimele româneşti, apostrof românesc, Em dash, En dash, Horizontal bar... şi poate şi altele.
Menţionez că AutoCorect are implementat în acest sens un singur cod: Tab = ^t. Alte coduri pot fi implementate. Nu este obligatoriu ca aceste coduri să fie cele folosite de Word, ele pot fi şi altele; pe de altă parte cred că ar fi bine ca ele să fie cât de cât aceleaşi pentru ca să nu ne încărcăm memoria cu alte coduri.
Aş face primul pas, propunând următoarele: ^s - spaţiu obişnuit ^w - spaţiu neseparabil ^m - Em dash ^n - En dash ^h - Horizontal bar ^a - Apostrof românesc
Aştept propuneri de modificare a acestor coduri, precum şi de adăugare a altor coduri ce ar putea fi necesare, în special pentru editarea dicţionarelor.
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
*** Mi se pare excelent să se poate activa şi dezactiva fiecare opţiune în parte şi mai ales să se poată alege şi culoarea pentru marcarea semnelor. În modul ăsta, întregul pachet poate fi redus la două opţiuni de genul acesta: una pentru cele patru opţiunile de marcare color şi una pentru cele patru opţiuni de ştergere... Sau... pentru ştergere nu se poate proceda similar?
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
*** Dacă se poate implementa şi la ştergere, atunci cred că e foarte bine să faci două opţiuni care rezolvă tot. Trebuie găsite nişte nume suficient de sugestive pentru cele două opţiuni. Oricum în loc de "răgălii" propun să folosim "artefacte"
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
Aş face primul pas, propunând următoarele: ^s - spaţiu obişnuit ^w - spaţiu neseparabil ^m - Em dash ^n - En dash ^h - Horizontal bar ^a - Apostrof românesc
Aştept propuneri de modificare a acestor coduri, precum şi de adăugare a altor coduri ce ar putea fi necesare, în special pentru editarea dicţionarelor.
De ce trebuie cod la spatiul normal? Toata lumea il are pe tastatura.
Acele coduri de mai sus, sunt personalizate sau sunt codurile din Word? Spatiu neseparabil e ^s, nu ^w
Nu merg puse la combinatii de taste? Sau in fine... ce e cu ele?
*** Deocamdată în AutoCorect este implementat un singur cod: Tab = ^t
Pentru ca dicţionarele care conţin spaţii normale sau neseparabile să fie mai uşor de editat, să fie mai vizibile, mă interesează să pot folosi astfel de coduri, care să se vadă în dicţionar, pentru că altfel practic nu "văd" ce conţin dicţionarele decât atunci când folosesc butonul editare. De exemplu: vreau să şterg răgălia asta ■ sau asta □ Este mult mai simplu și mai comod ca în dicționar să se vadă ceva de genul ^s■^s în care presupunem că ^s ar fi spațiu. Mai apoi mă interesează să pun în dicţionar că orice fel de linie însoţită sau nu de răgălii se transformă în Em dash; doar că în dicţionar, Em dash seamănă cu Horizontal bar, ceea ce mă face să nu ştiu exact dacă folosind Copy & Paste am pus exact linia care îmi trebuie. În concluzie, aceste coduri mă interesează doar pentru editarea dicţionarelor.
În ceea ce priveşte faptul că spaţiul neseparabil este ^s, şi nu ^w, asta nu contează la acest moment, pentru că în AutoCorect nu există nici unul, nici altul. Există coduri în Word... etc., dar nu în AutoCorect. Încearcă o chestie: pune într-un dicţionar la "căutare" un cuvânt, o literă ceva... iar la "Înlocuieşte cu.." pune acelaşi cuvânt urmat de codul ^s şi vezi ce rezultat are modificarea.
De abia acum se pune problema să fie implementate. Şi doar pentru a putea fi folosite în dicţionare...
Problema este dacă sunteţi şi voi de acord cu implementarea unor astfel de coduri pentru dicţionare sau nu... şi ce alte coduri credeţi că ar mai fi necesare. Cred că acum e mai clar... Sau mă înşel?
_______________________________________ Oameni şi popoare îşi cată libertatea; după ce-o obţin, îşi caută stăpân.
Spuneam mai sus: "5.6. – Marcare caractere. Se marchează de obicei pt. cărţi tehnice: ~ & = + - [semnul minus] $ [semnul dolarului], Ł [semnul lirei sterline], %, &, #, {, }, [, ], (, ), /, \, > [adică semnul mai mare], < [adică semnul mai mic], * [adică semnul înmulţirii]."
Trebuie să NU marcăm semnul minus deoarece este posibil să fie confundat cu cratima!!! Eroarea este că va marca şi semnul minus şi cratima!
_______________________________________ ---> "Eu nu am regrete, Iar dac-ai să-ntrebi ce-a rămas la mine, În inimă am urme de tine Regrete, eu nu am regrete..."