Provocările numărării algoritmice a silabelor
Determinarea automată a numărului de silabe dintr-un text prezintă dificultăți majore din cauza complexității limbilor naturale. În limba engleză, regulile de scriere nu corespund întotdeauna cu pronunția reală. Variațiile de accent regional, stilul de vorbire și excepțiile istorice de ortografie fac imposibilă stabilirea unui algoritm care să ofere o certitudine absolută pentru fiecare cuvânt.
Din acest motiv, instrumentul utilizează reguli specifice adaptate pentru a aproxima pronunția sau pentru a aplica reguli ortografice stricte, semnalând în același timp cazurile ambigue. Utilizatorul poate analiza textul introdus prin intermediul a trei reguli de contorizare distincte:
- Estimare English: Această regulă estimează pronunția standard în limba engleză și marchează riscurile cunoscute legate de accent sau ortografie.
- Español · ortografic: Această opțiune aplică regulile scrise din limba spaniolă pentru vocale, diftongi și hiați, menționând că pronunția reală poate varia în funcție de regiune.
- Grupuri de vocale · regulă transparentă: O regulă de bază care contorizează o singură dată fiecare grup consecutiv de vocale de la A la Z, toate rezultatele obținute prin această metodă fiind marcate ca estimări.
Funcționarea interfeței și limitele de procesare
Instrumentul este conceput pentru a analiza texte de dimensiuni mici și medii, cum ar fi poezii, versuri de cântece sau paragrafe de text. Pentru a asigura o funcționare optimă, există limite tehnice clare privind volumul de date introdus:
- Limita de caractere: Textul introdus în câmpul de analiză trebuie să fie de maximum 50.000 de caractere. Dacă această limită este depășită, sistemul va afișa mesajul de eroare:
Textul este prea lung. Păstrați-l sub 50.000 caractere.. - Limita de cuvinte: Textul nu trebuie să depășească 5.000 de cuvinte. În caz contrar, va fi afișat mesajul:
Textul are prea multe cuvinte pentru a fi afișat. Păstrați-l sub 5.000 cuvinte.. - Absența cuvintelor: Dacă textul introdus nu conține caractere alfabetice sau cuvinte ce pot fi procesate, se va afișa eroarea:
Nu s-au găsit cuvinte contorizabile. Alegeți o regulă potrivită sau adăugați un text bazat pe litere..
Atunci când câmpul de introducere este gol, interfața afișează mesajul de stare Pregătit. Adăugați text pentru a-i estima silabele.. În zona dedicată rezultatelor, utilizatorul va vedea textul Textul dumneavoastră adnotat va apărea aici însoțit de indicația Adăugați text sau încărcați exemplul pentru a vedea fiecare cuvânt, totalul pe linie și estimările incerte..
Butonul Exemplu permite încărcarea unui text demonstrativ, în timp ce butonul Șterge curăță zona de introducere și declanșează mesajul de stare Textul și rezultatele au fost șterse..
Analiza detaliată a rezultatelor și exportul datelor
După introducerea textului și selectarea regulii, instrumentul generează o serie de indicatori statistici exacți:
- Caractere: Numărul total de caractere din textul analizat.
- Silabe: Numărul total estimat de silabe.
- Cuvinte: Numărul de cuvinte contorizabile identificate.
- Linii: Numărul total de linii din text.
- Revizuire: Numărul de cuvinte care necesită o verificare manuală din cauza riscurilor de pronunție sau ortografie.
Mesajul de stare generat în urma analizei este de forma: Aproximativ ‹total› silabe în ‹words› cuvinte; ‹review› marcate pentru revizuire.. Pentru fiecare linie din text, se afișează un total parțial sub forma Linia ‹number›.
Fiecare cuvânt din text este analizat individual. Cuvintele fără riscuri sunt afișate sub forma ‹word›: ‹count› silabe. În cazul în care un cuvânt prezintă un risc de estimare incorectă, acesta este afișat sub forma ‹word›: ‹count› silabe; revizuire: ‹reason›.
Utilizatorul poate folosi butonul Copiază detaliile pentru a prelua o structură organizată a rezultatelor, care include etichetele standardizate Regulă, Totalul și Revizuisește aceste cuvinte.
De ce sunt marcate anumite cuvinte pentru revizuire
Anumite structuri lingvistice și tipare ortografice nu pot fi procesate cu certitudine prin reguli automate. Secțiunea Cuvinte de revizuit listează toate aceste cuvinte problematice. Dacă textul nu conține astfel de elemente, secțiunea va afișa mesajul: Nu există marcaje de risc suplimentare pentru acest text. Regula selectată rămâne o estimare..
Motivele pentru care un cuvânt este marcat pentru revizuire sunt extrem de specifice:
pronunția poate varia în funcție de accent sau de stilul de vorbire: Se aplică cuvintelor a căror structură silabică se modifică în funcție de dialectul vorbitorului.acesta poate fi rostit ca inițiale sau ca un cuvânt: Se aplică abrevierilor și acronimelor care pot fi citite pe litere sau ca un cuvânt de sine stătător.ortografia nu se potrivește cu limba selectată: Apare atunci când se detectează caractere sau cuvinte din alte limbi care nu respectă regulile engleze sau spaniole.numerele sau simbolurile neobișnuite fac cuvântul neclar: Se aplică termenilor care conțin cifre sau caractere speciale ce pot fi citite în moduri diferite.acest model de vocale nu este de încredere conform regulii selectate: Se aplică combinațiilor de vocale ambigue care pot forma fie un diftong, fie un hiat, în funcție de cuvânt.
Convențiile ortografice în limba spaniolă și limba engleză
Regula pentru limba spaniolă (Español · ortografic) se bazează pe normele scrise ale limbii, care definesc modul în care vocalele puternice (A, E, O) și cele slabe (I, U) se unesc sau se separă. Algoritmul calculează automat prezența diftongilor, triftongilor și a hiaților. Cu toate acestea, în vorbirea curentă, accentele regionale pot transforma un hiat într-un diftong sau invers, motiv pentru care rezultatul final rămâne o aproximare a normei academice scrise.
În limba engleză, lipsa unei corespondențe directe între litere și sunete face ca regula Estimare English să se bazeze pe tipare de pronunție standard. Deoarece engleza conține numeroase cuvinte împrumutate și reguli de accentuare variabile, marcajele de revizuire sunt esențiale pentru a ghida utilizatorul către o verificare manuală a termenilor atipici.
Confidențialitatea datelor și procesarea locală
Analiza textului introdus în acest instrument se realizează exclusiv local, în interiorul browserului web al utilizatorului. Textul nu este încărcat pe serverele BroBroGo și nu este transmis către nicio altă destinație externă. Acest mod de funcționare asigură că datele introduse rămân strict în dispozitivul de pe care se efectuează analiza.
Întrebări frecvente
Sunt exacte numerele de silabe?
Nicio regulă ortografică automată nu poate stabili cu certitudine fiecare pronunție. Rezultatele pentru English sunt estimări, limba spaniolă urmează o convenție a limbii scrise, iar cuvintele marcate ar trebui verificate în funcție de modul în care le pronunțați.
Ce reguli de contorizare sunt disponibile?
Alegeți o estimare a pronunției în English, o convenție ortografică pentru limba spaniolă sau o regulă transparentă care contorizează o singură dată fiecare grup consecutiv de vocale. Aceste reguli nu oferă suport pentru alte limbi.
De ce sunt marcate unele cuvinte pentru revizuire?
Cuvintele sensibile la accent, abrevierile, scrierile cu caractere mixte, ortografia neobișnuită și modelele vocalice ambigue pot împiedica aplicarea unei reguli scrise. Lista de revizuire menține aceste cuvinte vizibile fără a le ascunde estimarea curentă.