International English Test logo
Blog·Certificate de engleză și niveluri CEFR
Cum se notează testele de engleză? Notare cu IA, evaluatori umani și algoritmi

Cum se notează testele de engleză? Notare cu IA, evaluatori umani și algoritmi

Echipa editorială International English Test·14 Jul 2026·9 min de citire
#english test scoring#IELTS scoring#AI grading#CEFR#language testing

Majoritatea celor care dau un test de engleză se concentrează exclusiv pe scorul lor, fără să întrebe vreodată cum a fost calculat acel scor. Totuși, metoda din spatele cifrei — fie că e un examinator uman, un algoritm de IA sau o combinație hibridă — influențează direct consistența, corectitudinea și cât de mult are încredere în rezultatul tău o universitate, un angajator sau o autoritate de imigrare.

QUICK ANSWER

Testele de engleză se notează prin trei metode principale: evaluatori umani instruiți (vorbirea și scrierea la IELTS), sisteme automatizate de IA (PTE, International English Test) sau o combinație a celor două (TOEFL iBT). International English Test folosește un motor de notare complet automatizat, bazat pe IA, care mapează rezultatele pe cadrul CEFR. Află ce reprezintă scorul tău pe pagina de certificat International English Test.

Ce înseamnă notarea testelor de engleză?

Notarea testelor de engleză este procesul de transformare a răspunsurilor unui candidat într-un rezultat numeric sau pe niveluri, care reprezintă gradul său de competență. Metodele de notare variază de la grile simple de tip corect/greșit pentru itemii cu variante multiple, până la evaluări complexe bazate pe rubrici pentru sarcinile de vorbire și scriere.

Majoritatea testelor la scară largă notează cel puțin patru competențe — citire, ascultare, scriere și vorbire — și combină aceste scoruri într-un singur rezultat, adesea mapat pe Cadrul european comun de referință (CEFR), scala recunoscută internațional cu șase niveluri, de la A1 la C2.

Înțelegerea metodei de notare contează pentru că influențează cât de fiabil, cât de rapid și cât de corect este de fapt rezultatul tău.

Cele trei metode principale de notare

Notarea de către evaluatori umani

Notarea de către evaluatori umani folosește examinatori instruiți care analizează răspunsurile pe baza unei rubrici detaliate. Notarea pe benzi a IELTS este cel mai cunoscut exemplu. Scrierea și vorbirea la IELTS sunt corectate de examinatori certificați pe baza a patru criterii: îndeplinirea sarcinii, coerență și coeziune, resurse lexicale și diversitate și corectitudine gramaticală. Fiecare criteriu are pondere egală, iar cele patru scoruri parțiale sunt mediate.

Punctul forte al notării umane este judecata nuanțată — un examinator priceput poate recunoaște un vocabular sofisticat folosit adecvat, o sintaxă neobișnuită, dar corectă, sau un registru cultural potrivit. Slăbiciunea este fiabilitatea între evaluatori: măsura în care doi examinatori diferiți ar atribui același scor aceleiași prestații. Chiar și cu o instruire riguroasă, evaluatorii umani pot diverge cu 0,5 până la 1,0 puncte de bandă la lucrările aflate la limită.

Notarea automatizată cu IA

Notarea automatizată folosește modele de învățare automată antrenate pe sute de mii de răspunsuri deja notate. Aceste sisteme aplică procesarea limbajului natural (NLP) — ramura IA care analizează textul și vorbirea — pentru a evalua diversitatea vocabularului, complexitatea gramaticală, coerența discursului și, pentru vorbire, pronunția și fluența prin recunoașterea automată a vorbirii (ASR).

Atât PTE Academic, cât și International English Test folosesc fluxuri complet automatizate. Avantajul este o consistență perfectă: algoritmul aplică aceleași criterii de fiecare dată, fără oboseală sau părtinire. Rezultatele pot fi livrate în câteva minute. Limitarea este că modelele de IA actuale pot întâmpina dificultăți cu răspunsurile foarte creative sau ambigue, care ies din tiparul datelor de antrenament.

Pentru o analiză mai amplă a modului în care notarea cu IA afectează testarea orientată către carieră, vezi articolul nostru despre cum influențează notarea cu IA testele de nivel de engleză pentru cariera ta.

Notarea hibridă

Notarea hibridă combină ambele metode. TOEFL iBT folosește IA pentru a nota citirea și ascultarea, apoi trece răspunsurile de scriere printr-un motor de IA (e-rater) în paralel cu un examinator uman. Dacă cele două scoruri diferă semnificativ, este chemat un al doilea examinator uman. Această abordare echilibrează viteza și consistența cu supravegherea umană pentru sarcinile de scriere cu miză mare.

Cum îți notează engleza fiecare test important

Tabelul de mai jos rezumă modelul de notare, scala și alinierea la CEFR pentru cinci teste utilizate pe scară largă.

TestCitire și ascultareScriereVorbireScală de notareAliniat la CEFR
IELTSGrilă de răspunsuri (mașină)Examinator umanExaminator umanBenzi 1–9Da
TOEFL iBTIA/mașinăIA + umanIA (SpeechRater)0–120 puncteDa (aprox.)
PTE AcademicIA / NLPIA / NLPIA / ASR10–90 puncteDa
Duolingo English TestIA adaptivăIAIA10–160 puncteParțial
International English TestIA / NLPIA / NLPIA / ASRA1–C2 CEFRDa

IELTS rămâne standardul de aur pentru notarea umană a vorbirii și scrierii, motiv pentru care este cerut de multe rute de viză pentru Regatul Unit și de autoritățile de imigrare din Australia. PTE și International English Test oferă timpi de răspuns mai scurți pentru că întregul proces este automatizat. TOEFL se situează la mijloc, combinând eficiența IA cu revizuirea umană pentru sarcinile scrise.

Cum funcționează de fapt notarea cu IA

Motoarele de notare cu IA pentru text folosesc o combinație de tehnici:

  1. Extragerea caracteristicilor — modelul identifică elemente măsurabile: variația lungimii propozițiilor, diversitatea vocabularului (raportul tip-token), frecvența erorilor și conectorii de discurs.
  2. Clasificare sau regresie — modelul mapează aceste caracteristici pe o bandă de scor, fiind antrenat pe mii de exemple notate de oameni.
  3. Calibrare — rezultatul modelului este calibrat față de descriptorii oficiali CEFR pentru a garanta că o predicție de B2 corespunde cu adevărat unei prestații de nivel B2.

Pentru răspunsurile vorbite, ASR transcrie mai întâi conținutul audio, apoi un model NLP separat evaluează transcrierea din punctul de vedere al fluenței, vocabularului și gramaticii, în timp ce modelele acustice analizează ritmul, accentul și claritatea pronunției.

Când eșuează notarea cu IA

Notarea cu IA poate produce rezultate nefiabile în situații specifice:

  • Zgomotul puternic de fundal degradează precizia ASR, făcând sistemul să interpreteze greșit cuvintele rostite.
  • Code-switching — amestecarea englezei cu o altă limbă în mijlocul răspunsului — poate deruta clasificatoarele NLP.
  • Accentele nestandard, subreprezentate în datele de antrenament, pot primi scoruri de fluență mai mici decât ar acorda evaluatorii umani.
  • Memorarea de șabloane: unii candidați folosesc fraze de eseu învățate în prealabil. Modelele de IA sunt tot mai des antrenate să penalizeze acest lucru, dar folosirea sofisticată a șabloanelor poate încă umfla scorurile de scriere pe anumite platforme.

Furnizorii de încredere abordează aceste moduri de eșec prin reantrenarea continuă a modelelor, date de antrenament care includ o diversitate de accente și declanșarea revizuirii umane atunci când scorurile de încredere scad sub un prag stabilit.

Fiabilitatea între evaluatori și de ce contează

Fiabilitatea între evaluatori (IRR) este o măsură statistică a cât de constant diferiți evaluatori — sau o IA și un evaluator uman — atribuie același scor. Se exprimă de obicei printr-un coeficient de corelație (de la 0 la 1,0), unde valorile peste 0,80 sunt considerate acceptabile pentru testele lingvistice cu miză mare.

O IRR scăzută creează o problemă de corectitudine: dacă doi candidați trimit lucrări de scriere la fel de bune, dar primesc scoruri diferite din cauza variației dintre examinatori, testul nu măsoară ceea ce pretinde că măsoară. Notarea cu IA elimină în mare parte varianța dintre examinatori, dar introduce un risc diferit: părtinirea modelului, în care erorile sistematice din datele de antrenament produc predicții distorsionate sistematic pentru anumite grupuri de candidați.

Soluția de bune practici este validarea transparentă: publicarea statisticilor IRR, a auditurilor de părtinire și a studiilor de aliniere. Când alegi un test, caută furnizori care publică deschis aceste cifre, în loc să trateze modelul lor de notare ca pe o cutie neagră.

Dacă vrei să compari formatele de test mai pe larg, ghidul nostru despre compararea testelor de engleză online și a IELTS pentru admiterea la universitate explică cum influențează diferențele de notare deciziile de acceptare.

Cum alegi un test în funcție de modelul său de notare

Scopuri diferite cer modele de notare diferite:

  • Imigrare și admitere la universități cu miză mare — IELTS sau TOEFL sunt de regulă cerute, întrucât metodologiile lor de notare sunt menționate explicit în documentele de viză și în politicile de admitere.
  • Certificarea de engleză pentru locul de muncă — testele notate cu IA, precum International English Test, oferă rezultate mai rapide, costuri mai mici și certificate mapate pe CEFR, ușor de interpretat de echipele de resurse umane.
  • Plasarea academică și dezvoltarea personală — testele adaptive cu IA (Duolingo, International English Test) oferă feedback rapid și detaliat și sunt potrivite pentru identificarea lacunelor de competențe înainte de un studiu formal.
  • Certificarea celor patru competențe la un buget accesibiltestul Eng4Skills acoperă citirea, ascultarea, scrierea și vorbirea într-o singură sesiune, cu notare prin IA și rezultate aliniate la CEFR.

Greșeli frecvente pe care le fac candidații privind notarea

  • Presupunerea că toate testele aliniate la CEFR sunt echivalente. Calitatea alinierii la CEFR variază. Un certificat B2 autodeclarat de un test nevalidat cântărește mult mai puțin decât unul de la un furnizor acreditat ALTE.
  • Ignorarea scorurilor parțiale. Un scor general de bandă poate masca o prestație slabă la o competență. Analizează întotdeauna defalcarea secțiune cu secțiune.
  • Convingerea că IA nu poate evalua creativitatea. Modelele NLP moderne evaluează structura discursului, sofisticarea lexicală și coerența argumentației — nu doar regulile de gramatică.
  • Alegerea unui test doar după viteză. Timpul de răspuns contează, dar un rezultat rapid de la un test nefiabil poate să nu fie acceptat de instituția sau angajatorul pe care îl vizezi.
  • Necererea unei recorectări atunci când scorurile par greșite. Pentru testele notate de oameni există o recorectare formală. Pentru testele notate cu IA, unii furnizori oferă un nivel de revizuire manuală — verifică întotdeauna politica înainte de a considera un scor definitiv.

Concluzie

  • Metodele de notare a testelor de engleză se împart în trei categorii: evaluator uman, IA automatizată și sisteme hibride — fiecare cu compromisuri distincte între consistență, viteză și nuanță.
  • Notarea pe benzi a IELTS folosește examinatori umani instruiți pentru vorbire și scriere, ceea ce îi conferă o acceptare puternică pentru imigrare, dar rezultate mai lente și o oarecare variație între evaluatori.
  • Notarea cu IA (PTE, International English Test, Duolingo) livrează rezultate în câteva minute și elimină oboseala examinatorului, dar necesită date de antrenament riguroase și audituri de părtinire pentru a rămâne corectă.
  • O fiabilitate între evaluatori peste 0,80 este reperul din industrie — întreabă întotdeauna dacă un furnizor publică această cifră.
  • Când notarea cu IA eșuează — audio cu zgomot, accente rare, abuz de șabloane — cei mai buni furnizori folosesc praguri de încredere și declanșarea revizuirii umane pentru a proteja corectitudinea față de candidat.

Ești gata să vezi notarea cu IA în acțiune? Dă testul nostru gratuit de nivel de engleză și primește un rezultat mapat pe CEFR în mai puțin de 20 de minute — fără programări la examinator, fără zile de așteptare pentru un rezultat.

Întrebări frecvente

Pentru sarcinile de citire, ascultare și gramatică, notarea cu IA se apropie mult de precizia umană — adesea în limita a 0,1 dintr-un scor de bandă. Pentru scriere și vorbire mai complexe, sistemele de top combină IA cu revizuirea umană pentru a menține fiabilitatea. Modelele de IA bine proiectate, antrenate pe milioane de răspunsuri, pot atinge o concordanță între evaluatori de peste 90%.
IELTS folosește examinatori umani instruiți pentru a nota vorbirea și scrierea pe câte patru criterii fiecare: îndeplinirea sarcinii, coerență și coeziune, resurse lexicale și diversitate gramaticală. Citirea și ascultarea sunt notate automat pe baza unei grile de răspunsuri. Cele patru scoruri de secțiune sunt mediate pentru a produce o bandă generală de la 1 la 9, în trepte de 0,5.
Testele diferite folosesc scale de notare, tipuri de sarcini și sisteme de evaluare diferite. Un rezultat B2 la un test nu echivalează automat cu același nivel la altul, chiar dacă ambele susțin că sunt aliniate la CEFR. Verifică întotdeauna dacă un test a fost validat independent față de cadrul CEFR înainte de a compara rezultatele.
Testele complet automatizate, precum International English Test, returnează de obicei rezultatele în câteva minute după trimitere. Testele care combină IA cu revizuirea umană — cum ar fi TOEFL — durează de regulă 4–8 zile. Notarea exclusiv umană, ca în cazul vorbirii la IELTS, necesită programarea unui examinator și durează de obicei 3–13 zile, în funcție de formatul de desfășurare.
Fiabilitatea între evaluatori măsoară cât de constant doi sau mai mulți examinatori atribuie același scor aceleiași prestații. Un coeficient peste 0,80 este considerat în general acceptabil în testarea lingvistică. O fiabilitate scăzută înseamnă că rezultatul unui candidat poate varia în funcție de examinatorul care îi corectează lucrarea — o problemă majoră de corectitudine.
International English Test

Echipa editorială International English Test

Membru asociat ALTE · Evaluare britanică de engleză · din 2023

Ți-a fost util acest articol? Distribuie-l:

Ești gata să-ți obții certificatul de engleză?

Dă testul de nivel de engleză și obține-ți certificatul CEFR instant.

Începe — de la £12.99