AI se compară cu evaluatori umani în evaluarea răspunsurilor la examenul de macroeconomie

Florentina

AI ÎN EDUCAȚIE: O COMPETIȚIE CU EXAMINATORII UMANI

Un studiu recent realizat de cercetători de la Universitatea din Passau a adus în atenția publicului o întrebare îndrăzneață: pot AI-urile să concureze cu oamenii în evaluarea răspunsurilor la examen? Rezultatele sunt surprinzătoare, până la un punct. Modelul GPT-4 de la OpenAI a demonstrat performanțe comparabile cu cele ale evaluatorilor umani atunci când vine vorba de gradarea răspunsurilor la întrebări de macroeconomie.

PERFORMANȚE REMARCABILE, DAR NU FĂRĂ LIMITĂRI

În cadrul analizei, AI a fost solicitat să evalueze răspunsurile textuale bazate pe corectitudine și completitudine, rezultând într-un grad de concordanță cu evaluatorii umani. Deși GPT-4 nu favorizează răspunsurile generate de AI sau cele mai lungi, s-a observat o tendință de generozitate în evaluarea pe baza punctajelor, ceea ce sugerează că AI ar putea fi mai indulgent.

UN DIALOG DESCHIS ASUPRA NIVELULUI DE SUPRAVEGHERE

Cercetătorii sunt de părere că, în ciuda performanțelor aproape egale, AI-ul nu poate înlocui complet evaluarea umană. „Verificarea soluțiilor de exemplu și reevaluarea trebuie să rămână sarcini umane”, subliniază profesorul Johann Graf Lambsdorff. Este evident că, în peisajul educațional al viitorului, AI-ul ar putea juca un rol crucial ca al doilea evaluator critic.

METODE INOVATOARE ÎN COMPARAREA ASUPRA EVALUĂRILOR

Studiile anterioare s-au concentrat adesea pe evaluarea AI ca subiect, dar cercetarea din Passau a dus lucrurile mai departe, întrebându-se dacă evaluările AI pot fi comparabile cu ale umanilor, fără a presupune că evaluările umane sunt mereu corecte. Această abordare provocatoare subliniază complexitatea evaluării răspunsurilor la întrebări deschise, unde nu există întotdeauna un răspuns „corect”.

ÎNCERCĂRI ÎN EVALUARE

Examinările s-au bazat pe răspunsurile studenților la șase întrebări, fiecare dintre acestea având 50 de răspunsuri selectate. Se pare că GPT a reușit să îmbunătățească scorurile în comparație cu evaluările exclusiv umane, aducând un aer de inovație în procesul de examinare. Cu toate acestea, limitele sale sunt evident revizuite, arătând că, în ciuda acestor succese, AI-ul nu este infailibil.

PERSPECTIVELE VIITOARE ALE EDUCAȚIEI

Inteligența artificială își face loc în educație, punând la îndoială concepțiile tradiționale ale evaluării. Aceasta nu înseamnă că semințele unei revoluții în educație sunt plantate fără controverse. Este esențial ca discuțiile să continue, iar cercetătorii să înțeleagă impactul pe termen lung al integrării AI în procesele educaționale.

Sursa:

Share This Article