Evaluarea comparativă a ChatGPT, Gemini și DeepSeek în ceea ce privește informațiile medicale legate de ADHD

StudiuADHDÎncredere înaltă

Acest studiu a comparat sistematic modul în care trei modele mari de limbaj (ChatGPT GPT-4o, Gemini și DeepSeek R1) răspund la 22 întrebări frecvente despre ADHD în patru domenii, constatând că toate modelele au atins o acuratețe ridicată (87-91%), verificată independent de specialiști în psihiatrie. Reproductibilitatea a fost puternică în toate modelele, ChatGPT arătând o performanță ușor superioară în domeniile tratamentului, în timp ce Gemini și DeepSeek au excelat în cunoștințele de bază și diagnostic.

Surse

Afișăm titlu + rezumat scurt în limita dreptului de autor; textul integral e la sursă.