Blog
- Czy modele językowe potrafią oceniać zadania programistyczne? Co zmierzyły badania z lat 2025-2026
Osiem badań z lat 2025 i 2026 o modelach językowych w roli egzaminatora wygląda na sprzeczne. Po uporządkowaniu według tego, co każde z nich położyło na wadze, sprzeczność w większości znika, a zostaje jeden niewygodny porządek.
- Sprawdzanie kodu: niewidzialne podwójnie
Normy uczelniane wyceniają eseje i egzaminy do ułamków godziny, ale żaden z przejrzanych dokumentów nie daje sprawdzaniu kodu osobnej pozycji, a badania nad wypaleniem też nie mierzą go osobno.
- Automatyczne sprawdzanie zadań programistycznych: sześć dekad badań
Przegląd ok. 60 badań z pięciu stref językowych: od 1960 roku brak dowodów, że automatyczne ocenianie uczy programować lepiej. Sprawdza tylko szybciej.