Kısaca

Bocconi Üniversitesindeki işletmeye giriş dersinde 1.053 öğrenciyle yapılan rastgele kontrollü deneyde GPT-4o erişimi verilen öğrencilerin ödev notları 5 üzerinden yaklaşık 1 puan yükseldi.

İtalya'daki Bocconi Üniversitesinde 1.053 birinci sınıf öğrencisinin katılımıyla yürütülen rastgele kontrollü bir araştırma, büyük dil modellerinin akademik ödevlerdeki etkisini inceledi. Kasım 2025'te işletmeye giriş dersinin 13 farklı şubesinde gerçekleştirilen deneyde öğrenciler; kontrol grubu, nedensel akıl yürütme dersi alan grup, GPT-4o erişimi sağlanan grup ve her iki yöntemi birlikte kullanan grup olmak üzere dört ayrı kategoriye ayrıldı. Katılımcılardan üniversitenin hediyelik eşya mağazası için en fazla 180 kelimeden oluşan pazarlama tavsiyeleri hazırlamaları istendi.

Deney sonuçlarına göre GPT-4o kullanan öğrenciler, 5 puanlık değerlendirme ölçeğinde kontrol grubuna kıyasla yaklaşık 1 tam puan daha yüksek başarı elde etti. Yapay zekâ destekli metinler ortalama iki adet daha fazla öneri barındırırken, içeriklerin mantıksal tutarlılığı ve üç bağımsız alan uzmanının tavsiyeleriyle örtüşme oranı belirgin şekilde yükseldi. Araştırmacılar argüman kalitesi, fikir sayısı ve metin özellikleri gibi değişkenleri kontrol ettikten sonra dahi GPT-4o avantajının sürdüğünü ve bu farkın öğrenci bilgisinden ziyade üretilen içeriğin yüzeysel kalitesinden kaynaklandığını saptadı.

Öte yandan, geçerli nedensellik bağları ve yanlışlanabilirlik üzerine kısa bir eğitim alan öğrencilerin hazırladığı çalışmalar geleneksel notlandırmada daha düşük puan aldı. Bu gruptaki öğrenciler önerilen eylemlerin hangi koşullarda başarısız olabileceğini daha ayrıntılı açıkladı ve akranlarından farklılaşan özgün fikirler geliştirdi; ancak mevcut değerlendirme kriterleri bu derinliği ödüllendirmedi. Çalışma, geleneksel puanlama sistemlerinin özgünlük ve neden-sonuç analizinden ziyade yapay zekânın kolayca üretebildiği düzenli, akıcı ve standart metin yapılarına yüksek not verdiğini gösterdi.

Araştırmada yer alan yazarlar arasında OpenAI çalışanlarının bulunması ve kullanılan teknolojinin aynı kurum tarafından sağlanması dikkat çekerken, deney sonrasında öğrencilerin bilgiyi kalıcı olarak öğrenip öğrenmediğini ölçen herhangi bir takip sınavı uygulanmadı. Benzer alanda daha önce ABD'deki 500 binden fazla üniversite notunu inceleyen çalışmalar ile Çin'de 26 bin öğrenciyle yürütülen 30 aylık araştırmalar, yapay zekâ desteğiyle hazırlanan ödevlerin kalitesi artsa da merkezi sınavlardaki puanların yüzde 18 ila 24 oranında düştüğünü ortaya koymuştu.

Neden önemli?Çalışma, geleneksel akademik değerlendirme sistemlerinin derinlik veya özgün fikirlerden ziyade yapay zekânın kolayca üretebildiği yapı ve akıcılığı ödüllendirdiğini gösteriyor.

Şu ana kadar bildiklerimiz

  • Bocconi Üniversitesinde Kasım 2025'te 13 sınıf şubesindeki 1.053 birinci sınıf öğrencisi dört gruba ayrılarak 180 kelimelik pazarlama tavsiyesi ödevi hazırladı.
  • GPT-4o kullanan öğrenciler 5 puanlık ölçekte yaklaşık 1 puan daha yüksek not alırken ödevlerinde ortalama iki daha fazla fikir üretti ve uzman önerileriyle daha uyumlu sonuçlar sundu.
  • Nedensel akıl yürütme dersi alan öğrencilerin ödevleri daha özgün ve sorgulayıcı fikirler içermesine rağmen geleneksel değerlendirmede daha düşük puanlar aldı.

Cevabı beklenen sorular

  • Ödev hazırlarken yapay zekâ kullanan öğrencilerin bağımsız çalışma ortamındaki sınav ve uzun vadeli öğrenme performansı nasıl etkilenecek?
  • Eğitim kurumları, yapay zekânın kolayca taklit ettiği metin yapısı yerine özgün düşünceyi ve nedensel akıl yürütmeyi ölçecek yeni notlandırma standartlarını nasıl geliştirecek?