![](https://teknovivo.com/wp-content/uploads/2024/06/openaidan-criticgpt-gpt-4un-hatalarini-gpt-4-bulacak-0-Rf6ADJsF.jpg)
OpenAI, ChatGPT tarafından oluşturulan programlama kodunu inceleyen insan eğitmenlere yardımcı olmak için CriticGPT’yi geliştirdiklerini söylüyor. Firma, ChatGPT kodunu gözden geçirmek için CriticGPT’den yardım alan insanların, yardım almayanlardan %60 oranında daha yeterli performans gösterdiklerini belirtiyor.
GPT-4’ün kusurları GPT-4’e emanet
![](https://teknovivo.com/wp-content/uploads/2024/06/openaidan-criticgpt-gpt-4un-hatalarini-gpt-4-bulacak-1-h42BBF9B.jpg)
![](https://teknovivo.com/wp-content/uploads/2024/06/openaidan-criticgpt-gpt-4un-hatalarini-gpt-4-bulacak-2-n2tKK38D.jpg)
![](https://teknovivo.com/wp-content/uploads/2024/06/openaidan-criticgpt-gpt-4un-hatalarini-gpt-4-bulacak-3-lwZ2wyyr.jpg)
OpenAI birebir vakitte Force Sampling Beam Search (FSBS) ismini verdikleri yeni bir teknik de geliştirdi. Bu prosedür en kolay haliyle CriticGPT’nin daha detaylı kod incelemeleri yazmasına yardımcı oluyor. Araştırmacılar FSBS ile CriticGPT’nin sıkıntıları ararken ne kadar kapsamlı olacağını ayarlayabiliyor, tıpkı vakitte gerçekte var olmayan sıkıntıları ne sıklıkla uydurabileceğini de denetim edebiliyor.
İlginç bir bulgu da var
OpenAI, kod üzerindeki deneylere ek olarak, LLM eleştirmenlerinin genel yardımcı vazifelerde nasıl performans gösterdiğini de araştırdı ve enteresan bir biçimde CriticGPT’nin yeteneklerinin kodun ötesine geçtiğini keşfetti. OpenAI, daha evvel insanlar tarafından kusursuz olarak değerlendirilen ChatGPT eğitim bilgilerinin bir alt kümesinde CriticGPT’yi test etti. Değişik bir halde CriticGPT, buradaki vakaların yüzde 24’ünde yanılgılar buldu. OpenAI, bunun CriticGPT’nin kod dışı vazifelere genelleme potansiyelini gösterdiğini ve dikkatli insan değerlendirmesinin bile gözden kaçırabileceği ince yanılgıları yakalama yeteneğini vurguladığını düşünüyor.
CriticGPT eksiksiz değil
En nihayetinde CriticGPT modeli de GPT-4 üzerinde inşa edilmiş bir yapay zeka. Bu nedende başka tüm modeller üzere CriticGPT’nin de kimi sınırlamaları bulunuyor. Bu sınırlamaların başında modelin halen halüsinasyon görmesi geliyor. CriticGPT daha dar ve kaliteli bir bilgi kümesinde eğitilse de modellerin en doğal çalışma prensipleri nedeniyle daha az yapıyor olsa bile halüsinasyonlardan kurtulamıyor. Haliyle bunlar da insanların yanlış etiketlemeler yapmasına neden oluyor. Şayet bu mevzuda daha fazla bilgi almak istiyorsanız aşağıdaki içeriğimizi kesinlikle okuyunuz:
Bununla birlikte CriticGPT, oldukça kısa olan ChatGPT karşılıkları üzerinde eğitildi. Bu da uzun ve karmaşık vazifeleri değerlendirmede performansını düşürüyor. Ayrıyeten bazen yanlışlar tek bir yerde olmayabiliyor. CriticGPT, belli bir yerde tespit edilebilen yanlışları belirlemede epey yeterli olsa da gerçek dünyadaki yanılgılar bir yanıtın birçok kısmında olabiliyor. Ek olarak OpenAI, CriticGPT’nin bir yere kadar yardımcı olabileceğini söylüyor. Bir vazife yahut karşılık son derece karmaşıksa, model yardımı alan bir uzman bile bunu hakikat bir halde değerlendiremeyebilir.