本站提供正體中文版。切換到正體中文本站提供简体中文版。切换到简体中文This site is available in English.View in Englishこのサイトには日本語版があります。日本語で表示이 사이트는 한국어로도 제공됩니다.한국어로 보기Diese Website ist auch auf Deutsch verfügbar.Auf Deutsch ansehenEste sitio web también está disponible en español.Ver en españolQuesto sito è disponibile anche in italiano.Visualizza in italianoCe site est également disponible en français.Afficher en françaisEste site também está disponível em português.Ver em portuguêsDeze website is ook beschikbaar in het Nederlands.In het Nederlands bekijkenЭтот сайт также доступен на русском языке.Смотреть на русскомयह वेबसाइट हिन्दी में भी उपलब्ध है।हिन्दी में देखेंهذا الموقع متاح أيضًا باللغة العربية.عرض بالعربيةSitus ini juga tersedia dalam bahasa Indonesia.Lihat dalam bahasa IndonesiaTa strona jest dostępna także po polsku.Wyświetl po polskuTrang web này cũng có phiên bản tiếng Việt.Xem bằng tiếng Việtاین وب‌سایت به فارسی هم در دسترس است.مشاهده به فارسی

Kafanızdaki muhakemeyi belgeye dökmek: bağlam mühendisliği ve modelin itaat düzeyi

Yapay Zekâ2026.06

Son birkaç yılda yapay zekâyı işime dahil ettikten sonra, başlangıçta yalnızca kafamın içinde var olan muhakemeleri adım adım parçalarına ayırdım, externalize ettim (dışsallaştırdım) ve denetlenebilir bir “bağlam mühendisliği belgesi” (Context Engineering Document) halinde düzenledim.

Model karşılaştırma infografiği: Claude ana model, GPT yedek olarak yer alıyor, Gemini ise bir keresinde uydurma kaynaklar sıraladığı için elenmiş; ayrıca bunun kişisel ve o âna ait bir denemeden ibaret olduğu, nesnel bir nihai hüküm olmadığı not düşülmüş

Bir modeli üç şeye bakarak değerlendiriyorum

Şu anda bir modelin “yüksek disiplinli, yüksek izlenebilirlikli” işlere uygun olup olmadığını değerlendirirken başlıca üç şeye bakıyorum:

  1. belirlenmiş kurallara uyabiliyor mu;
  2. bilgi yetersiz kaldığında boşlukları kendiliğinden “dolduruyor” mu;
  3. ürettiği içerik izlenebiliyor ve denetlenebiliyor mu.

Şu ana ait bir saha izlenimi

Aşağıda son dönemdeki saha izlenimlerim var — peşinen belirteyim, bunlar tümüyle şu ana ait, kişisel kullanım deneyimimdir; modeller de sürekli güncelleniyor, dolayısıyla herkes ve her sürüm için geçerli olmayabilir:

  • Claude: bağlama itaat düzeyi en yüksek olanı; belirlenmiş kurallara yapışarak iş görme konusunda görece daha başarılı, bu yüzden onu ana model sayıyorum ve muhakeme katmanını ona taşıtıyorum.
  • GPT: hemen arkasından geliyor. Kaynak izlenebilirliği görece kontrol edilebilir, ama bilgi yetersiz kaldığında ara sıra boşlukları eğitim verileriyle dolduruyor; bu yüzden onu ağırlıklı olarak yedek ve belirli görevler için kullanıyorum.
  • Gemini: bu tür uzun soluklu, yüksek disiplinli işlerde epey zorlanıyor; bir keresinde tek seferde koca bir yığın uydurma kaynak sıralamıştı, bu nedenle şimdilik bu ana hattın dışında kaldı.

Aradaki farkı açan şey, “dışsallaştırılmış muhakemeye itaat”

Bana kalırsa modeller arasındaki farkı asıl açan anahtar, aslında yalnızca modelin kendi yeteneği değil; benim çoktan dışsallaştırdığım o mesleki muhakemeye “itaat” edip edemediği.

Araçlar güncellenmeye devam edecek; ama önce kafanızdaki muhakemeyi açık seçik yazıya dökmek — bu iş, hangi aracı seçtiğinizle aslında aynı derecede önemli.