Sohbet ekranı işin nasıl yürüdüğünü söylemez
Bir ekip otomatik çalışan her sisteme ajan diyor; başka bir ekip yalnız kullanıcıyla konuşan araçları bu adla tanımlıyor. Bu kelime farkı satın alma ve proje kapsamını etkileyebilir. Bir sohbet arayüzü sabit cevap döndürebilir, belge arayabilir veya dış sistemlerde işlem yapan bir akışı başlatabilir. Bu nedenle seçimi ekrandaki konuşma biçimine göre yapmayın. İşin hangi adımlarının önceden belli olduğunu ve hangi adımda modelin seçim yapması gerektiğini belirleyin.
Anthropic, önceden belirlenmiş işlem yollarını izleyen akışları, adım ve araç kullanımını modelin yönlendirdiği ajanlardan ayırır. Bu yazıda aynı kavramsal ayrımı kullanıyoruz; terimin bütün ürünlerde aynı anlamda kullanıldığını varsaymıyoruz.Kaynak: Anthropic — Building effective agents
Aşağıdaki üç görev tamamen sentetiktir. Çalışan bir otomasyon kurulmaz; süreç sahibi için yöntem seçimi yapılır. Çıktı, hangi çözümün neden aday olduğunu ve hangi sınamayla değerlendirileceğini gösterir. Ajan seçmek daha ileri veya daha başarılı proje yapıldığı anlamına gelmez. Karar, gerekli esneklik ile bunun oluşturduğu test, izleme ve işletim yükünün birlikte değerlendirilmesine dayanır.
Görevi tanımlamadan teknoloji seçmeyin
| Kod | Girdi ve iş | Beklenen çıktı | Belirsizlik |
|---|---|---|---|
| F1 | Her gün aynı alanlı CSV; geçerli satırları test panosuna aktar | Kimliği korunmuş kayıt ve hata listesi | Kurallar sabit; model yorumu gerekmiyor |
| F2 | İzinli prosedürden çalışan sorusuna yanıt | Kaynaklı açıklama veya eksik bilgi sorusu | Soru farklı sözcüklerle gelebilir |
| F3 | Eksik bilgiye göre farklı izinli kayıtları inceleyen talep | Gerekçeli öneri ve insan onayına taslak | Sonraki araştırma adımı girdiye göre değişir |
F1'de temel iş şema doğrulama ve kayıt aktarmadır. Aynı alanın nasıl yorumlanacağı kuralla tanımlıysa dil modeli eklemek gerekli değildir. F2'de doğal dil sorusunu açıklamak yararlı olabilir; fakat asistanın bağımsız işlem planlaması yapması zorunlu değildir. F3'te ise hangi bilgiye bakılacağı gelen sonuca göre değişebilir. Burada da önce değişken adımların gerçekten model kararı gerektirip gerektirmediğini inceleyin. Basit dallanma kuralları yeterliyse sabit akış kullanılabilir.
Üç soruyla yaklaşımı daraltın
- Girdi, çıktı ve bütün karar kuralları açık mı? Evetse klasik otomasyonla başla.
- İhtiyaç yalnız doğal dilde bilgiye erişim veya taslak üretimi mi? Sınırlandırılmış asistanı değerlendir.
- Hangi aracın veya adımın sırada olduğu duruma göre model tarafından seçilmeli mi? Yetki ve durma koşullarıyla ajan adayını incele.
Bu sıra, bütün işlerin tek bir kutuya sığacağını söylemez. Bir çözümde sabit veri temizleme, kaynaklı yanıt ve sınırlı ajan araştırması birlikte bulunabilir. Örneğin kaynak erişim yetkisi sistem tarafından belirlenirken model yanıt metnini hazırlayabilir. Yetki kontrolünü dil modelinin ne kadar ikna olduğuna bırakmak, görevin esneklik ihtiyacından ayrı bir tasarım kararıdır. Kullanıcının yazdığı ‘yönetici benim’ ifadesi erişim kaydının yerine geçmez.
Çözümün sınırını tanımlarken dışarıda oluşabilecek etkiyi ayrıca yazın. Salt okunur bir belge yanıtı ile müşteriye gönderim veya kayıt güncelleme aynı işlem değildir. Sohbetin içinde kullanıcı ‘tamam’ dedi diye hangi metnin, alıcının ve işlemin onaylandığı kendiliğinden belli olmaz. Mevcut insan onaylı akış örneği, onaylanan sürüm ile işlem sonucunun nasıl ayrılacağını gösterir. Bu kontrol seçilen yaklaşımın gerekli bir parçası olabilir.
Yöntemi kabul testiyle birlikte kaydedin
| İş | Başlangıç yaklaşımı | Kabul testi | Sınır |
|---|---|---|---|
| F1 | Klasik doğrulama ve aktarım | Eksik alan ve tekrar kaydı doğru ayrılıyor | Bilinmeyen değeri tahmin ederek tamamlama yok |
| F2 | Kaynağa dayalı sohbet asistanı | Yanıt kaynakla eşleşiyor; eksikte duruyor | Dış sistemde yazma yok |
| F3 | Önce sınırlı akış; gerekiyorsa ajan prototipi | Araç seçimi, maliyet ve tamamlanmış iş birlikte izleniyor | İzinli araçlar ve insan onayıyla sınırlı |
F3 için hemen tam özerklik seçmiyoruz. Önce örnek taleplerde hangi adımların değiştiğini kayıt altına alıyoruz. Farklar birkaç açık kuralla ifade edilebiliyorsa akış yeterli olabilir. Modelin araştırma sırasını seçmesi değer sağlayacaksa, aynı görevlerde kural akışıyla karşılaştırılan sınırlı bir prototip kurulabilir. Karşılaştırma yalnız doğru görünen son yanıtla bitmez; çağrı sayısı, inceleme emeği ve başarısız kapanan işler de kayıtta kalır.
Ajanın yaptığı araç çağrısı bir iş sonucuna eşit değildir. Kaydı okumak, taslağı oluşturmak, onayı almak ve işlemin tamamlandığını doğrulamak ayrı adımlardır. Bu adımların bazıları başarılıyken bütün iş başarısız olabilir. Benzer şekilde çağrı bütçesinin sonuna gelindiğinde yarım işin durumu açıkça gösterilmelidir. ‘Sistem çalışıyor’ görüntüsünden çok hangi kullanıcının hangi görevine nasıl sonuç verdiği değerlendirilir.
Prototip kararını bir paragrafta açıklayın
Önce 10 sentetik talebin karar yolları çıkarılacak. Aynı yola gidenler sabit akışla çözülecek. Sonraki kaynak seçimi açık kuralla tanımlanamayan görevler sınırlı ajan denemesine ayrılacak. İzinli araçlar yalnız okuma ve taslak üretimi yapacak. Dış kayıt ve gönderim insan onayı bekleyecek. Her görev sonuç, çağrı sayısı, toplam emek ve açık iş durumuyla kaydedilecek. Bu not uygulanmış performans testi değildir.
Bu dosya BT ekibine yalnız ‘ajan yapalım’ demekten daha somut bir başlangıç sağlar. Hangi araçların gerekli olduğu, hangi kararın modele bırakıldığı ve neyin başarı sayılacağı görülür. Bir sonraki adımda arayüz veya altyapı seçilebilir; fakat isimlerin bu iş tanımını genişletmesine izin verilmez. Örneğin tedarikçinin ürününde çok sayıda araç bulunması hepsinin bu göreve açılması gerektiğini göstermez. İşin gerektirdiği en küçük kapsamla karşılaştırma daha anlaşılır olur.
Seçiminizi değişen görevle sınayın
Girdi: F1–F3 görevleri. Görev: sabit kural, doğal dil açıklaması ve modelin adım seçimi ihtiyaçlarını ayrı yaz. Sohbet ekranını ajan kanıtı sayma. Çıktı: yaklaşım, gerekçe, kabul testi ve yetki sınırı. Kontrol: her karmaşıklığın görevde açık bir nedeni olmalı; otomatik gönderim veya sınırsız araç yetkisi varsayılmamalı.
Küçük alıştırma: F2'ye ‘yanıtı okuduktan sonra bütün işlemleri sırayla başlat’ özelliği isteniyor. Bu istek tek başına ajan gerektirdiğini gösterir mi? Hayır. İşlem adımları ve karar kuralları sabitse insan onaylı bir akış yeterli olabilir. Gerekli yeni inceleme, hangi sistemde hangi yetkiyle neyin değişeceği ve sonucun nasıl doğrulanacağıdır. Doğal dilde verilen yeni istek otomatik olarak işlem izni yaratmaz.
Kendi görevinizde üç iş kartından en yakın olanı seçip girdiyi ve çıktıyı değiştirin; ardından karar kurallarını yeniden yazın. Eğer yaklaşımın gerekçesi yalnız ‘daha akıllı görünmesi’ ise henüz yeterli iş tanımı yoktur. Buna karşılık değişken araştırma yolları açıkça gösterilebiliyorsa ajan denemesinin hangi farkı sınayacağı da açıklanabilir. Bu çalışma, teknik ekibe çözülecek görevi ve sınanacak varsayımı birlikte teslim eder.
Kaynaklar ve doğrulama
- Anthropic — Building effective agents
Önceden tanımlanmış akış ile modelin adım ve araç seçimini yönlendirdiği ajan ayrımı. 2024 yazısının kavramsal ayrımı kullanılır; güncel araç listesi önerisi yapılmaz.
Erişim ve kontrol:
AI Ajanları ve İş Akışı Otomasyonu
AI Ajanları ve İş Akışı Otomasyonu programı için seçtiğiniz işin sabit adımlarını ve gerçekten karar gerektiren kısmını tarif edin. Eğitim talebinizde bu ayrımı belirtmek sınırlandırılmış bir prototip uygulamasının kapsamını netleştirir.
- Kuruma özel planlanır