Teknik notlar, saha günlükleri ve uzun düşünceler.
0sonuç
saha notları
MEXT'teki Twin Strikers: AWS Agentic AI & Cloud gününden notlar: Türkiye'nin AI karnesi, ajanların 'yıl sıfırı', MCP ile formdan sohbete ve Agentic Football Cup.
İTÜ Taşkışla'daki İstanbul vLLM & llm-d buluşmasından notlar: PagedAttention, sürekli yığınlama ve beklenmedik bir karşılaşma.
sistemler
Şemadan geçen çıktı güvenli demek değildir: alan değerlerine injection, schema bypass, tehlikeli tool argümanları ve downstream parser riskleri. Geçerli bir şekil, geçersiz bir niyet taşıyabilir.
Aynı şema her modelde aynı davranmaz: native structured output modları (OpenAI, Anthropic, Gemini) ile constrained decoding kütüphanelerini, schema özellik boşluklarını ve JSONSchemaBench kanıtını karşılaştırmalı okuma.
Çıktı bozuk veya anlamca geçersiz geldiğinde sistem nasıl toparlanır: hatayı modele geri besleyen repair loop, sınırlı retry, error feedback ve constrained decoding'den insana uzanan fallback chain.
Doğrulamayı bir prompt talimatı değil, bir uygulama sınırı olarak ele almak: type, enum, required, nested schema ve partial output'lar; Pydantic, Zod, Instructor ve Guardrails ile model çıktısını güvenilmez girdi gibi okuma.
Geçerli yapıyı ummak yerine üretim anında zorlamak: grammar/FSM'ye karşı token maskeleme, JSON Schema'yı otomataya derlemek ve maliyetleri. PICARD, LMQL, Outlines, Guidance, XGrammar ve JSONSchemaBench.
Bir LLM'in üretebileceği formatlar ve hangisini ne zaman seçmeli: JSON (neden varsayılan), XML, YAML, Markdown tablolar ve JSON üzerine typed object'ler (Pydantic, Zod). Okunabilirlik, parse edilebilirlik ve token maliyeti dengeleri.
Task success, progress rate, tool correctness, pass^k güvenilirliği, maliyet ve human review: bir agent'ın iyi olup olmadığını WebArena, SWE-bench, AgentBoard, tau-bench ve METR üzerinden katmanlı okuma.
Sonsuz döngü, tool spam, goal drift, stale state ve silent partial failure: canlı ortamda agent'ları bozan beş başarısızlık modunu, nasıl fark edileceğini ve budget ile state üzerinden nasıl engelleneceğini şematik bir okumayla.
Supervisor-worker, specialist ajanlar, debate, delegation ve koordinasyon maliyeti: multi-agent mimarinin ne zaman yardımcı olduğu, ne zaman gürültü kattığı ve çoğu zaman iyi kurulmuş tek bir agent'ın neden kazandığı üzerine kaynaklı bir okuma.
Agent otonomisini sınırlı bir kontrol problemi olarak okumak: loop, tool, cost ve time budget'ları, escalation kuralları ve termination koşullarının bir guardrail içinde nasıl birleştiğini şemalarla.
Working memory, episodic memory, semantic memory, preference memory ve memory poisoning kavramlarını; depolama, geri getirme, güncelleme ve güvenlik politikaları üzerinden örnekli okuma.
Conversation state, task state, tool state, checkpoint, replay, rollback, redrive ve idempotency kavramlarını üretim agent'ları için kaynaklı ve şematik bir okuma.
ReAct, Plan-and-Execute, Reflexion, Tree of Thoughts ve Graph of Thoughts mimarilerini; feedback, state, search ve maliyet eksenlerinde kaynaklı bir okuma.
Agent'i chatbot ve workflow'dan ayıran şey: hedef, state, tool, döngü ve termination koşullarını açık bir sistem sözleşmesine bağlamak.
Düğüm etiketleri, device plugin'ler ve paylaşımlı GPU'lar üzerine pratik notlar.
deneme ve rehberler