Messbare Fehler in LM-Agenten
Messbare Fehler bei Exploration und Exploitation in LM-Agenten untersucht
Messbare Fehler bei Exploration und Exploitation in LM-Agenten untersucht
Probabilistisches Modell zur Allokation von Verantwortung
ANAC 2025 präsentiert Hauptforderungen und Ergebnisse.
Identifiziert Lücken im MCP und schlägt neue Mechanismen vor.
Harness Engineering ist ein neues Ingenieurwesen zur Entwicklung zuverlässiger agenter Software.
Untersuchung von Versagensmustern in LLM-basierten Agenten
Aethon reduziert Latenz und Speicheraufwand durch kompositionelle Instanzen.
HCP-MAD reduziert Tokenkosten durch adaptives Vorgehen.
MPAC-Protokoll überbrückt Lücken bei der Agentenkoordination
Blaue Agenten lernen, Werbeanzeigen zu vermeiden.
MirrorCode zeigt Fähigkeiten moderner AI-Systeme in der Reimplementierung komplexer Software.