AutoGen, CrewAI, LangGraph ve MetaGPT'yi kendi Ajan işletim sistemimle karşılaştırdım. “LLM - as - a - judge” paradigması tamamen kırılmıştır. İşte yerel veriler.
Özgün başlık: I benchmarked AutoGen, CrewAI, LangGraph, and MetaGPT against my own Agent OS. The "LLM-as-a-judge" paradigm is completely broken. Here is the local data.
Bu gelişmenin ayrıntıları kaynağında yer alıyor.
✳ Bu özet ve çevirisi Base of AGI tarafından otomatik derlendi. Kısa özet ve görsel kaynağa aittir — haberin tamamı ve tüm haklar kaynağındadır.
Haberin tamamını kaynağında oku ↗
Akış içinde yorumlarla aç