DeepSeek V4 Pro протестували у 5 агентських фреймворках: Pi має найвищий показник успішності, а DSH — найекономніший
За даними Composio, у нещодавньому бенчмарк-тесті DeepSeek V4 Pro 0813 у п’яти агентських фреймворках — Pi Agent, DeepSeek Harness, Claude Code, OpenCode і Hermes Agent — оцінювали продуктивність на 30 багатоетапних агентських завданнях із увімкненим максимальним рівнем міркувань. Pi Agent показав найвищу частку успішних виконань — 21/30, за ним — DeepSeek Harness із результатом 20/30. DeepSeek Harness продемонстрував найнижчу вартість одного успішного завдання — $0,028, тоді як вартість одного
GateNews·08-20 10:49
