Тест SemiAnalysis AgentX вимірює реальне споживання токенів та ефективність AI-агентів
NVIDIA опублікувала дані тестування AgentX, які свідчать, що AI-агенти споживають у 15 разів більше токенів на запит, ніж звичайний чат. Тест відтворює сесії Claude Code для оцінки роботи з довгим контекстом та повторного використання KV-кешу.
Чому це важливо
Оцінка серверних платформ LLM вимагає динамічного відтворення сесій агентів замість статичних тестів для точного вимірювання навантаження на KV-кеш.
Відкрити повністю