Vibe coding
Оцінка доцільності розробки через тестування всередині автономних циклів ШІ-агентів
Дослідження Thoughtworks показало, що суворе дотримання розробки через тестування (TDD) в агентних циклах погіршує архітектуру коду. Моделі ухвалюють локально обмежені рішення замість врахування комплексного контексту.
7 вересня 2026 р. 4 хв читання
Куратор Oleksandr Kuzmenko, AI Product EngineerОновлено 7 вересня 2026 р.Джерела вказані в кожному матеріалі
За участі AI · перевірено редакторомЯк ми використовуємо AI

Вплив: Високий
Чому це важливо
Припиніть змушувати кодинг-агентів проходити жорсткі цикли TDD «червоний-зелений»; вимагайте проектування архітектури до написання тестів та коду.
TL;DR
- 01Суворе дотримання покрокового TDD в агентних циклах шкодить архітектурі через локальну обмеженість рішень.
- 02Попереднє проектування структури та контрактів суттєво перевершує інкрементний підхід при роботі з ШІ.
- 03Агенти схильні писати тавтологічні тести, що звіряють вихідний результат коду з його власним повторним викликом.
Ключові факти
- Модель генерації
- Sonnet 4.6
- Модель оцінки
- Opus 4.8
- Вимога покриття
- Щонайменше 80%
Експеримент: TDD проти попереднього проектування в агентах. Бірґітта Бекелер провела п’ять серій генерації бізнес-логіки з нуля, щоб перевірити, чи дає реальну користь вимога до агента писати спочатку тест, який падає. Завдання виконувала модель Sonnet 4.6 з вимогою досягти щонайменше 80% покриття, а дотримання TDD перевірялося за транскриптом сесії. Оцінювання проводила модель Opus 4.8 наосліп. У більшості завдань рішення без TDD посідали вищі позиції за структурою даних та повнотою функціоналу. ### Чому покроковий TDD шкодить LLM. Аналіз логів показав, що в сесіях без TDD агент спочатку створював цілісний дизайн архітектури, типів даних та граничних випадків. Примусовий TDD, навпаки, штовхав модель до мінімалістичних локальних рішень, які потім не переглядалися. Крім того, ШІ нерідко генерував автореферентні тести, порівнюючи результат функції з її ж повторним викликом. Попередня вимога спланувати систему перед написанням тестів дає значно стабільніший результат.
Спробуй за 2 хвилини
Instruct your agent:
1. First generate the comprehensive domain model, contracts, and cross-cutting edge cases.
2. Write the complete test suite verifying these contracts.
3. Implement the feature logic until all tests pass.markdown
✓ Коли використовувати
- Під час налаштування системних промптів та інструкцій для Claude Code, Cursor чи кастомних агентів.
✕ Коли НЕ варто
- Коли ви очікуєте, що автономний агент якісно покращить загальну архітектуру на основі дрібних юніт-тестів.
Що зробити сьогодні
- Оновіть системні промпти агентів, вимагаючи план архітектури перед створенням файлів тестів.
- Перевірте згенеровані тести на відсутність тавтологічних перевірок, що звіряють код сам із собою.
#Claude Sonnet 4.6#Claude Opus 4.8
Джерела