вівторок, 11 серпня 2026 р.
Сьогоднішній випуск досліджує, як мультиагентні архітектури у поєднанні з інструментами формальної верифікації усувають галюцинації в тривалих автономних пайплайнах.
У цьому випуску · 7
Anthropic оголосила про плани впровадження статистичних невидимих водяних знаків у тексти Claude, за аналогією з механізмом Google Gemini з 2024 року. Маркування змінює ймовірності токенів і зберігається при копіюванні та базовому редагуванні.
Компанія Cactus Compute випустила Needle 2 — модель на 45M параметрів розміром 14MB, створену для структурованого виклику інструментів на бюджетному обладнанні вартістю до $200. Працюючи з 2-бітною квантизацією всередині єдиного C++ бінарника, вона забезпечує автономне виконання з низькою затримкою.
IBM Research представила ALTK-Evolve — відкриту бібліотеку пам'яті агентів, що замінює повну ін'єкцію інструкцій вибірковим вилученням правил. На бенчмарку AppWorld вона досягає або перевищує точність ACE при 14–40% витрат токенів.
Red Hat представила захищене виконання команд у developer preview для MCP-сервера RHEL. Це дозволяє AI-агентам динамічно запускати скрипти діагностики в межах суворих правил безпеки.
NVIDIA випустила Nemotron 3.5 Lightning — відкриту 30B MoE модель з 3Б активними параметрами та контекстом 1M токенів. Модель доступна в Ollama і оптимізована для фонових локальних агентів.
Дослідники з безпеки виявили вразливість у відповідях API провідних розробників AI, яка дозволяє витягувати приховані ланцюжки міркувань моделей. Кількість токенів 1:1 відповідає білінгу.
Anthropic розгорнула експериментальну модель на 60 спеціалізованих субагентів для дослідження гіпотези Рімана. Мультиагентна архітектура витратила 31 мільйон токенів за 36 годин і перевірила результати за допомогою інструменту верифікації Lean.
Email-дайджест
Один лист на день — історії, що важливі для інженерів, фаундерів і техлідів. Редагує людина, з посиланнями на першоджерела.
Підписуючись, ви погоджуєтесь з політикою конфіденційності.