Harness запустила повний цикл розроблення й контролю ШІ-агентів
Harness розширила свою платформу доставки програмного забезпечення на повний життєвий цикл ШІ-агентів — від перевірки якості до розгортання, спостереження за роботою та політик безпеки. Новий набір Agent DLC має дати компаніям єдиний процес для агентів і звичайного коду, замість окремих експериментальних інструментів для кожної команди.
До запуску входять п’ять основних можливостей. AI Evals дає змогу створювати тестові набори, функції оцінювання та автоматичні пороги якості. Agent Deployments додає поетапні релізи, погодження й правила OPA для керованих середовищ Amazon Bedrock AgentCore та Google Agent Runtime. AI Configs керує змінами моделей і промптів під час виконання, а AI Asset Catalog знаходить агентів, навички та плагіни в репозиторіях і прив’язує їх до відповідальних команд.
Спостереження і захист після запуску
AgentTrace записує маршрут одного запуску та багатокрокової сесії, щоб команда бачила вибрані інструменти, затримки й вплив різних моделей або промптів. Harness також відкриває базові компоненти трасування — harness-sdk і harness-evals. Для безпеки платформа додає сканування конфігурацій, опис залежностей AIBOM, перевірки проти атак на мовні моделі та AI Firewall, який має блокувати ін'єкції промптів, неправильне використання інструментів і витік даних.
Компанія пояснює потребу в окремому циклі недетермінованістю агентів: однаковий запит може приводити до різних дій, тому одноразовий успішний тест не гарантує повторюваності. Agent DLC переносить у цей контекст контрольовані релізи, журнали аудиту та можливість швидкого відкату. Можливості вже почали ставати доступними клієнтам Harness.