
Sherlock публічно запустив Sherlock Audit Engine, розкривши платформу аудиту безпеки, яку компанія здебільшого тримала в тіні, поки тестувала модель із командами протоколів.
Audit Engine працює на шар вище окремих ІІ-аудиторів, координуючи кілька підходів до виявлення вразливостей у межах одного рев'ю.
Фронтирні LLM, спеціалізовані ІІ-аудитори та ІІ-оснащені дослідники безпеки працюють проти однієї й тієї самої кодової бази й контексту. Sherlock займається оркестрацією по всьому завданню, а знахідки судяться, валідуються й дедуплікуються, перш ніж консолідуватися в один фінальний результат аудиту.
Ця модель також проливає нове світло на одне з незвичніших завдань Sherlock цього року.
Чи був Polygon раннім поглядом на Audit Engine?
У червні Sherlock прогнав Heimdall V2 від Polygon через рев'ю за участю широкого поля ІІ-систем аудиту та дослідників безпеки.
Heimdall V2 — консенсус-клієнт у ядрі Polygon PoS, що робить його значущою кодовою базою для раннього розгортання моделі.
Тепер, коли Audit Engine став публічним, це завдання, схоже, послужило випробувальним полігоном для платформи, яку Sherlock виводить на ринок.
Автоматизовані ІІ-системи аудиту проявили себе серед найсильніших за загальним покриттям, тоді як різні системи та дослідники виявляли різні частини загального набору проблем. Результат підкріпив центральну ідею за Audit Engine: жоден підхід не вловлював повну картину безпеки.
Платформа вимірює ці відмінності напряму. Команди можуть бачити, які системи забезпечили широке покриття, які підтримували високу точність і де різні підходи вносили доповнювальний сигнал безпеки.
Це стає дедалі актуальнішим у міру зміни базової технології.
У липні Google DeepMind представив Gemini 3.5 Flash Cyber — специфічну для кібербезпеки модель, розроблену, щоб швидко знаходити, валідувати й патчити вразливості, — ще одне вказання на те, як швидко розвиваються спеціалізовані ІІ-можливості в безпеці.
Тому для команд безпеки найкраща доступна суміш — рухома ціль.
Audit Engine спроєктований так, щоб включати нові моделі, аудиторів і методології дослідників у міру їх появи, даючи протоколам при цьому узгоджене середовище для вимірювання того, що справді добре працює проти їхнього коду.
Джерело: BeInCrypto






