# Наделла радить вважати модель ШІ скомпрометованою від початку

> Сатья Наделла вважає перевірку однієї моделі іншою недостатньою: архітектура має дозволяти людині зупиняти агента й незалежно перевіряти його значущі дії.

- Опубліковано: 11 жовтня 2026 р. (2026-10-11T12:41:01.580481+00:00)
- Розділ: Безпека AI
- На основі публікації: [Mezha](https://mezha.ua/news/satya-nadella-modeli-shi-vidpochatku-slid-vvazhati-vrazlivimi-316044/)
- Видання: AiiN (https://aiin.news)
- URL: https://aiin.news/article?slug=%D0%BD%D0%B0%D0%B4%D0%B5%D0%BB%D0%BB%D0%B0-%D1%80%D0%B0%D0%B4%D0%B8%D1%82%D1%8C-%D0%B2%D0%B2%D0%B0%D0%B6%D0%B0%D1%82%D0%B8-%D0%BC%D0%BE%D0%B4%D0%B5%D0%BB%D1%8C-%D1%88%D1%96-%D1%81%D0%BA%D0%BE%D0%BC%D0%BF%D1%80%D0%BE%D0%BC%D0%B5%D1%82%D0%BE%D0%B2%D0%B0%D0%BD%D0%BE%D1%8E-%D0%B2%D1%96%D0%B4-%D0%BF%D0%BE%D1%87%D0%B0%D1%82%D0%BA%D1%83

---

Microsoft очолює Сатья Наделла, який виклав у дописі на X сім принципів безпеки ШІ. Він радить від початку виходити з припущення, що модель скомпрометована, [за даними Mezha](https://mezha.ua/news/satya-nadella-modeli-shi-vidpochatku-slid-vvazhati-vrazlivimi-316044/).

Для білдера ключова теза — контроль потребує системної архітектури й участі людини. Уповноважена особа повинна мати змогу зупинити модель, а докази її дій мають бути зрозумілими людині та захищеними від змін.

## Чому перевірка однієї моделі іншою не гарантує захисту?

Наделла вважає взаємну перевірку моделей недостатньою, бо системи непередбачувані й за однакових умов можуть давати різні результати. «Ланцюг міркувань» також не гарантує безпеки. Коли непрозора модель стежить за іншою непрозорою моделлю, процес перетворюється на «вкладення чорних скриньок».

Наделла наголошує на потребі в передбачуваній системній архітектурі, людському контролі та перевірених робочих процедурах. Прозорість і взаємна перевірка моделей можуть бути початковими кроками, але людина повинна мати змогу спостерігати за діями системи.

## Які принципи допомагають контролювати модель?

Mezha докладно описує три із семи принципів Наделли: стримування, спостережуваність і аудит.

- Стримування. Слід виходити з припущення, що «модель скомпрометована», й одразу обмежувати її можливості. Уповноважена особа повинна мати змогу призупинити або повністю зупинити роботу моделі під час виконання завдання.
- Спостережуваність. Жодна модель не повинна одночасно контролювати поведінку системи й надавати докази її відповідності початковим намірам. Ці докази мають бути зрозумілими людині та захищеними від змін. За словами Наделли, дію, за якою неможливо спостерігати, не можна вважати надійною.
- Аудит. Кожна значуща дія моделі повинна залишати слід у вигляді доказів, які можна відтворити без покладання на саму модель. Наделла пов’язує цю вимогу з тим, що ШІ фактично стає «внутрішнім співробітником» компанії.

## Що це означає для архітектури вашого агента?

Принципи Наделли дають підстави перевірити, хто може зупинити агента та як система фіксує його дії. Нижче — наша інтерпретація цих вимог.

- Чи можна зупинити конкретне завдання під час виконання і чи визначено, хто має на це право?
- Чи забезпечує одна й та сама модель і контроль поведінки системи, і докази її відповідності початковим намірам?
- Чи може людина відтворити значущі дії агента за доказами, захищеними від змін, без покладання на саму модель?

---

Теги: AI, Microsoft, БезпекаAI, AIагенти, Наделла, AgentSecurity

Джерело: AiiN — https://aiin.news/article?slug=%D0%BD%D0%B0%D0%B4%D0%B5%D0%BB%D0%BB%D0%B0-%D1%80%D0%B0%D0%B4%D0%B8%D1%82%D1%8C-%D0%B2%D0%B2%D0%B0%D0%B6%D0%B0%D1%82%D0%B8-%D0%BC%D0%BE%D0%B4%D0%B5%D0%BB%D1%8C-%D1%88%D1%96-%D1%81%D0%BA%D0%BE%D0%BC%D0%BF%D1%80%D0%BE%D0%BC%D0%B5%D1%82%D0%BE%D0%B2%D0%B0%D0%BD%D0%BE%D1%8E-%D0%B2%D1%96%D0%B4-%D0%BF%D0%BE%D1%87%D0%B0%D1%82%D0%BA%D1%83. Цитуючи, посилайтесь на канонічний URL.
