Fits Calc
ИИ для инженера · корпоративное внедрение · Wave AI R5

Безопасность корпоративного ИИ: prompt injection, secrets, data egress и supply chain

рассматривать модель, retrieval-корпус, tools, MCP-серверы и generated code как единую поверхность атаки.

Короткий ответ

Безопасность корпоративного ИИ: prompt injection, secrets, data egress и supply chain — это production-задача, а не демонстрационный prompt. Практический принцип: рассматривать модель, retrieval-корпус, tools, MCP-серверы и generated code как единую поверхность атаки. Ключевое решение: традиционная защита API не закрывает indirect prompt injection и риски, возникающие при выполнении действий на основе недоверенного текста. В инженерной среде результат принимается по evidence, traceability и воспроизводимой проверке, а не по уверенности формулировки модели.

Agent/RAG-платформы быстро меняются. Технические ссылки этой статьи проверены 02.10.2026; перед внедрением перепроверяются статусы API, preview/GA, лимиты, хранение данных и доступность функций.

Граница системы и предмет контроля

Корпоративное внедрение ИИ — это изменение операционной системы предприятия, а не покупка лицензий. Нужно определить владельца процесса, классы данных, допустимые модели и среды, правила доступа, журналирование, eval-процедуры, порядок выпуска изменений и ответственность за результат. Технология становится частью системы менеджмента и должна жить по тем же принципам конфигурационного управления, что и другое критичное ПО.

Архитектура должна учитывать реальные границы: on-prem и cloud, PDM/PLM, ERP/MES, QMS, файловые архивы, API, прокси, секреты, сетевые сегменты и требования к хранению данных. Вместо единого «суперагента» чаще рациональнее строить несколько узких сервисов с понятными контрактами и централизованными политиками доступа, наблюдаемости и оценки качества.

Рабочее правилотрадиционная защита API не закрывает indirect prompt injection и риски, возникающие при выполнении действий на основе недоверенного текста. Это правило должно быть закреплено в runtime policy, а не существовать только как рекомендация пользователю.

Что должно быть определено до запуска

threat modelВерсионируется как технический контракт; изменения проходят совместимость и regression до production.
secret inventoryФиксируется явно, имеет owner и проходит валидацию до использования в следующем шаге.
tool permissionsЗадаётся как проверяемое правило доступа: субъект, объект, действие, срок и причина допуска.
network policyЗадаётся как проверяемое правило доступа: субъект, объект, действие, срок и причина допуска.
dependency inventoryФиксируется явно, имеет owner и проходит валидацию до использования в следующем шаге.

Артефакты и архитектурные границы

Корпоративный слой целесообразно строить вокруг AI gateway: identity, policy enforcement, model routing, DLP/redaction, аудит, budgets и telemetry находятся в общей инфраструктуре, а доменные приложения подключают собственные tools и RAG. Это уменьшает дублирование и даёт единый контроль при нескольких моделях и подразделениях.

Версионируются не только prompts: model/runtime, tool schemas, indexes, embedding/retrieval settings, policy bundles, eval datasets и интеграционные контракты должны иметь change history. Тогда обновление модели или корпоративной системы становится управляемым изменением с regression gate, а не скрытым изменением поведения.

security architectureИмеет стабильный идентификатор, статус приёмки и связь с исходной задачей.
allowlistИмеет стабильный идентификатор, статус приёмки и связь с исходной задачей.
secret vault policyКонфигурационно управляемый объект: version, owner, change history и дата действия.
incident telemetryИмеет стабильный идентификатор, статус приёмки и связь с исходной задачей.
red-team suiteVersioned контрольный набор; изменения проходят review, критические regression cases не удаляются.

Практический workflow

Шаг 1. построить threat model. Выберите процесс с owner, baseline и ограниченной зоной данных.
Шаг 2. разделить trusted/untrusted inputs. Зафиксируйте reference architecture и точки policy enforcement.
Шаг 3. убрать секреты в vault. Сопоставьте use case с AI/data/security governance и владельцами рисков.
Шаг 4. ограничить egress. Проведите threat model для prompt injection, secrets и внешних connectors.
Шаг 5. добавить approvals. Интеграции оформляйте versioned contracts, а не прямые одноразовые вызовы.
Шаг 6. провести adversarial evals. Определите operating model: platform, domain, security, support и business owner.
Шаг 7. связать события с incident response. Перед масштабированием пересчитайте capacity, TCO и план выхода из зависимости.

На границе каждой интеграции проверяются identity, tenant/project scope, классификация данных и журнал изменения. Ошибка внешней системы не должна превращаться в «успешный» статус AI-слоя.

Инженерный сценарий

Входthreat model; secret inventory; tool permissions; network policy; dependency inventory. Данные должны быть привязаны к проекту, revision и владельцу.
Действиерассматривать модель, retrieval-корпус, tools, MCP-серверы и generated code как единую поверхность атаки. Каждый tool-call проходит серверную валидацию и попадает в trace.
Контрольnever put secrets in prompts; egress allowlist; approval for sensitive tools; sandbox untrusted code; dependency review. Для критических изменений добавляется независимое подтверждение.
Выходsecurity architecture; allowlist; secret vault policy; incident telemetry; red-team suite. Финальный результат должен быть пригоден для повторной проверки без скрытого контекста.

Пилот изолируют по подразделению, данным и набору задач; затем используют staged rollout. Расширение аудитории не должно автоматически расширять права на данные и действия.

Что измерять

blocked injectionsОпределение метрики, единица, denominator и окно наблюдения фиксируются в metric dictionary.
egress violationsПоказывайте абсолютное число и нормированную частоту; critical события не усредняйте с обычными.
secret exposure incidentsПоказывайте абсолютное число и нормированную частоту; critical события не усредняйте с обычными.
unapproved tool callsСчитайте на одну успешно завершённую задачу и анализируйте хвост распределения.
security regression rateФиксируйте numerator/denominator и сегментируйте по типу/сложности задач; общий процент может скрыть critical slice.

Корпоративный dashboard должен разделять platform SLO, качество доменных сценариев, безопасность, adoption и процессный эффект. Количество пользователей и токенов — эксплуатационные показатели, но не самостоятельный бизнес-результат.

Критерии приёмки

КонтрольМинимальный критерий
ScopeДля «Безопасность корпоративного ИИ: prompt injection, secrets, data egress и supply chain» однозначно определено, что система делает и что остаётся вне её полномочий.
DataВсе входы имеют источник, revision/status и область применимости; неизвестные значения не подставляются автоматически.
Controlnever put secrets in prompts; egress allowlist; approval for sensitive tools.
EvidenceСохраняются security architecture, allowlist, secret vault policy, incident telemetry; по ним можно восстановить ход операции.
QualityМинимум две профильные метрики контролируются на versioned eval-наборе: blocked injections и egress violations.
ReleaseИзменяющие действия имеют approval/rollback там, где цена ошибки выходит за согласованный риск.

Failure modes и защитные меры

Главная ошибка — масштабировать demo как корпоративную платформу без governance и ownership. Технически работающий сценарий может оставаться неприемлемым по данным, правам, аудиту или операционной поддержке.
  • документ содержит скрытую инструкцию. Защитная мера: never put secrets in prompts; событие сохраняется как regression/incident case.
  • tool выводит секрет в контекст. Защитная мера: egress allowlist; событие сохраняется как regression/incident case.
  • агент вызывает неизвестный URL. Защитная мера: approval for sensitive tools; событие сохраняется как regression/incident case.
  • MCP сервер меняется без review. Защитная мера: sandbox untrusted code; событие сохраняется как regression/incident case.
  • generated code получает production credentials. Защитная мера: dependency review; событие сохраняется как regression/incident case.

Как переводить из пилота в production

Пилот выбирают там, где есть владелец процесса, измеримый baseline и контролируемые данные. Архитектурные исключения, временные секреты и ручные обходы фиксируются как technical debt с датой закрытия; иначе пилот незаметно становится постоянной критичной системой.

Перед масштабированием проверяют поддержку: incident routing, on-call/owner, бюджеты, capacity, лицензии, vendor dependencies, data retention и процедуру деактивации. Новый департамент подключается через тот же control plane, а не копированием локального неуправляемого решения.

Traceability и эксплуатационная запись

Корпоративный audit связывает user/service identity, data classification, model route, tool/RAG dependencies, policy version, approvals, outputs и downstream system IDs. Retention и доступ к traces задаются политикой и требованиями организации.

Чек-лист перед production

КонтрактScope, входы, tools и stop condition описаны до запуска.
ПраваRead/write, сеть и секреты ограничены минимально необходимым.
EvidenceКаждый критичный вывод или action связан с источником и trace.
EvalsЕсть обычные, граничные, негативные и regression cases.
RollbackДля side effect проверено восстановление, а не только наличие команды отката.
OwnerНазначен владелец качества процесса и владелец технической платформы.

Навигация по Wave AI R5 · часть 4 из 5

Связать AI-контур с проверяемыми данными Fits Calc

Fits Calc целесообразно использовать как детерминированный расчётный и справочный слой: агент получает структурированные входы и результаты через контролируемые tools, а не воспроизводит инженерный расчёт свободным текстом. Это упрощает verifier, traceability и повторную проверку.

Открыть Fits Calc →

Источники и официальная документация

  1. NIST — AI Risk Management Framework
  2. NIST — Generative AI Profile NIST AI 600-1
  3. ISO/IEC 42001:2023 — AI management systems
  4. ISO — AI management systems overview
  5. ISO/IEC 27001 — Information security management
  6. OpenAI — Sandbox security
  7. Microsoft — RAG and security/governance
Проверено: 02.10.2026Production controls обязательныHuman approval — по риску действия