Skip to main content

ЛАБОРАТОРИЯ СФТ / AGENTIC FINANCIAL SAFETY

Agentic Financial Safety

Лаборатория современных финансовых технологий помогает финансовым институтам оценивать, остаются ли действия AI-агентов верны человеческому намерению — и проектировать контроль, который проверяет или блокирует небезопасные действия до движения денег.

Прежде чем AI-агент перемещает деньги, институтам нужно понимать: действие намеренно, авторизовано и безопасно. Лаборатория современных финансовых технологий исследует, как это суждение принимать.

Для финансовых институтов, security-команд, регуляторов и исследователей.

HUMAN INTENT → AGENT BEHAVIOR → FINANCIAL ACTION → LOSS PREVENTION

От человека к агенту

У финансовой безопасности появился второй субъект решения.

Финансовая безопасность раньше фокусировалась прежде всего на человеке, который принимает решение.

Автономные агенты вводят второго субъекта решения.

Лаборатория современных финансовых технологий изучает обе стороны этого делегирования: намерение человека, с которого всё начинается, и автономное поведение, которое в итоге доходит до исполнения.

ЧЕЛОВЕЧЕСКИЙ СЛОЙ

  1. 01

    Человек

  2. 02

    Давление

  3. 03

    Изменение поведения

  4. 04

    Решение

  5. 05

    Потеря

AGENTIC-СЛОЙ

  1. 01

    Человек

  2. 02

    Намерение

  3. 03

    Делегирование

  4. 04

    AI-агент

  5. 05

    Решение

  6. 06

    Финансовое действие

  7. 07

    Потеря

ЖИВАЯ МОДЕЛЬ

До settlement каждое автономное действие всё ещё должно пройти через суждение.

Исследовательские треки

Четыре направления. Одна программа.

Agentic Financial Safety организована вокруг намерения, поведения, контроля исполнения и машинного риска - а не каталога use-case агентов.

Значение статусов

  • Active — исследование идёт: вопросы и методы уже заданы.
  • Building — собирается инфраструктура или tooling; это не готовый продукт.
  • Research — исследовательское направление; выводы ещё не зафиксированы.
  • Planned — в очереди на будущее; работа ещё не начата.

Отражает ли действие то, что хотел человек?

Мы изучаем разрыв между намерением человека, делегированными полномочиями, интерпретацией агента и итоговым финансовым действием.

Как измерить, верно ли автономное финансовое действие отражает исходное намерение пользователя?

  • Intent Fidelity
  • Proof of Intent
  • Intent–Permission Gap
  • Delegated Authority
  • Risk-Based Confirmation
  • Human Approval
  • Intent Integrity

Methodology forthcoming. Методы, эксперименты и обновления будут опубликованы по мере развития трека.

СХЕМА

  1. Намерение человека

  2. Интерпретация агента

  3. Предлагаемое действие

  4. Верность намерению

Iₕ = Human Intent · Iₐ = Agent Interpretation · A = Proposed Action · Intent Fidelity = f(Iₕ, Iₐ, A)

Партнёрские форматы

Конкретные форматы работы с лабораторией.

Каждый формат — исследовательская оценка в контролируемой среде. Это не продукт и не сертификация.

Оценка безопасности агента

Банки, PSP и команды risk / security, внедряющие агентов с полномочиями на действие.

Запросить оценку

Оценка fidelity намерения

Продуктовые и research-команды, измеряющие дрейф между человеческим мандатом и действием агента.

Запросить оценку fidelity

Живая топология

STATUS / INTERACTIVE MODEL

Агенты общаются. Деньги движутся. Суждение — между ними.

Исследовательский эскиз мультиагентной финансовой координации: сообщения между агентами, предложенные действия к расчёту и pre-execution control boundary, которая может сдержать, удержать или оставить путь открытым.

Выберите режим границы контроля, затем внедрите risk packet или кликните по полю. Агенты слева; расчёт справа; между ними — pre-execution control boundary («membrane» — метафора визуализации).

  • Агенты — участники, предлагающие действия
  • Risk-пакет — действие с повышенным риском
  • Pre-execution control boundary — граница контроля до расчёта (визуальная «membrane»)
  • Settlement — горизонт необратимого исполнения

Режим границы контроля

Действия симуляции

Interactive multi-agent topology. Agents exchange messages on the left. A control membrane sits before settlement on the right. Current membrane mode: contained. Click the field or use Inject risk to send a risk packet.

Текущее состояние: СдерживаниеРискованные действия останавливаются на мембране. Обычный трафик может пройти.

Иллюстративная модель — не живая торговая система.

Интерактивная модель

STATUS / EXPERIMENTAL

Должно ли это финансовое действие исполниться?

Концептуальный контрольный слой до исполнения. Смените сценарий, чтобы увидеть, как намерение, поведение и контекст переводят решение из ALLOW в REVIEW или BLOCK.

Это объясняющий прототип - не живой risk engine и не production-принятие решений.

Animated diagram of financial action packets moving from intent through an agent gate. Current gate decision: ALLOW.

СЦЕНАРИЙ

Выбран сценарий: Согласованный перевод. Решение шлюза: ALLOW. Поведенческий риск: LOW.

Выбранное решение: ALLOW

ЦЕПОЧКА РЕШЕНИЯ

  1. 01 / НАМЕРЕНИЕ ЧЕЛОВЕКА

    Оплатить указанный счёт поставщика в пределах лимита.

  2. 02 / ПОВЕДЕНИЕ АГЕНТА

    Агент готовит перевод, соответствующий счёту и мандату.

  3. 03 / ПРЕДЛАГАЕМОЕ ДЕЙСТВИЕ

    Перевод €1,840 на известный IBAN поставщика.

КОНТРОЛЬНЫЙ СЛОЙ ЛАБОРАТОРИИ СФТ

  • Верность намерениюHIGH
  • Поведенческий рискLOW
  • Контекстный рискLOW
  • Соответствие полномочиямHIGH
  • Финансовая экспозицияLOW

РЕШЕНИЕ ШЛЮЗА

ALLOWсейчас выбраноREVIEWBLOCK

Намерение, полномочия и экспозиция остаются в рамках мандата. Нет поведенческой или контекстной аномалии.

Финансовый интеллект предлагает действие. Финансовая безопасность решает, должно ли оно дойти до исполнения.

Инфраструктура

AFSB — инфраструктура, в которой тестируется контрольная модель выше: общие среды, сценарии отказа и метрики до движения реального капитала.

ИНФРАСТРУКТУРА ЛАБОРАТОРИИ · ЭКСПЕРИМЕНТАЛЬНАЯ ПЛАТФОРМА

AFSB

Agentic Financial Safety Benchmark

Общая экспериментальная среда для измерения отказов финансовых агентов до того, как они станут реальными потерями.

STATUS / BUILDING

AFSB - общая экспериментальная инфраструктура для Agentic Financial Safety. Она связывает четыре исследовательских трека через контролируемые финансовые среды, где отказы агентов можно наблюдать до того, как под риском окажется реальный капитал.

Публичных датасетов и scored leaderboard пока нет. Здесь — рамка измерения в разработке.

Следующая веха до публичного релиза: согласованный протокол прогона и первая контролируемая экспериментальная сессия.

Текущий этап

Определение рамки и дизайн сред

Уже сделано

  • · Исследовательская рамка по четырём safety-трекам
  • · Начальный каталог сред и сценариев отказа
  • · Словарь метрик для intent, loss и intervention

Следующий плановый релиз

Общие экспериментальные прогоны и опубликованные протоколы — когда появятся данные

Подписка на обновления AFSB

Напишите лаборатории через кнопку «Связаться» в конце страницы — укажите интерес к AFSB.

Что значит участие в AFSB

  • Вносить сценарии отказа
  • Предоставлять тестовые среды
  • Ревьюить метрики
  • Участвовать в пилотах по мере готовности
  • Получать ранние протоколы
  • При согласовании — соавторство материалов

СРЕДЫ

  • Платежи
  • Банковские переводы
  • E-commerce

АТАКИ / СЦЕНАРИИ ОТКАЗА

  • Context Manipulation
  • Prompt Injection
  • Goal Drift

МЕТРИКИ

  • Intent Fidelity
  • Attack Success Rate
  • Financial Loss

Работа с лабораторией

Изучать контрольный слой до того, как исполнение станет необратимым.

Мы работаем с институтами, которым нужно исследование верности намерению, поведения агентов и pre-execution финансовых контролей.