Открытые LLM вроде LLaMA или Mistral стали основой для множества финансовых агентов • от ботов в Telegram до корпоративных систем. Их прозрачность, которая считается преимуществом, оборачивается риском: любой может скачать модель и методом градиентного спуска подобрать входные данные, которые заставят её выдать нужный злоумышленнику ответ • например, «продать всё». Такая атака не требует взлома серверов и работает сразу против всех пользователей одной и той же модели. Суть угрозы не в том, что кто-то обманет одного пользователя, а в том, что одна и та же «отравленная» фраза или сигнал может одновременно сбить с толку тысячи агентов по всему миру. Это делает такие системы особенно уязвимыми в высокоставочных сценариях • например, при управлении активами. Предложенный подход с VRF (Verifi... Читать полностью — Habr 📰 — Habr

Читать полностью на Habr →

Получайте такие новости первым

AI анализирует 50+ источников каждые 15 минут. Без кликбейта, без шума — только важное.

Вступить в Telegram

Бесплатно · Без спама · Отписка в 1 клик