Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Созданная учеными формула покажет, когда ИИ переключается на сомнительные ответы

Дата публикации: 10-10-2026 09:38:03

Математический инструмент, который предсказывает момент, когда ИИ-модель начинает переключаться с нормальных ответов на опасные, разработали американские ученые.

Основное содержимое страницы с новостью.

Созданная учеными формула ловит момент, когда ИИ начинает давать сомнительные ответы

Математический инструмент, который предсказывает момент, когда ИИ-модель начинает переключаться с нормальных ответов на опасные, разработали американские ученые.

Для разработки формулы ученые применили неожиданный ход. Они представили процесс поиска ответа нейросетью на поставленный вопрос, как движение по пересеченной местности. Одни долины на этом ландшафте содержат желательные ответы, другие - потенциально вредные. Эти варианты постоянно конкурируют друг с другом за "внимание" нейросети.

Созданная учеными формула описывает момент, когда система переходит из безопасной долины в рискованную. Ключевой параметр - скорость приближения к этой критической точке. Если ИИ "едет параллельно обрыву", он в безопасности. Но если его внимание начинает смещаться в сторону опасного выхода, он неизбежно с него свалится.

Ученые протестировали формулу на семи моделях от трех разных компаний. Прогноз совпал с реальным поведением в 18 из 19 случаев переключения.

Формула работает независимо от того, как определять "нежелательное" - это может быть дезинформация, нарушение медицинских или юридических обязанностей, или опасная инструкция. Машина не понимает этики, но она оперирует концепциями. И если внимание системы начинает смещаться в сторону опасного концепта, формула покажет, когда именно она перейдет черту.

Результаты работы опубликованы в журнале Patterns.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Учёные нашли переломный момент, когда ИИ становится опасным08.9510-10-2026
2Quantum-inspired math could help AI recognize when it does not know the answer08.7730-09-2026
3Инвесторов предупредили о скором схлопывании «пузыря» ИИ01007-10-2026
4Crean un "detector de mentiras" para controlar las respuestas de los chatbots de IA05.6907-10-2026
5Восстание машин уже близко: Anthropic заявила, что ИИ может представлять «экзистенциальные риски для человечества»07.7430-09-2026
6Reuters: Anthropic в своих документах перед IPO предупреждает об экзистенциальной угрозе ИИ07.7429-09-2026
7Reuters: Anthropic предупредит инвесторов об экзистенциальных угрозах ИИ07.229-09-2026
8В Перми разработали ИИ для раннего выявления риска банкротства08.5526-09-2026
9«Ажиотаж вокруг ИИ напоминает финансовый пузырь» // Anthropic предупредила об экзистенциальном риске ИИ для человечества: мнения СМИ07.6929-09-2026
10Американский ученый рассказал, как ИИ повлияет на образовательную систему011.404-10-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 11.19. Источник: rg.ru.