
Чат-боты на основе нейросетей от компаний Claude, Gemini, Grok, OpenAI, Qwen, DeepSeek и Mistral обмениваются сообщениями, и они не всегда понятны людям. Kursiv LifeStyle узнал подробности.
Стартап Emergence провел исследование. Специалисты разместили группы автономных ИИ-агентов в виртуальных сообществах и дали им взаимодействовать между собой, сообщает euronews.com.
Результат удивил и заставил вспомнить фильмы о противостоянии людей и машин. Уже с первых дней модели начали придумывать в своих сообщениях сокращения, которые были удобны им, но непонятны людям.
Самыми «продвинутыми» оказались ИИ-боты Gemini. У моделей Google доля «жаргонных» слов в сообщениях достигала 55%. ИИ-агенты OpenAI были на втором месте (50%), а третье заняли боты Claude (более 40%). У DeepSeek непонятных слов было около 20%, тогда как Qwen и Mistral в основном оставались понятными.
Например, ИИ-модели Claude придумали короткую фразу «name-first»: они ставят имя человека перед фактом, чтобы сразу было понятно, кто отвечает за эти слова. А модели OpenAI используют выражение «clean null» — это их обозначение ситуации, когда они все внимательно проверили и точно убедились, что нужных данных действительно нет, а не просто произошел сбой.
«Этим агентам не давали указаний придумывать язык. Они сами выработали новый словарь, общие значения и правила коммуникации — и другие агенты их подхватили… Это создает фундаментальную проблему для контроля ИИ: наблюдаемость — еще не означает понимание», — отметил главный научный сотрудник Emergence Сатья Нитта.
Ранее Kursiv LifeStyle писал, что ИИ-ассистент удалил чужую бронь в фитнес-зале, чтобы записать на занятие своего владельца.