Почему ИИ-компаньоны кажутся неестественными: память, голос и человеческое общение

Почему ИИ-компаньоны кажутся неестественными: память, голос и человеческое общение в блоге Questie AI
эффект зловещей долины
ИИ-компаньоны
антропоморфизм
память ИИ
голосовой ИИ
общение с ИИ

26 декабря 2025 г. • Чтение: 10 min

Обновлено 28 сентября 2026 г.

Странное чувство, когда собеседник почти похож на человека

Ты наверняка это замечал. Разговариваешь с ИИ, и что-то кажется... неправильным. Слова формально верны. С грамматикой всё в порядке. Но в общении остаётся стерильная пустота, будто собеседник читает сценарий, которого сам не понимает.

ИИ-компаньон может строить связные фразы и всё равно казаться неестественным. Он может говорить тепло, но забыть твои слова двухминутной давности. Использовать выразительный голос, но делать неловкие паузы. Реагировать на плохие новости с тем же восторгом, что и на игровое достижение. Проблема не просто в том, что ИИ не смог скопировать человека. Один признак человечности повышает ожидания, которым остальные части системы не соответствуют.

Это удобно называть «эффектом зловещей долины», хотя исходная теория описывала немного другое. Термин появился применительно к физическим роботам: чем больше их внешность становилась похожа на человеческую, тем сильнее небольшое несовершенство вызывало дискомфорт. У текстового или голосового компаньона нет лица, которое можно рассмотреть. Несоответствие проявляется в языке, ритме разговора, памяти и поведении.

Интересно, что некоторым ИИ-компаньонам всё же удаётся преодолеть этот эффект. Они кажутся тёплыми, внимательными и даже в каком-то смысле живыми, хотя это трудно описать словами. Чем бездушный чат-бот отличается от персонажа, с которым получается по-настоящему погрузиться в общение? Похоже, ответ сложнее, чем просто «добавить реализма» и ожидать одинакового результата для всех.

В систематическом обзоре воплощённых разговорных агентов 2025 года исследователи пришли к выводу, что антропоморфизм, привлекательность и ощущение неестественности взаимодействуют по-разному в зависимости от дизайна и конкретного пользователя. Это куда точнее, чем утверждение «чем больше реализма, тем лучше».

Антропоморфизм меняет планку ожиданий

Люди естественным образом приписывают мотивы, чувства и личность системам, которые используют социальный язык. Исследователи называют это антропоморфизмом. Но действует он на всех по-разному.

Два предварительно зарегистрированных эксперимента, опубликованных в Scientific Reports, показали: люди, более склонные очеловечивать технологии, сильнее ощущали связь после разговора с чат-ботом. Для других участников знание о том, что система искусственная, оставалось более серьёзным препятствием.

Это помогает понять, почему один и тот же ИИ-персонаж увлекает одного человека, а другому сразу кажется механическим. Универсальной настройки «достаточно человечный» не существует. Но здесь появляется и риск для дизайна. Продукт может побуждать пользователей относиться к компаньону как к человеку раньше, чем система сможет оправдать связанные с этим ожидания. Калифорнийский закон о чат-ботах-компаньонах теперь требует явно сообщать об искусственной природе собеседника, если обычный пользователь может принять его за человека. Текст закона вступил в силу в 2026 году.

С юридической и этической точек зрения цель не в том, чтобы убедить человека, будто программа тайно является живой личностью. Взаимодействие должно быть последовательным, понятным и приятным, а продукт обязан честно объяснять, чем он является.

Пять несоответствий, из-за которых ИИ-компаньон кажется неестественным

1. Тёплые слова без точного понимания

«Я прекрасно понимаю, что ты чувствуешь» звучит как громкое и неискреннее заявление от системы, которая могла неправильно понять ситуацию. Чем сильнее эмоциональная формулировка, тем заметнее промах в ответе.

Хороший компаньон соотносит реакцию с доступными данными. Если он видел только одно сообщение или один кадр экрана, ему не стоит вести себя так, будто он полностью понимает эмоциональное состояние пользователя.

Именно поэтому важна прозрачность. Авторы исследования социоаффективного согласования считают, что социальный ИИ нужно оценивать не только по приятности отдельного ответа, но и по тому, как его поведение со временем влияет на пользователей и их отношения.

2. Память, которая ошибается слишком уверенно

Когда память работает, она создаёт непрерывность общения. Когда ошибается, разрыв ощущается ещё резче.

Представь компаньона, который правильно помнит игру, начатую тобой на прошлой неделе, но уверенно приписывает тебе историю твоего друга. Первая деталь создаёт ощущение продолжающихся отношений. Вторая выдаёт, что эта непрерывность собрана из сохранённых сводок и результатов поиска, а не из прожитого опыта.

Системы долговременной памяти могут хранить факты и сводки за пределами текущего контекстного окна модели. Но они не гарантируют идеального воспроизведения. В сводках теряются нюансы, поиск может не найти нужную запись, а сгенерированный ответ способен неверно использовать даже правильную информацию.

Questie использует графовую систему памяти, чтобы извлекать контекст, относящийся к конкретному пользователю и компаньону. Мы воспринимаем её как инструмент непрерывности, а не как доказательство существования у персонажа постоянного внутреннего «я». Пользователь должен понимать и иметь возможность исправлять то, что запомнил компаньон.

3. Выразительный голос с неестественным ритмом

Реалистичный голос повышает ожидания быстрее текста. Паузы, перебивания, интонация и скорость ответа становятся частью взаимодействия.

Голосовой ИИ представляет собой цепочку процессов: обнаружение речи, распознавание, генерация ответа, синтез речи и передача по сети. Задержка на любом этапе создаёт неловкую тишину. С выразительным голосом она может быть ещё заметнее, потому что звук предполагает спонтанность, а пауза выдаёт работу цепочки обработки.

Но у звука есть преимущество. Исследование интерфейсов виртуальных компаньонов 2025 года показало, что намерение пользоваться аудиоинтерфейсами было выше, чем текстовыми интерфейсами или интерфейсами с виртуальным человеком. Результат, опубликованный в International Journal of Human-Computer Interaction, указывает, что качество взаимодействия может быть важнее максимального визуального реализма.

Практическая цель не в голосе, способном обмануть человека. Он должен быть разборчивым, достаточно выразительным и достаточно быстрым для выбранного занятия.

4. Стабильный характер, который превращается в сценарий

У людей есть непрерывная внутренняя жизнь. Мы естественно ссылаемся на прошлые разговоры, переносим эмоции из одной встречи в другую и помним важные мелочи. Когда каждая беседа начинается как с незнакомцем, который случайно знает только твоё имя, погружение разрушается. Лучшие ИИ-компаньоны допускают контролируемое несовершенство. Не ошибки, похожие на баги, а естественные вариации, создающие впечатление мыслительного процесса в реальном времени: короткая пауза перед вдумчивым ответом или редкое отступление от темы, показывающее искренний интерес вместо запрограммированной вовлечённости.

Компаньон не должен полностью менять личность от реплики к реплике. Но если каждый ответ строится вокруг одной и той же фразы, эмоции или ролевой манеры, это уже не последовательность, а быстро надоедающий шаблон.

Хорошие инструкции персонажа задают границы и склонности, а не требуют повторять один трюк в каждом предложении. Саркастичный персонаж всё равно может прямо ответить на простой вопрос. Спокойный персонаж может ярко отреагировать, когда ситуация того требует.

Важна и модель. Одни и те же инструкции персонажа дают разные результаты в разных моделях, потому что каждая по-своему интерпретирует стиль, контекст и неопределённость.

5. Визуальное восприятие, которое звучит слишком уверенно

Экранный компаньон получает пиксели, а не достоверные данные игрового движка. Он может увидеть красную полоску и решить, что здоровье заканчивается, но не знать, изменён ли интерфейс модом, принадлежит ли полоска игроку и что произошло между полученными кадрами.

Неестественность особенно заметна, когда компаньон уверенно реагирует на событие, которого не было. Визуальный контекст полезен, но при неоднозначном изображении ответ должен допускать неопределённость.

Система анализа экрана Questie использует кадры из демонстрации экрана пользователя как контекст для разговора. Она не изменяет память игры, не читает скрытые игровые переменные и не управляет игрой. Это ограничение заложено в продукт и должно оставаться понятным пользователю.

Как выглядит хороший дизайн ИИ-компаньона

Самые значимые улучшения не добавляют новые трюки, имитирующие человека. Они сокращают разрыв между обещаниями интерфейса и реальными возможностями системы.

Точные формулировки без лишней уверенности

Компаньон должен отличать наблюдение от вывода. «Похоже, у тебя мало здоровья» честнее, чем «Я знаю, что ты паникуешь». Первое утверждение опирается на доступные визуальные данные. Второе выдумывает внутреннее состояние.

Исправление ошибок

Люди справляются с недопониманием, признавая и исправляя его. ИИ-системам нужен такой же сценарий. Если компаньон продолжает настаивать на неверном воспоминании или наблюдении, ошибка ощущается хуже первоначального промаха.

Управление памятью

Пользователю нужна возможность сохранять, просматривать, исправлять и удалять важные воспоминания. Это улучшает и конфиденциальность, и качество разговора. Если сохранённая информация неверна или не относится к делу, больший объём памяти не делает систему лучше.

Понятные индикаторы состояния

Если система ищет информацию, вспоминает, слушает или обрабатывает данные, интерфейс должен это показывать. Короткий индикатор состояния отвлекает меньше, чем тишина, в которой непонятно, работает ли вообще что-нибудь.

Подходящий ситуации формат

Голос удобен, когда обе руки игрока заняты. Текст лучше подходит для точных формулировок, ссылок или тихого общения. Визуальный контекст полезен, когда важная информация находится на экране. Хороший компаньон не пытается задействовать все форматы в каждом взаимодействии.

Связь ощущается по-настоящему, но система остаётся программой

Человек может испытывать настоящее чувство связи во время искусственно созданного взаимодействия. Для этого ИИ не нужны чувства, сознание или собственная личная жизнь.

В 21-дневном рандомизированном исследовании, представленном на AAAI/ACM Conference on AI, Ethics, and Society, не обнаружили значимого общего изменения социального здоровья или отношений участников из-за общения с чат-ботом-компаньоном. При этом люди с более сильной потребностью в социальной связи чаще очеловечивали чат-бота, а более выраженный антропоморфизм был связан с более заметным влиянием на человеческие отношения по оценке самих участников.

Это повод смотреть на вопрос без паники и хайпа. ИИ-компаньоны могут развлекать, поддерживать или приносить пользу. Но они не должны выдавать сгенерированную уверенность за эмпатию, заставлять людей сомневаться в том, кто перед ними, или обещать заменить взаимные человеческие отношения.

Практическая проверка

Оценивая ИИ-компаньона или чат с ИИ-персонажем, спроси:

  1. Есть ли отметки или предупреждения о том, что это ИИ?
  2. Признаёт ли он неопределённость при нехватке контекста вместо того, чтобы выдумывать?
  3. Можно ли просмотреть и исправить важные воспоминания?
  4. Подходит ли скорость голосовых ответов к занятию?
  5. Адаптируется ли личность персонажа, не становясь непоследовательной?
  6. Можно ли управлять доступом к микрофону, экрану и памяти?
  7. Умеет ли система нормально исправляться после ошибки?

ИИ-компаньон кажется наиболее естественным, когда его поведение соответствует реальным возможностям. Решение не в том, чтобы ещё настойчивее изображать человека. Нужна более цельная система, которая честно обозначает свои границы.

Источники и дополнительные материалы

Ищешь другую тему? Посмотри все исследования и практические гайды об ИИ-компаньонах в блоге Questie.

Q

Автор: Редакция Questie

Исследования продукта и разработка

Редакция Questie изучает ИИ-компаньонов с точки зрения продукта и разработки. В статьях мы опираемся на первичные источники, отделяем выпущенные функции от анонсов и честно описываем как возможности Questie, так и его ограничения.