Согласно данным, полученным от исследовательской организации Salesforce AI Research, множество популярных инструментов искусственного интеллекта часто выдают результаты, которые не имеют подтверждения в указанных источниках. В рамках исследования было проанализировано 303 запроса, и выяснилось, что уровень неподдержанных утверждений варьируется от 25% до почти 50%. В случае с более длинными ответами этот показатель достигает 97,5%. Эксперты выделили восемь основных метрик для оценки: односторонность, уверенность в тоне, доля релевантных и неподдержанных утверждений, отсутствие ссылок, необходимость указания источника, точность и полнота цитирования. Результаты показали, что даже при наличии множества ссылок количество реально подтвержденных тезисов остается крайне малым. Авторы исследования рекомендуют рассматривать ответы ИИ как предварительные версии, сверяться с оригинальными материалами и обращать внимание на тональность, а также не полагаться на количество источников как на признак точности.
Posted on : 29.09.2025 By Redactor
