Заголовки

Исследование: ИИ-инструменты часто дают неподтвержденные ответы

Согласно исследованию, проведенному Salesforce AI Research, многие известные инструменты искусственного интеллекта часто формируют выводы, не имеющие под собой оснований. В рамках анализа было рассмотрено 303 запроса, и уровень неподдержанных утверждений колебался от 25% до почти 50%. В случае более длинных отчетов этот показатель достигал 97,5%. Эксперты выделили восемь основных критериев оценки: односторонность, чрезмерная уверенность, доля релевантных и неподдержанных утверждений, отсутствие ссылок, необходимость источника, а также точность и полнота цитирования. Результаты показали, что даже при наличии большого количества ссылок, подтвержденные тезисы встречаются крайне редко. В связи с этим, пользователям и создателям контента рекомендовано рассматривать ответы ИИ как предварительные версии, сверяться с оригинальными источниками, обращать внимание на тон и не оценивать корректность по количеству ссылок.