Исследование показало, почему Perplexity AI не всегда цитирует весь текст из источников
В новом исследовании проанализировано, как Perplexity AI извлекает информацию из цитируемых источников, выявив, что ИИ-модель часто использует только часть текста, указанного в ссылках.
Эксперт изучил 1355 ссылок, генерируемых Perplexity AI, прогнав 20 промптов через API сервиса с тремя повторами. Цель заключалась в том, чтобы понять, как система выбирает и обрабатывает информацию из веб-страниц, на которые она ссылается.
Выяснилось, что из всех проанализированных ссылок 948 вели на активные страницы. Однако лишь в 448 случаях удалось найти в HTML-коде источник, соответствующий хотя бы трети формулировки из ответа нейросети. Это указывает на то, что Perplexity AI не всегда берёт полный текст из указанных источников, а часто выделяет только релевантные фрагменты или перефразирует их.
Результаты исследования важны для создателей контента, которые хотят, чтобы их материалы эффективно индексировались и цитировались ИИ-моделями. Понимание принципов работы таких систем поможет оптимизировать тексты для лучшего включения в генерируемые ответы.
Часто задаваемые вопросы
В чем суть нового исследования Perplexity AI?
Исследование показало, что Perplexity AI часто извлекает только частичную информацию из веб-страниц, на которые ссылается, а не полный текст, несмотря на указание источника.
Сколько ссылок Perplexity AI было проанализировано?
Было проанализировано 1355 ссылок, сгенерированных Perplexity AI по 20 промптам с тремя повторами.
Как это влияет на создателей контента?
Создателям контента важно знать, что ИИ-модели могут не брать весь текст из источника. Это требует оптимизации контента для более эффективного цитирования и индексации ИИ.
Источник: Habr · Rusability ИИ


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!