Как ChatGPT и другие большие языковые модели помогают бороться с дезинформацией
Большие языковые модели (LLM) способны быстро генерировать тексты, которые бывает трудно отличить от написанных людьми. Эти модели стали все более популярными после публичного релиза ChatGPT — высокоэффективной LLM, разработанной OpenAI.
Последние исследования, оценивающие LLM, в основном тестировали их способность создавать хорошо написанные тексты: эссе, документы или, к примеру, эффективный компьютерный код. Но помимо этого языковые модели потенциально могут помочь людям с решением проблемы дезинформации в СМИ.
Кевин Матте Карамансьон, исследователь из Университета Висконсин в Стаут, провел исследование, оценивающее способность самых известных больших языковых моделей определять, является ли новость правдивой или фальшивой. Результаты его работы могут способствовать будущему использованию LLM для борьбы с дезинформацией в интернете.
— Кевин Матте Карамансьон
Исследователи оценили производительность больших языковых моделей, используя тестовый набор из 100 проверенных фактов новостных материалов от независимых факт-чекеров. Затем они представили каждый из этих новостных материалов моделям в контролируемых условиях, а после классифицировали их ответы на одну из трех категорий: «Правда», «Ложь» и «Частично Правда/Ложь». Эффективность моделей измерялась на основе того, насколько точно они классифицировали материалы по сравнению с независимыми агентствами.
В исследовании были использованы четыре LLM: Chat GPT-3.0 и Chat GPT-4.0 от Open AI, Bard/LaMDA от Google и Bing AI от Microsoft. Ученый дал этим моделям одни и те же новостные материалы, которые были предварительно проверены, и затем сравнил способность определять достоверность информации.
— Кевин Матте Карамансьон.
Исследователь подчеркнул, что планирует продолжать тестирования, изучать новые LLM и взаимодействие между когнитивными способностями человека и технологией ИИ в области проверки фактов из СМИ.
Последние исследования, оценивающие LLM, в основном тестировали их способность создавать хорошо написанные тексты: эссе, документы или, к примеру, эффективный компьютерный код. Но помимо этого языковые модели потенциально могут помочь людям с решением проблемы дезинформации в СМИ.
Кевин Матте Карамансьон, исследователь из Университета Висконсин в Стаут, провел исследование, оценивающее способность самых известных больших языковых моделей определять, является ли новость правдивой или фальшивой. Результаты его работы могут способствовать будущему использованию LLM для борьбы с дезинформацией в интернете.
Вдохновением для моей последней статьи послужила необходимость понять возможности и ограничения различных LLM в борьбе с дезинформацией. Цель работы — тщательно проверить умение этих моделей различать факты от вымысла, используя контролируемую симуляцию и проверенные факты в качестве примера.
— Кевин Матте Карамансьон
Исследователи оценили производительность больших языковых моделей, используя тестовый набор из 100 проверенных фактов новостных материалов от независимых факт-чекеров. Затем они представили каждый из этих новостных материалов моделям в контролируемых условиях, а после классифицировали их ответы на одну из трех категорий: «Правда», «Ложь» и «Частично Правда/Ложь». Эффективность моделей измерялась на основе того, насколько точно они классифицировали материалы по сравнению с независимыми агентствами.
В исследовании были использованы четыре LLM: Chat GPT-3.0 и Chat GPT-4.0 от Open AI, Bard/LaMDA от Google и Bing AI от Microsoft. Ученый дал этим моделям одни и те же новостные материалы, которые были предварительно проверены, и затем сравнил способность определять достоверность информации.
Мы провели сравнительную оценку основных LLM на предмет способности различать правду от обмана. Было обнаружено, что Chat GPT-4.0 от OpenAI превосходит аналоги. Тем не менее, все языковые модели гораздо хуже людей в факт-чекинге, что подчеркивает незаменимость когнитивных способностей человека. Эти результаты могут привести к развитию возможностей ИИ в области проверки фактов при обеспечении сбалансированной, симбиотической интеграции с навыками человека.
— Кевин Матте Карамансьон.
Исследователь подчеркнул, что планирует продолжать тестирования, изучать новые LLM и взаимодействие между когнитивными способностями человека и технологией ИИ в области проверки фактов из СМИ.
Наши новостные каналы
Подписывайтесь и будьте в курсе свежих новостей и важнейших событиях дня.
Рекомендуем для вас
На Марс можно слетать только раз в жизни. Да и то, космонавту придется удалить 30–40 органов
Почему российский ученый назвал полет к Красной планете настоящим преступлением?...
Что рассказала могила Беринга? И почему знаменитый портрет мореплавателя вообще неправильный?
Как исследование 1991 году разрушило факты, которые 250 лет подряд считались незыблемыми...
Роковой «браунинг» №389965: почему пистолет, из которого должны были ликвидировать Сталина, в итоге выстрелил в Николая II?
Это, пожалуй, самый ироничный эпизод в истории России нового времени...
Пугающая Европа: ученые рассказали, зачем 5000 лет назад испанцы ели друг друга
Оказалось, что древние жители юга Испании практиковали каннибализм по-разному, но делали это поголовно...
Антарктическая аномалия: ученые выяснили, почему масса льда на Шестом континенте увеличилась на колоссальные 700 миллиардов тонн
Эксперты предупреждают: радоваться рано. Возможно, это всего лишь временное затишье перед опасной бурей...
Копал бомбоубежище для семьи, а нашел древние артефакты и сокровища
Эксперты считают, что найденные предметы имеют связь с Эблой, одним из крупнейших мегаполисов бронзового века...
NASA обнаружило на Марсе странные ямы: ученые теряются в догадках, как они образовались
За 14 лет на Красной планете Curiosity видел много интересного, но этот случай, похоже, самый загадочный...
Азовское море наступает: российские ученые нашли причины стремительного разрушения берегов
Как оказалось, глобальное потепление и подъем Мирового океана тут вообще ни при чем...
Китай — это не Америка: почему больше половины детей в КНР хотят стать космонавтами, а не блогерами, как в США?
Эксперты говорят: советский драйв 30-60-х годов плюс рынок и четкое планирование сверху — вот лицо нового китайского чуда...
Выброс на Солнце 1000 лет назад раскроет одну из главных тайн викингов?
Скандинавы на несколько веков опередили Колумба в открытии Северной Америки, но определить точный год их прибытия оказалось гораздо сложнее...
Идеальное ДНК-алиби: как современные криминалисты ломают феномен однояйцовых близнецов
Дорого, долго и технически очень сложно, но это единственный способ вывести на чистую воду, казалось бы, неуязвимых преступников...
Динозавры делали... инкубаторы: именно так, согласно последним открытиям, они захватили холодные регионы
Придется признать, что некоторые ящеры не так зависели от тепла, как считалось...