Разработан алгоритм определения продажности сайтов

А вы в состоянии понять, что за сайт перед вами — чья-то личная страница или корпоративный проект, особенно если на нем расположена некая коммерческая информация? Специалисты в сфере IT из Индии и Японии утверждают, что нашли автоматический способ отличить чью-то персональную страничку от коммерческого сайта, сделанного с целью одурачивания потребителей.

Такахиро Хаваши с коллегами из университета Ниигаты объясняют, что их метод извлекает субъективно воспринимаемые выражения, расположенные на вэб-странице. Затем система подсчитывает степень субъективности и выносит вердикт, выражает ли содержание страницы чье-то личное мнение или это такая маркетинговая уловка.

Ученые протестировали систему в работе, проанализировав 1200 страниц, тематически относящихся к четырем направлениям — конкретный товар, туризм, ресторан и кино. Выяснилось, что данный метод намного более эффективен для нахождения именно личных страниц, чем любой поисковик. А происходит это потому, что большинство популярных поисковых машин оценивает личные странички невысоко и они редко встречаются даже на первых десяти страницах результатов поиска.

Личные сайты, блоги и форумы расцениваются поисковиками, например Google или Яндекс, как личные странички, и как правило они никогда не займут места в первой десятке результатов поиска (SERPs). Именно чье-то личное мнение о том или ином продукте найти в интернете несравнимо труднее, чем коммерческие резюме и релизы.

Новая система основывается на том факте, что составители проплаченных сообщений чаще всего не употребляют критических или негативных отзывов о какой-либо продукции или услуге. Личные же мнения обычно пестрят и положительными, и негативными сообщениями.

В японском письменном это могут быть: выражения с негативной окраской, завершающие частицы, междометия и определенные символы — Кандзи — наподобие наших смайликов. Существуют эквивалентные выражения и на других языках.

Вот примерно такие выражения и извлекаются из текста страницы, а системный алгоритм разбирается, сколько из них положительных, а сколько отрицательных. Это и служит основным индикатором принадлежности страницы.

Подобный подход было бы неплохо применять в результатах поиска всех поисковиков, чтобы те, кому это важно, могли искать мнения потребителей, а не штампованные на заказ тексты.

21.05.2009

Оценка:

Подписаться в Telegram



Net&IT

Nature Electronics: Изменение памяти дает новые вычислительные возможности
Nature Electronics: Изменение памяти дает новые вычислительные возможности

Ученые Рочестерского университета разработали ...

Nature: 2D-материал изменяет форму 3D-электроники для искусственного интеллекта
Nature: 2D-материал изменяет форму 3D-электроники для искусственного интеллекта

Многофункциональные компьютерные чипы эволюцио...

Началась регистрация на конкурс «Битва искусственных интеллектов»
Началась регистрация на конкурс «Битва искусственных интеллектов»

Стартовал отборочный этап Международного техно...

ИИ помогает математикам находить закономерности
ИИ помогает математикам находить закономерности

Применение машинного обучения для поиска ...

Scientific Reports: Борьба с недоверием в Интернете может быть неэффективной
Scientific Reports: Борьба с недоверием в Интернете может быть неэффективной

Новое исследование, проведенное Университетом ...

JRCS: ChatGPT перегружает пользователей выбором
JRCS: ChatGPT перегружает пользователей выбором

За последние несколько лет в области...

Искусственный интеллект может превзойти человеческий мозг
Искусственный интеллект может превзойти человеческий мозг

Ощупывание кошачьей шерсти может дать некотору...

Нейронные сети в опасности: как злоумышленники могут запутать ИИ
Нейронные сети в опасности: как злоумышленники могут запутать ИИ

Большинство искусственных интеллектуальных сис...

ChatGPT почти такой же хороший диагност, как доктор Хаус
ChatGPT почти такой же хороший диагност, как доктор Хаус

Чат-бот с искусственным интеллектом ChatG...

QS&T: Ученые создали самый точный метод управления квантовыми компьютерами
QS&T: Ученые создали самый точный метод управления квантовыми компьютерами

С помощью лазерного излучения исследователи ра...

New Phytologist: ИИ поможет распознавать аллергенную пыльцу
New Phytologist: ИИ поможет распознавать аллергенную пыльцу

Новая система, сочетающая в себе быстрое ...

Российские игры покоряют мир: Atomic Heart заняла первое место на Steam
Российские игры покоряют мир: Atomic Heart заняла первое место на Steam

В этом году российская игровая индустрия продо...

HV&I: ChatGPT помогает выявлять фейки о вакцинации
HV&I: ChatGPT помогает выявлять фейки о вакцинации

Чат-бот ChatGPT может помочь увеличить количес...

Те, у кого нет AR-очков, уязвимы перед теми, у кого они есть
Те, у кого нет AR-очков, уязвимы перед теми, у кого они есть

Тот, кто носит очки дополненной реальност...

Nature: Научная группа разработала критерии определения сознания ИИ
Nature: Научная группа разработала критерии определения сознания ИИ

В этом может помочь контрольный список, состав...

JAMA Oncology: ChatGPT еще не готов заменить врачей-онкологов
JAMA Oncology: ChatGPT еще не готов заменить врачей-онкологов

Когда исследователи попросили чатбот назначить...

Computers in Human Behavior: Социальные сети не провоцируют депрессию у детей
Computers in Human Behavior: Социальные сети не провоцируют депрессию у детей

Дети действительно проводят много времени в&nb...

Поиск на сайте

Знатоки клуба инноваций


ТОП - Новости мира, инновации

Nature Geoscience: Ученые возвестили начало лунного антропоцена
Nature Geoscience: Ученые возвестили начало лунного антропоцена
NeuroImage: Найдено объяснение разного уровня эритроцитов в крови новорожденных
NeuroImage: Найдено объяснение разного уровня эритроцитов в крови новорожденных
PLOS ONE: Разработана система для предотвращения потери природных ресурсов
PLOS ONE: Разработана система для предотвращения потери природных ресурсов
Хирургия полезна для некоторых детей с легким нарушением дыхания во сне
Хирургия полезна для некоторых детей с легким нарушением дыхания во сне
PLOS ONE: Сойки и вороны по-разному реагируют на появление конкурентов
PLOS ONE: Сойки и вороны по-разному реагируют на появление конкурентов
PNAS: Есть ли признаки жизни на холодной луне Сатурна?
PNAS: Есть ли признаки жизни на холодной луне Сатурна?
Мозг новорожденных только кажется недоразвитым по сравнению с другими приматами
Мозг новорожденных только кажется недоразвитым по сравнению с другими приматами
Исследователи составили карту воздействия кетамина на мозг
Исследователи составили карту воздействия кетамина на мозг
Исследование показало, как важный белок сбалансировал клеточные мембраны
Исследование показало, как важный белок сбалансировал клеточные мембраны
AJT: Старые органы ускоряют старение получателей трансплантатов
AJT: Старые органы ускоряют старение получателей трансплантатов
Ученые предложили собирать воду из воздуха с помощью солнечной энергии
Ученые предложили собирать воду из воздуха с помощью солнечной энергии
В Science Advances опубликовали новые сведения о гибели динозавров
В Science Advances опубликовали новые сведения о гибели динозавров
JI: В-клетки вырабатывают антитела, которые подавляют аутоиммунный патогенез
JI: В-клетки вырабатывают антитела, которые подавляют аутоиммунный патогенез
Nature Comm: Робот, созданный по образу улитки, соберет микропластик в океане
Nature Comm: Робот, созданный по образу улитки, соберет микропластик в океане
Соленые иммунные клетки в мозге связаны с деменцией, вызванной гипертонией
Соленые иммунные клетки в мозге связаны с деменцией, вызванной гипертонией

Новости компаний, релизы

НАИРИТ объявит итоги Всероссийского инновационного конкурса 21 февраля
НАИРИТ объявит итоги Всероссийского инновационного конкурса 21 февраля
«Инструменты инновационного развития»
«Инструменты инновационного развития»
3 причины перехода с печатной рекламы на цифровую
3 причины перехода с печатной рекламы на цифровую
Виды резервирования серверов для задач АСУ ТП
Виды резервирования серверов для задач АСУ ТП
Выбор клиники и лечащего врача с помощью специализированного сервиса
Выбор клиники и лечащего врача с помощью специализированного сервиса