AIHOT интересен не самим фактом очередного открытого агрегатора. В репозитории опубликована практически вся цепочка обработки: сбор материалов, предварительная фильтрация, оценка через языковую модель, объединение публикаций об одном событии, расчет популярности и автоматическое составление ежедневных, недельных и месячных выпусков.
По описанию проекта на GitHub, система поддерживает RSS, обычные веб-страницы, JSON API, аккаунты X, публикации WeChat и материалы, отправленные внешними скриптами. После первичного отбора потенциально интересная запись дважды независимо оценивается моделью. Порог прохождения зависит от типа источника, причем сами промты и правила отбора находятся в репозитории и могут быть изменены владельцем сайта.

Отдельно устроена работа с повторами. Публикации разных СМИ об одном событии объединяются в кластер. Сначала система ищет похожие записи по векторам заголовков и аннотаций за последние две недели, затем модель определяет, идет ли речь об одном событии, продолжении прежней истории или разных новостях. Для спорных случаев предусмотрена дополнительная проверка другой моделью.



