Мой блог
Redpine открывает доступ к 20 миллионам научных статей для ИИ-агентов
Современные ИИ-ассистенты способны генерировать убедительные научные обзоры, даже не обращаясь к первоисточникам. Однако шведский проект Redpine открывает доступ к более чем 20 миллионам рецензируемых научных статей, чтобы сделать исследовательские работы доступными, проверяемыми и оплачиваемыми в момент их реального использования агентами.

Шведская компания объявила о заключении партнерских соглашений с крупными издательствами, среди которых BMJ Group, Sage, IOP Publishing, IGI Global Scientific Publishing, Wanfang Data и RCNi. Такой шаг позволяет разработчикам и исследователям интегрировать первичную научную литературу в рабочие процессы искусственного интеллекта с четкими правилами лицензирования.
От внутренней памяти моделей к поиску научных данных
Платформа Redpine предоставляет агентам полноценный текст публикаций и таблиц, не ограничиваясь одними лишь аннотациями. Полученные фрагменты содержат точные идентификаторы вроде DOI и номеров страниц, что позволяет пользователям легко проверить первоисточник. Интеграции сервиса включают протокол Model Context Protocol (MCP) для работы с такими инструментами, как Claude, Cursor и ChatGPT, а также API и SDK для создания сторонних приложений.
Технически этот подход опирается на поиск в момент генерации (retrieval-augmented generation). Нейросеть сначала получает запрос, запрашивает релевантные данные из внешнего хранилища и использует их в качестве контекста. Это кардинально меняет уровень надежности: любые тезисы можно проверить по конкретным фрагментам текста, перекладывая часть рутинной работы по поиску и извлечению доказательств на инфраструктуру системы.
Модель оплаты по факту использования в научных публикациях
Согласно условиям соглашений, издатели самостоятельно устанавливают правила использования контента и ценообразование транзакций, тогда как Redpine распределяет бо́льшую часть выручки среди правообладателей. К примеру, компания Sage запустила пилотный проект, охватывающий более 400 журналов по медицине и наукам о жизни, включая издания Mary Ann Liebert. Кроме того, к платформе подключились партнеры из сферы физических наук, сестринского дела и китайских исследовательских баз данных.
Стоит отметить, что речь идет именно о схеме распределения доходов с издателями, а не о гарантированных прямых роялти для каждого отдельного автора. Базовая стоимость услуг Redpine Science составляет около 1 доллара за 1000 токенов без необходимости оформлять предварительную подписку. Итоговые затраты будут зависеть от того, насколько глубоко агенту потребуется погружаться в материалы и как эффективно система выбирает нужные фрагменты.
Как устроен рабочий процесс поиска информации
Документация сервиса описывает механизмы, которые делают отбор контента более осознанным. Функция предварительного просмотра позволяет приложению оценить тизеры результатов и расчетную стоимость до того, как будет произведена оплата за разблокировку полных версий текстов. В свою очередь, ассистированный поиск разбивает сложный запрос на несколько аспектов, выполняет параллельные внутренние проверки и отсеивает лишнее.
Тем не менее релевантность запроса и научная достоверность остаются разными вещами. Точное совпадение фрагмента по ключевым словам не гарантирует отсутствие методологических изъянов или предварительного характера выводов, поэтому качественный поиск лишь поддерживает критическое чтение, но не заменяет его.
Результаты внутренней оценки компании
В ходе проведенного Redpine тестирования сравнивалась работа поискового агента с подключенной базой данных и без нее на выборке из 179 экспертно проверенных биомедицинских вопросов. Согласно метрикам оценки, основанным на охвате фактов и отсутствии противоречий, показатель корректности ответов вырос с 75,9 до 84.7 баллов.
Хотя такие цифры выглядят внушительно, они получены в рамках контролируемого бенчмарка самой компании, а не независимых клинических испытаний. Тем не менее они демонстрируют потенциал перехода к более подотчетным системам генерации научных текстов.
