Тэг
векторный поиск
Векторный поиск: деплой моделей без GPU на Triton Inference Server
Практическое руководство по развертыванию русскоязычных моделей векторного поиска на CPU с помощью NVIDIA Triton Inference Server без использования GPU.
Читать далееЧто такое Agentic RAG: когда ИИ сам планирует и регулирует поиск информации
Подробный разбор концепции Agentic RAG: как нейросети автономно планируют поиск, проверяют факты и корректируют запросы. Разбираем 5 этапов работы, риски и методы оценки.
Читать далееЛокальный ИИ-ассистент для созвонов: как построить надежную память на графе знаний в Obsidian
Подробный разбор архитектуры локального ИИ-ассистента: как хранить историю встреч в Obsidian без графовых баз данных, бороться с галлюцинациями моделей, настраивать гибридный поиск и соблюдать гигиену памяти.
Читать далее 01.






