Тэг
Long Context
RAG или Long Context: когда действительно нужен сложный пайплайн, а когда хватит большого окна LLM
Разбираем, когда действительно нужен RAG с векторной базой и реранкером, а когда проще загрузить всю документацию в контекстное окно LLM с использованием кэширования.
Читать далее 01.





