Тэг
промпт инжиниринг
RAG или Long Context: когда действительно нужен сложный пайплайн, а когда хватит большого окна LLM
Разбираем, когда действительно нужен RAG с векторной базой и реранкером, а когда проще загрузить всю документацию в контекстное окно LLM с использованием кэширования.
Читать далееИнтерактивный промпт-инжиниринг от Snickers: как рекламная акция Hungr.AI учит заставлять ChatGPT думать лучше
Разбираем рекламный спецпроект Snickers Hungr.AI: как забавная идея «покормить» голодный ChatGPT превратилась в эффективный прием промпт-инжиниринга с критическим анализом ответов.
Читать далееLLM зацикливается в продакшене: как локализовать петлю повтора без слепой смены параметров
Полный разбор причин зацикливания LLM в продакшене: почему слепое увеличение repetition_penalty вредит системе, как работать с vLLM, анализировать logprobs и оптимизировать промпты.
Читать далее 01.







