Тэг
LLM
Нейросеть Qwen 3.8 27B: обзор возможностей, проблемы с логикой и оптимизация скорости
Разбираем особенности новой модели Qwen 3.8 27B от Alibaba, ее склонность к избыточным размышлениям по умолчанию и способы ускорения работы на локальном железе.
Читать далееКак подружить локальную LLM с дешевым дисплеем ESP32: интерактивный экран для каждого вопроса
Автор проекта подключил локальную языковую модель к компактному круглому дисплею ESP32 за 30 долларов, научив ее самостоятельно генерировать интерфейс под каждый пользовательский запрос.
Читать далееМодель Qwen 3.8 27B: возможности локального запуска, избыточные рассуждения и методы ускорения
Обзор открытой языковой модели Qwen 3.8 27B с поддержкой работы с изображениями. Оцениваем её производительность на потребительском «железе», проблему избыточных рассуждений по умолчанию и способы оптимизации.
Читать далееАудит предпочтений и дообучение языковых моделей с помощью DPO
Разбор сквозного пайплайна настройки языковых моделей методом Direct Preference Optimization на датасете Anthropic HH-RLHF с учетом анализа длины ответов и лексических искажений.
Читать далееВодяные знаки в ответах Claude: как Anthropic меняет выбор слов нейросетью
Разработчики Anthropic внедряют скрытую маркировку текста в модели Claude. Разбираемся, как это влияет на выбор слов и качество ответов искусственного интеллекта.
Читать далееИсследователи нашли способ извлекать скрытые рассуждения из API проприетарных нейросетей
Специалисты выяснили, как расшифровывать скрытые цепочки рассуждений ведущих языковых моделей через уязвимости в младших версиях семейств.
Читать далееЛокальные нейросети для UI: запускаем кодинг-модели на обычном GPU
Узнайте, как заменить облачные инструменты локальными решениями. Разбираемся, как использовать компактные языковые модели для дизайна на домашнем ПК.
Читать далееOpenAI обновила модели GPT-5.6 Sol и Luna в ChatGPT
Разработчики представили обновленную модель GPT-5.6 Sol для пользователей подписок Pro и Plus, а также расширили возможности бесплатной версии ChatGPT с моделью Luna.
Читать далееАвтоматизация финансовых отчетов: как Model ML использует ИИ GPT-5.6 Sol
Финтех-платформа Model ML внедрила модель GPT-5.6 Sol для создания редактируемых презентаций PowerPoint и таблиц Excel, существенно снизив расход токенов и ускорив подготовку отчетов.
Читать далееNeedle 2: компактная модель для вызова функций на локальных устройствах
Cactus Compute представила модель Needle 2 с 45 миллионами параметров, которая поставляется в виде бинарного файла размером 14 МБ и работает на устройствах без графического процессора.
Читать далее












