Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Baseten теперь доступен в качестве провайдера инференса на Hugging Face

Baseten теперь доступен в качестве провайдера инференса на Hugging Face

Baseten теперь среди провайдеров инференса в Hugging Face Hub

Мы рады сообщить, что платформа Baseten стала полноценным партнером и поддерживаемым провайдером инференса в экосистеме Hugging Face Hub. Это стратегическое пополнение существенно расширяет возможности серверного инференса, позволяя запускать модели прямо со страниц их описания на Hub. Интеграция провайдеров инференса реализована нативно в наших клиентских SDK как для JavaScript, так и для Python, что делает работу с широким спектром моделей максимально простой и удобной для разработчиков.

Baseten представляет собой мощную инфраструктурную платформу для ИИ, специализирующуюся на серверных вычислениях, обучении моделей и других смежных задачах. Благодаря обширному каталогу передовых нейросетей, платформа позволяет разработчикам внедрять сложные ИИ-функции в свои приложения, сводя к минимуму время на настройку и развертывание. Baseten поддерживает разнообразные типы моделей: от больших языковых моделей (LLM) до систем преобразования текста в речь и многих других.

Старт интеграции и доступные возможности

На текущем этапе партнерства Baseten обеспечивает поддержку задач разговорного ИИ и генерации текста. Пользователям Hugging Face открывается прямой доступ к популярным open-weight моделям, включая Kimi K3, новейшую DeepSeek V4 Flash, GLM-5.2 и другие востребованные решения. В ближайшее время планируется расширение списка поддерживаемых задач. Полный перечень моделей, работающих через Baseten, доступен в документации платформы, а следить за новостями можно на официальной странице Baseten в Hugging Face.

Управление доступом и настройка предпочтений

В настройках вашего пользовательского профиля доступен гибкий инструментарий для управления работой с провайдерами:

  • Настройка API-ключей: Вы можете добавить собственные ключи для провайдеров, на которых у вас есть аккаунт. Если пользовательский ключ не задан, все запросы будут автоматически маршрутизироваться через Hugging Face.
  • Приоритизация провайдеров: Система позволяет ранжировать провайдеров по личным предпочтениям, что напрямую влияет на то, какие виджеты и примеры кода будут отображаться на страницах моделей.

При использовании Inference Providers предусмотрено два основных режима работы: использование персонального ключа API (в этом случае запросы идут напрямую к провайдеру, и оплата производится согласно его тарифам) или маршрутизация через Hugging Face (токен провайдера не требуется, а оплата списывается с вашего баланса в Hugging Face).

Техническая реализация и примеры использования

Baseten полностью интегрирован в SDK Hugging Face (версии huggingface_hub от 1.26.1 для Python и @huggingface/inference для JS). Чтобы воспользоваться возможностями модели, например DeepSeek V4 Flash, достаточно аутентифицироваться с помощью токена Hugging Face — маршрутизация запроса произойдет автоматически.

Ниже приведены примеры кода для интеграции:

Python:

import os
from openai import OpenAI

client = OpenAI(
    base_url="https://router.huggingface.co/v1",
    api_key=os.environ["HF_TOKEN"],
)

completion = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-V4-Flash-0731:baseten",
    messages=[{"role": "user", "content": "Напиши функцию на Python, вычисляющую n-е число Фибоначчи через мемоизацию."}]
)
print(completion.choices[0].message)

JavaScript:

import { OpenAI } from "openai";

const client = new OpenAI({
    baseURL: "https://router.huggingface.co/v1",
    apiKey: process.env.HF_TOKEN,
});

const chatCompletion = await client.chat.completions.create({
    model: "deepseek-ai/DeepSeek-V4-Flash-0731:baseten",
    messages: [{ role: "user", content: "Напиши функцию на Python, вычисляющую n-е число Фибоначчи через мемоизацию." }],
});
console.log(chatCompletion.choices[0].message);

Важно отметить, что решение полностью совместимо с популярными инструментами автоматизации, такими как Pi, OpenCode, Hermes Agents и OpenClaw. Это позволяет подключать модели, размещенные на Baseten, напрямую в ваш рабочий процесс без необходимости написания сложного связующего кода.

Оплата и преимущества для PRO-пользователей

При работе с собственным ключом провайдера вы рассчитываетесь напрямую с ним по их тарифам. При использовании маршрутизации через Hugging Face вы оплачиваете лишь стандартную стоимость услуг провайдера без каких-либо дополнительных наценок от нашей стороны. Мы транслируем расходы напрямую, хотя в перспективе возможно внедрение партнерских соглашений о распределении доходов.

Пользователи тарифа PRO ежемесячно получают 2 доллара в виде кредитов на инференс, которые можно использовать у любого из провайдеров. Подписка на Hugging Face PRO также дает доступ к технологиям ZeroGPU, режиму разработчика в Spaces и увеличенным лимитам. Мы также предоставляем бесплатную квоту для всех авторизованных пользователей, но призываем оформить подписку для поддержки платформы. Ждем ваших отзывов и предложений по развитию сервиса в нашем сообществе.

Источник: huggingface.co

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

01.
На платформе MonsterInsights