Hugging Face에 Baseten이 붙었다. 달라지는 건 플러그인이 아니라 실행 경로다
OnePageDaily·8/16/2026·24 views
Hugging Face가 Baseten을 Inference Provider로 추가했습니다. 표면적으로는 Hub의 모델 페이지에 선택지가 하나 늘어난 발표처럼 보입니다. 하지만 개발자가 실제로 만지는 층위는 더 깊습니다. 모델 선택 화면, 호출 SDK, OpenAI 호환 엔드포인트, 그리고 비용이 청구되는 계정이 한 흐름으로 연결됩니다.
이번 통합에서는 사용자가 provider별 우선순위를 정할 수 있습니다. Baseten API 키를 직접 넣으면 Baseten 계정으로 비용이 청구되고, Hugging Face를 통해 라우팅하면 Hugging Face 계정에 비용이 잡힙니다. Hugging Face는 provider 비용에 별도 마크업을 붙이지 않는다고 설명합니다. 같은 모델 호출이라도 키를 어디에 두느냐에 따라 운영 주체가 달라지는 구조입니다.
첫 지원 범위는 대화와 텍스트 생성입니다. DeepSeek-V4-Flash-0731, Kimi K3, GLM-5.2 같은 오픈 웨이트 모델을 Baseten으로 호출할 수 있고, Python에서는 huggingface_hub 1.26.1 이상, JavaScript에서는 @huggingface/inference를 사용합니다. OpenAI 호환 엔드포인트에서는 모델명 뒤에 :baseten을 붙이는 방식도 제시됐습니다.
편해진 만큼 확인할 항목도 선명해졌습니다. 화면에서 provider를 바꾸는 일은 간단하지만, 운영자는 요청이 어느 경로로 라우팅됐는지, 비용이 어느 계정으로 들어갔는지, 지원 태스크가 어디까지인지 추적해야 합니다. PRO 사용자에게 매달 2달러의 Inference 크레딧이 제공된다는 조건도 실행 경로의 일부입니다. 이번 발표를 플러그인 추가로만 보면 이 비용·라우팅 구조를 놓칩니다. 앞으로 모델 접근을 비교할 때는 모델 이름보다 실행 주체와 청구 경로를 먼저 보게 될 겁니다.