AI 플랫폼
AI 모델 호스팅, 배포, 추론 플랫폼
Hugging Face
Hugging Face
모델 호스팅, 추론 API, 협업 도구를 제공하는 세계 최대의 오픈소스 AI 모델·데이터셋 커뮤니티입니다.
Replicate
Replicate
인프라 관리 없이 오픈소스 모델을 실행할 수 있는 AI 모델 실행 클라우드 플랫폼입니다.
Ollama
Ollama
오픈소스 LLM을 로컬에서 실행하는 표준 도구입니다. 명령 한 줄로 Llama·Qwen·DeepSeek 같은 모델을 내 컴퓨터에 내려받아 구동하며, API를 내장합니다.
Together AI
Together AI
오픈소스 모델을 대규모로 학습·파인튜닝·서빙하는 클라우드 플랫폼으로, 수백 개 체크포인트에 대한 고속 추론 API를 제공합니다.
Groq
Groq
자체 LPU 하드웨어 기반의 추론 플랫폼으로, 오픈 모델 응답의 비정상적으로 빠른 속도로 유명합니다.
OpenRouter
OpenRouter
주요 랩의 수백 개 모델로 요청을 라우팅하는 통합 API로, 가격·지연 비교와 자동 폴백을 제공합니다.
DeepInfra
DeepInfra
텍스트·이미지·음성·임베딩의 수백 개 오픈 모델을 표준화된 API로 토큰 단위 제공하는 추론 클라우드.
Fireworks AI
Fireworks
오픈 모델을 위한 고속 추론 클라우드로, 프로덕션급 안정성·파인튜닝·다중 모델 조합 배포를 지원합니다.
Baseten
Baseten
커스텀·오픈 모델을 전용 GPU에 배포하는 추론 플랫폼으로, 오토스케일링·저지연 서빙·모델 프라이버시를 지원합니다.
Modal
Modal Labs
코드로 정의한 인프라로 오토스케일링 GPU에서 추론·파인튜닝·배치를 실행하는 AI/ML용 서버리스 클라우드.
RunPod
RunPod
AI 워크로드를 위한 GPU 클라우드로, 서버리스 추론·온디맨드·스팟 GPU·학습·오픈 모델 호스팅용 Pod 환경을 제공합니다.
Vast.ai
Vast.ai
커뮤니티 GPU를 최저가로 임대하는 마켓플레이스로, 유연한 입찰로 학습·추론·렌더링 워크로드를 지원합니다.
Novita AI
Novita
LLM·이미지·오디오 생성 등 수백 개 오픈 모델을 토큰·이미지 단위 과금으로 제공하는 저가 추론 클라우드.
SiliconFlow
SiliconFlow
중국 발 추론 클라우드로, GLM·Qwen·DeepSeek 등 주요 오픈 모델을 표준화된 저렴한 API로 제공합니다.
Perplexity Sonar API
Perplexity
Perplexity의 검색 기반 추론 API로, 실시간 웹 출처가 있는 LLM 응답을 사실 기반 답변이 필요한 앱에 제공합니다.
Azure OpenAI
Microsoft
Microsoft Azure의 OpenAI 모델 엔터프라이즈 서비스입니다. GPT-4o·o 시리즈·임베딩 모델을 엔터프라이즈 보안·컴플라이언스·리전 가용성과 함께 제공합니다.
Cohere
Cohere
보안에 민감한 조직을 위해 만들어진 엔터프라이즈 LLM 플랫폼. Command 모델 패밀리, 검색용 Embed·Rerank 모델, 자체 클라우드·온프레미스 프라이빗 배포를 제공합니다.
Writer
Writer
풀스택 엔터프라이즈 생성형 AI 플랫폼. Palmyra LLM, 노코드 에이전트 빌더, 지식 그래프 그라운딩, 거버넌스 통제를 갖추고 규제 조직 전반의 AI 확산을 지원합니다.
vLLM
vLLM Project
현대 LLM 서빙의 상당 부분을 떠받치는 오픈소스 추론 엔진. PagedAttention이 최고 수준의 처리량을 내고, OpenAI 호환 API와 폭넓은 모델 지원으로 자체 GPU 위에서 돌아갑니다.
ModelScope
Alibaba (Dammo Academy)
Alibaba의 오픈소스 모델 커뮤니티와 MaaS 플랫폼. 수십만 모델·데이터셋, 무료 온라인 추론 노트북, Qwen 패밀리의 본거지입니다.
Dify
Dify (LangGenius)
오픈소스 LLM 앱 플랫폼. RAG 어시스턴트와 에이전트 워크플로를 비주얼로 만들고, 100여 개 모델을 골라 자체 인프라나 Dify Cloud에서 실행합니다.
Exa
Exa AI
AI를 위해 만든 검색 엔진. 광고 범벅 결과 목록이 아니라 의미적으로 관련 있는 깨끗한 웹 콘텐츠 — 페이지 본문 — 를 돌려주는 API로, 사람이 아닌 모델이 읽도록 설계됐습니다.
Tavily
Tavily
LLM과 RAG를 위해 만든 검색 API. 한 번의 호출로 검색에 최적화된 랭크된 콘텐츠 즉시 사용 가능한 결과를 돌려줍니다 — 수많은 에이전트 프레임워크의 기본 웹 도구입니다.
Serper
Serper Dev
AI를 위해 만든 빠르고 저렴한 Google 검색 결과 API. 기존 SERP API의 몇 분의 일 가격으로 구조화된 SERP 데이터(오가닉·뉴스·이미지·지도)를 제공 — 수많은 리서치 에이전트의 주력입니다.
fal.ai
fal
생성 미디어 클라우드 인프라. 하나의 API로 이미지·영상·오디오 모델을 호스팅·서빙하며, 아초 FLUX 생성과 새 오픈 모델 첫날 호스팅으로 유명합니다.
Runware
Runware
초저가 이미지 생성 인프라. GPU 파이프라인을 엔드투엔드로 소유해 업계 최저가를 주장하는 아초 API — 대량 생성 앱을 위해 만들어졌습니다.
Vapi
Vapi
보이스 에이전트 개발자 플랫폼. 최고 수준 STT·LLM·TTS로 아초 전화 AI를 조립합니다 — 전화번호·착신 전환·통합이 내장되어, 전화 배관을 직접 만들 필요가 없습니다.
Brave Search API
Brave Software
API로 공개된 독립 검색 인덱스. 프라이버시 우선의 Google 대안 결과로, 웹·뉴스·이미지·로컬 엔드포인트를 제공하는 AI 검색 스택의 독립 데이터 선택지입니다.
Open WebUI
Open WebUI
로컬·프라이빗 모델용 셀프호스팅 ChatGPT 스타일 인터페이스. Ollama, OpenAI 호환 API 또는 어떤 백엔드 위에 정제된 채팅 UI를 얹고, RAG·멀티유저 관리·도구 호출을 내장합니다.
LibreChat
LibreChat
오픈소스 멀티프로바이더 채팅 인터페이스. OpenAI·Anthropic·Google·로컬 모델을 하나의 셀프호스팅 UI로 — 에이전트·RAG·artifacts·멀티유저 관리를 갖추고 벤더 락인 없이.
Apple Intelligence
Apple
Apple의 온디바이스·프라이빗 클라우드 AI 계층. 글쓰기 도구, 알림 요약, 이미지 생성, 재설계된 Siri — 개인 데이터가 기기를 떠날 필요가 없도록 설계됐습니다.
Pinecone
Pinecone
이 카테고리를 정의한 관리형 벡터 데이터베이스. 수십억 임베딩의 밀리초 유사도 검색, 서버리스 확장, 수많은 프로덕션 RAG의 검색 중추입니다.