AI 모델
필요한 AI 모델을
사양부터 조건까지 비교하세요
202개 모델의 구조, 문맥, 제작 국가, 라이선스, 한국어 활용과 MonoGPT 지원 여부를 같은 기준으로 정리했습니다.
모델 선택 가이드
한눈에 고르는 AI 모델
대표 모델의 강점과 입력 형식, 추론·코딩 특화, 오픈웨이트와 MonoGPT 지원 여부를 한 장에서 빠르게 좁혀보세요. 순위표가 아니라 용도별 출발점입니다.
| 모델 | 추천 용도 | 추론 특화 | 코딩 특화 | 이미지 입력 | 영상 입력 | 음성 입력 | 오픈웨이트 | MonoGPT 지원 |
|---|---|---|---|---|---|---|---|---|
| OpenAIGPT-5.6 Sol | 고난도 추론·장문 에이전트 | O | O | O | X | X | X | O |
| AnthropicClaude Sonnet 5 | 성능·속도 균형 실무 | O | O | O | X | X | X | O |
| GoogleGemini 3.6 Flash | 빠른 멀티모달·영상/음성 입력 | O | O | O | O | O | X | O |
| OpenAIGPT-5.3 Codex | 장시간 에이전트 코딩 | O | O | O | X | X | X | O |
| xAIGrok 4.5 | 고급 추론·장문 에이전트 | O | O | O | X | X | X | O |
| Mistral AIMistral Small 4 | 효율형 추론·코딩·멀티모달 | O | O | O | X | X | O | X |
| DeepSeek AIDeepSeek V4 Flash | 오픈웨이트 추론·코딩 | O | O | X | X | X | O | X |
| Qwen Team · Alibaba CloudQwen3.6 35B-A3B | 긴 문맥 오픈웨이트 멀티모달 | O | O | O | O | X | O | X |
| GoogleGemma 4 12B Unified | 경량 통합 멀티모달 | O | O | O | O | O | O | X |
| LG AI ResearchEXAONE 4.0 32B | 한국어·영어 자체 운영 | O | 자료 없음 | X | X | X | O | X |
GPT-6 AstraGPT-6 아스트라
최고난도 추론·코딩·리서치·문서 생성에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.6 SolGPT-5.6 솔
장문·에이전트·고난도 추론에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
Claude Fable 5클로드 페이블 5
최상위 범용 추론과 장시간 에이전트에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Gemini 3.6 Flash제미나이 3.6 플래시
고속 멀티모달과 에이전트에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Grok 4.5그록 4.5
고급 추론과 장문 에이전트에 맞춰 제공되는 xAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.5
범용 추론과 업무 자동화에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
Claude Sonnet 5클로드 소넷 5
성능과 속도의 균형에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Gemini 3.5 Flash제미나이 3.5 플래시
빠른 범용 멀티모달 처리에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
GPT-5.4
복합 문서와 도구 사용에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
Claude Opus 5클로드 오푸스 5
고난도 코딩·분석·에이전트에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Gemini 3.1 Pro Preview제미나이 3.1 프로 프리뷰
고난도 추론과 코딩에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델 · Preview
GPT Image 2GPT 이미지 2
텍스트 표현과 정밀 이미지 편집에 맞춰 제공되는 OpenAI의 이미지 생성·편집 생성 미디어 API·서비스 모델
GPT-Realtime-2.1GPT 리얼타임 2.1
추론과 도구 사용을 포함한 실시간 음성 에이전트에 맞춰 제공되는 OpenAI의 텍스트·이미지 입력·양방향 음성 상용 API 모델
GPT-5.6 TerraGPT-5.6 테라
균형형 범용 작업과 에이전트에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.6 LunaGPT-5.6 루나
빠른 응답과 대량 처리에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.4 ProGPT-5.4 프로
최상위 정확도와 장시간 추론에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.4 MiniGPT-5.4 미니
비용 효율형 실시간 업무에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.4 NanoGPT-5.4 나노
분류·추출·대량 처리에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.3 CodexGPT-5.3 코덱스
장시간 에이전트 코딩에 맞춰 제공되는 OpenAI의 코드·텍스트·도구 상용 API 모델
GPT-5.2
전문 지식 작업과 추론에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.2 ProGPT-5.2 프로
고정밀 전문 분석에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5.1
조절 가능한 추론과 코딩에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5
범용 추론과 코딩에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5 ProGPT-5 프로
더 많은 연산을 쓰는 정밀 추론에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-5 MiniGPT-5 미니
비용 효율형 범용 API에 맞춰 제공되는 OpenAI의 텍스트·이미지·도구 상용 API 모델
GPT-4.1
긴 문맥과 비추론 응답에 맞춰 제공되는 OpenAI의 텍스트·이미지 상용 API 모델
GPT-4.1 MiniGPT-4.1 미니
빠른 장문 처리와 코딩에 맞춰 제공되는 OpenAI의 텍스트·이미지 상용 API 모델
GPT-4o
실시간 멀티모달 상호작용에 맞춰 제공되는 OpenAI의 텍스트·이미지·음성 상용 API 모델
text-embedding-3-large텍스트 임베딩 3 라지
다국어 검색·군집화·추천용 벡터 생성에 맞춰 제공되는 OpenAI의 텍스트 임베딩 상용 API 모델
Claude Opus 4.8클로드 오푸스 4.8
복합 추론과 장기 작업에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Claude Opus 4.6클로드 오푸스 4.6
에이전트 코딩과 전문 분석에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Claude Sonnet 4.6클로드 소넷 4.6
실무 코딩과 문서 업무에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Claude Sonnet 4.5클로드 소넷 4.5
코딩과 컴퓨터 사용에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Claude Haiku 4.5클로드 하이쿠 4.5
빠르고 경제적인 실시간 응답에 맞춰 제공되는 Anthropic의 텍스트·이미지·도구 상용 API 모델
Gemini 3.5 Flash-Lite제미나이 3.5 플래시 라이트
대량·저비용 멀티모달 처리에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Gemini 3.1 Flash-Lite제미나이 3.1 플래시 라이트
저지연 대규모 처리에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Gemini 3 Flash Preview제미나이 3 플래시 프리뷰
빠른 추론과 도구 사용에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델 · Preview
Gemini 2.5 Pro제미나이 2.5 프로
장문 추론과 코딩에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Gemini 2.5 Flash제미나이 2.5 플래시
속도·비용·추론 균형에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Gemini 2.5 Flash-Lite제미나이 2.5 플래시 라이트
고처리량 경량 응답에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성 상용 API 모델
Gemini Embedding 2제미나이 임베딩 2
여러 입력 형식을 함께 검색하는 멀티모달 임베딩에 맞춰 제공되는 Google의 텍스트·이미지·영상·음성·PDF 임베딩 상용 API 모델
Gemini 3.5 Live Translate Preview제미나이 3.5 라이브 번역 프리뷰
저지연 양방향 실시간 음성 번역에 맞춰 제공되는 Google의 음성 입력·번역 음성·자막 출력 상용 API 모델 · Preview
Gemini Live Native Audio제미나이 라이브 네이티브 오디오
저지연 양방향 음성 대화에 맞춰 제공되는 Google의 실시간 음성·영상 상용 API 모델
Gemini 3 Pro Image제미나이 3 프로 이미지
정밀 이미지 합성과 텍스트 표현에 맞춰 제공되는 Google의 이미지 생성·편집 생성 미디어 API·서비스 모델
Gemini 3.1 Flash Image제미나이 3.1 플래시 이미지
빠른 이미지 생성과 반복 편집에 맞춰 제공되는 Google의 이미지 생성·편집 생성 미디어 API·서비스 모델
Veo 3.1비오 3.1
고품질 영상과 네이티브 오디오에 맞춰 제공되는 Google의 영상·오디오 생성 생성 미디어 API·서비스 모델
Veo 3.1 Fast비오 3.1 패스트
빠른 영상 시안과 반복에 맞춰 제공되는 Google의 영상·오디오 생성 생성 미디어 API·서비스 모델
Lyria 3.5리리아 3.5
가사·연주곡 기반 풀송 음악 제작에 맞춰 제공되는 Google의 음악 생성 생성 미디어 API·서비스 모델 · Preview
Lyria 3 Pro리리아 3 프로
상업용 고품질 음악 제작에 맞춰 제공되는 Google의 음악 생성 생성 미디어 API·서비스 모델
Grok 4.3그록 4.3
균형형 추론과 도구 사용에 맞춰 제공되는 xAI의 텍스트·이미지·도구 상용 API 모델
Grok 4.20 Reasoning그록 4.20 리즈닝
긴 문맥의 심층 추론에 맞춰 제공되는 xAI의 텍스트·이미지·도구 상용 API 모델
Grok 4.20 Multi-Agent그록 4.20 멀티 에이전트
병렬 에이전트 조사와 종합에 맞춰 제공되는 xAI의 텍스트·이미지·도구 상용 API 모델
Grok 3그록 3
범용 대화와 추론에 맞춰 제공되는 xAI의 텍스트·이미지 상용 API 모델
Grok Build 0.1그록 빌드 0.1
에이전트형 소프트웨어 개발과 엔지니어링 워크플로에 맞춰 제공되는 xAI의 텍스트·이미지 입력·텍스트 출력·도구 상용 API 모델 · Early Access
Grok Imagine Image Quality그록 이매진 이미지 퀄리티
고품질 이미지 생성에 맞춰 제공되는 xAI의 이미지 생성·편집 생성 미디어 API·서비스 모델
Grok Imagine Video 1.5그록 이매진 비디오 1.5
빠른 영상 생성과 장면 움직임에 맞춰 제공되는 xAI의 영상 생성 생성 미디어 API·서비스 모델
Amazon Nova Premier아마존 노바 프리미어
복합 업무와 모델 증류에 맞춰 제공되는 Amazon Web Services의 텍스트·이미지·영상 상용 API 모델
Amazon Nova Pro아마존 노바 프로
범용 멀티모달과 에이전트에 맞춰 제공되는 Amazon Web Services의 텍스트·이미지·영상 상용 API 모델
Amazon Nova Lite아마존 노바 라이트
비용 효율형 멀티모달 처리에 맞춰 제공되는 Amazon Web Services의 텍스트·이미지·영상 상용 API 모델
Amazon Nova Micro아마존 노바 마이크로
저지연 텍스트 생성에 맞춰 제공되는 Amazon Web Services의 텍스트 상용 API 모델
Amazon Nova 2 Lite아마존 노바 2 라이트
저비용 멀티모달 추론에 맞춰 제공되는 Amazon Web Services의 텍스트·이미지·영상 상용 API 모델
Qwen3-0.6B큐원3-0.6B
0.8B 규모와 40K · 128K 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트 오픈웨이트 모델
Qwen3-8B큐원3-8B
8.2B 규모와 40K · 128K 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트 오픈웨이트 모델
Llama 3.2 1B Instruct라마 3.2 1B Instruct
1.2B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
DeepSeek-R1딥시크-R1
강화학습 기반 추론과 공개된 사고형 응답으로 주목받은 전체 6710억 규모의 대형 MoE 모델
gpt-oss-20b
약 210억 전체 가중치와 낮은 활성 파라미터로 로컬·엣지 추론을 겨냥한 OpenAI 오픈웨이트 모델
Qwen3-32B큐원3-32B
생각 모드와 빠른 응답 모드를 전환할 수 있는 328억 파라미터 오픈웨이트 언어 모델
Qwen3-1.7B큐원3-1.7B
2.0B 규모와 40K · 128K 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트 오픈웨이트 모델
Llama 3.1 8B Instruct라마 3.1 8B Instruct
8.0B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
Qwen3.6 35B-A3B큐원3.6 35B-A3B
35B 규모와 262K 기본 · 약 1.01M 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·이미지·영상 오픈웨이트 모델
Gemma 3 1B IT젬마 3 1B IT
1.0B 규모와 32K 문맥을 제공하는 Google의 텍스트 오픈웨이트 모델
Qwen3-VL-8B Instruct큐원3-VL-8B Instruct
8.8B 규모와 256K 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·이미지·영상 오픈웨이트 모델
Qwen3-4B큐원3-4B
4.0B 규모와 40K · 128K 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트 오픈웨이트 모델
Granite 4.1 8B그래니트 4.1 8B
8B 규모와 128K 문맥을 제공하는 IBM의 다국어 텍스트·코드·도구 오픈웨이트 모델
gpt-oss-120b
Apache 2.0으로 공개되어 자체 호스팅과 추론 강도 조절을 지원하는 OpenAI의 1170억 MoE 모델
Gemma 4 12B Unified젬마 4 12B Unified
11.95B 규모와 256K 문맥을 제공하는 Google의 텍스트·이미지·음성·영상 오픈웨이트 모델
Qwen3-VL-32B Instruct큐원3-VL-32B Instruct
33.4B 규모와 256K 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·이미지·영상 오픈웨이트 모델
Qwen3-30B-A3B큐원3-30B-A3B
전체 305억 중 약 33억 파라미터를 활성화하는 경량 MoE 구조의 Qwen3 추론 언어 모델
GLM-5.2
753B 규모와 1M 문맥을 제공하는 Z.ai의 텍스트·코드·추론 오픈웨이트 모델
Qwen3-14B큐원3-14B
14.8B 규모와 40K · 128K 확장 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트 오픈웨이트 모델
DeepSeek V4 Flash딥시크 V4 Flash
284B 규모와 1M 문맥을 제공하는 DeepSeek AI의 텍스트·코드·추론 오픈웨이트 모델
Qwen3-VL-235B-A22B Instruct큐원3-VL-235B-A22B Instruct
235.7B 규모와 256K 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·이미지·영상 오픈웨이트 모델
Kimi K3키미 K3
2.8T 규모와 1,048,576 문맥을 제공하는 Moonshot AI의 텍스트·이미지·영상 오픈웨이트 모델
Gemma 3 4B IT젬마 3 4B IT
4.3B 규모와 128K 문맥을 제공하는 Google의 텍스트·이미지 오픈웨이트 모델
Qwen3-Coder-30B-A3B Instruct큐원3-Coder-30B-A3B Instruct
30.5B 규모와 256K 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·코드 오픈웨이트 모델
Llama 3.2 3B Instruct라마 3.2 3B Instruct
3.2B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
Gemma 3 12B IT젬마 3 12B IT
12.2B 규모와 128K 문맥을 제공하는 Google의 텍스트·이미지 오픈웨이트 모델
Phi-3.5 Vision Instruct파이-3.5 Vision Instruct
4.1B 규모와 128K 문맥을 제공하는 Microsoft의 텍스트·이미지 오픈웨이트 모델
Qwen2.5-Coder-32B Instruct큐원2.5-Coder-32B Instruct
32.8B 규모와 32K 문맥을 제공하는 Qwen Team · Alibaba Cloud의 텍스트·코드 오픈웨이트 모델
DeepSeek-V3-0324딥시크-V3-0324
일반 대화·코딩·에이전트 작업을 위한 전체 6710억·활성 370억 규모의 DeepSeek MoE 모델
Phi-3.5 Mini Instruct파이-3.5 Mini Instruct
3.8B 규모와 128K 문맥을 제공하는 Microsoft의 텍스트 오픈웨이트 모델
Amazon Nova 2 Sonic아마존 노바 2 소닉
양방향 음성 에이전트에 맞춰 제공되는 Amazon Web Services의 실시간 음성 상용 API 모델
Amazon Nova Multimodal Embeddings아마존 노바 멀티모달 임베딩
통합 벡터 공간 기반 멀티모달 RAG와 검색에 맞춰 제공되는 Amazon Web Services의 텍스트·문서·이미지·영상·음성 임베딩 상용 API 모델
Amazon Nova Canvas아마존 노바 캔버스
기업용 이미지 생성과 편집에 맞춰 제공되는 Amazon Web Services의 이미지 생성·편집 생성 미디어 API·서비스 모델
Amazon Nova Reel아마존 노바 릴
기업용 영상 생성에 맞춰 제공되는 Amazon Web Services의 영상 생성 생성 미디어 API·서비스 모델
Mistral Medium 3.5미스트랄 미디엄 3.5
에이전트·코딩 중심의 프런티어급 멀티모달 업무에 맞춰 제공되는 Mistral AI의 텍스트·이미지·도구 상용 API 모델
Mistral Small 4미스트랄 스몰 4
지시·추론·코딩을 결합한 효율형 멀티모달 작업에 맞춰 제공되는 Mistral AI의 텍스트·이미지·도구 오픈웨이트·API 모델
Mistral Large 3미스트랄 라지 3
대규모 범용 멀티모달 추론에 맞춰 제공되는 Mistral AI의 텍스트·이미지·도구 상용 API 모델
Mistral OCR 4미스트랄 OCR 4
문단 경계·표·수식·레이아웃 문서 인식에 맞춰 제공되는 Mistral AI의 문서·이미지 입력·구조화 텍스트 출력 상용 API 모델
Voxtral Mini Transcribe 2복스트랄 미니 트랜스크라이브 2
다국어 음성 전사와 화자 분리에 맞춰 제공되는 Mistral AI의 음성 입력·텍스트 출력 상용 API 모델
Voxtral TTS복스트랄 TTS
다국어 실시간 음성 합성과 제로샷 보이스 클로닝에 맞춰 제공되는 Mistral AI의 텍스트 입력·음성 출력 상용 API 모델
Command A+커맨드 A 플러스
다국어 기업 에이전트·추론·번역·비전에 맞춰 제공되는 Cohere의 텍스트·이미지 입력·텍스트·도구 출력 상용 API 모델
Command A Translate커맨드 A 트랜슬레이트
한국어를 포함한 전용 기계 번역에 맞춰 제공되는 Cohere의 23개 언어 텍스트 입력·번역 텍스트 출력 상용 API 모델
Command R 08-2024커맨드 R 08-2024
비용 효율형 RAG에 맞춰 제공되는 Cohere의 텍스트·도구 상용 API 모델
Cohere Embed v4코히어 임베드 v4
다국어·멀티모달 검색에 맞춰 제공되는 Cohere의 텍스트·이미지 임베딩 상용 API 모델
Cohere Rerank 4.0 Pro코히어 리랭크 4.0 프로
복잡한 다국어 검색 결과의 고품질 재정렬에 맞춰 제공되는 Cohere의 질의·텍스트·JSON 입력·순위 출력 상용 API 모델
Cohere Rerank 4.0 Fast코히어 리랭크 4.0 패스트
저지연·고처리량 다국어 검색 재정렬에 맞춰 제공되는 Cohere의 질의·텍스트·JSON 입력·순위 출력 상용 API 모델
Cohere Transcribe코히어 트랜스크라이브
한국어를 포함한 14개 언어 자동 음성 인식에 맞춰 제공되는 Cohere의 음성 입력·텍스트 출력 상용 API 모델
Sonar소나
빠른 웹 근거 답변에 맞춰 제공되는 Perplexity의 텍스트·웹 검색 상용 API 모델
Sonar Pro소나 프로
다단계 검색과 풍부한 출처에 맞춰 제공되는 Perplexity의 텍스트·웹 검색 상용 API 모델
Sonar Reasoning Pro소나 리즈닝 프로
추론과 실시간 검색 결합에 맞춰 제공되는 Perplexity의 텍스트·웹 검색 상용 API 모델
Sonar Deep Research소나 딥 리서치
장시간 조사와 보고서 종합에 맞춰 제공되는 Perplexity의 텍스트·웹 검색 상용 API 모델
pplx-embed-context-v1-4b퍼플렉시티 콘텍스트 임베드 4B
검색 문맥을 보존하는 장문 임베딩에 맞춰 제공되는 Perplexity의 텍스트 임베딩 상용 API 모델
Jamba Large 1.7잠바 라지 1.7
긴 문맥과 구조화 출력·기업 에이전트에 맞춰 제공되는 AI21 Labs의 텍스트·도구 상용 API 모델
Jamba Mini 2잠바 미니 2
경제적인 장문 처리와 기업 업무에 맞춰 제공되는 AI21 Labs의 텍스트·도구 상용 API 모델
Solar Pro 4솔라 프로 4
한국어·영어 장문 업무와 에이전트에 맞춰 제공되는 Upstage의 텍스트·도구 상용 API 모델
Solar Embedding 2솔라 임베딩 2
한국어·영어 검색과 RAG용 벡터 생성에 맞춰 제공되는 Upstage의 텍스트 임베딩 상용 API 모델
Upstage Document Parse업스테이지 도큐먼트 파스
표·레이아웃을 포함한 문서 디지털화에 맞춰 제공되는 Upstage의 문서·이미지 입력·구조화 텍스트 출력 상용 API 모델
SmolLM3 3B스몰LM3 3B
3.1B 규모와 64K 학습 · 128K YaRN 문맥을 제공하는 HuggingFace의 다국어 텍스트 오픈웨이트 모델
DeepSeek-R1-Distill-Qwen-14B딥시크-R1-Distill-Qwen-14B
14.8B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
Gemma 3 27B IT젬마 3 27B IT
270억 규모에서 이미지 입력과 128K 문맥, 다국어를 지원하는 Google의 오픈 모델 계열
Llama 3.1 70B Instruct라마 3.1 70B Instruct
70.6B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
DeepSeek-R1-Distill-Qwen-32B딥시크-R1-Distill-Qwen-32B
32.8B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
Phi-4파이-4
합성 데이터와 고품질 데이터 조합으로 수학·추론 성능을 강조한 Microsoft의 147억 언어 모델
DeepSeek-R1-Distill-Qwen-1.5B딥시크-R1-Distill-Qwen-1.5B
1.8B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
Phi-4 Multimodal Instruct파이-4 Multimodal Instruct
5.6B 규모와 128K 문맥을 제공하는 Microsoft의 텍스트·이미지·음성 오픈웨이트 모델
Qwen3-235B-A22B큐원3-235B-A22B
전체 2350억·활성 220억 파라미터로 고난도 추론과 에이전트 작업을 겨냥한 대형 Qwen3 MoE 모델
Qwen2.5-VL-72B-Instruct큐원2.5-VL-72B-Instruct
이미지·문서·영상 이해와 시각적 위치 인식을 지원하는 720억 규모의 Qwen 멀티모달 모델
EXAONE 3.5 7.8B Instruct엑사원 3.5 7.8B Instruct
7.8B 규모와 32K 문맥을 제공하는 LG AI Research의 한국어·영어 텍스트 오픈웨이트 모델
NVIDIA Nemotron 3 Ultra 550B-A55B
550B 규모와 최대 1M 문맥을 제공하는 NVIDIA의 다국어 텍스트·추론 오픈웨이트 모델
Llama 4 Scout라마 4 Scout
17B 활성 파라미터와 매우 긴 문맥·이미지 이해를 결합한 Meta의 경량 Llama 4 MoE 모델
Phi-4 Mini Instruct파이-4 Mini Instruct
38억 파라미터와 128K 문맥, 함수 호출을 제공하는 경량 Microsoft 지시형 언어 모델
Gemma 3n E2B IT젬마 3n E2B IT
E2B · 5.4B 저장 규모와 32K 문맥을 제공하는 Google의 텍스트·이미지·음성 오픈웨이트 모델
Kimi-VL-A3B Instruct키미-VL-A3B Instruct
16.4B 규모와 128K 문맥을 제공하는 Moonshot AI의 텍스트·이미지 오픈웨이트 모델
GLM-4.1V-9B Thinking
10.3B 규모와 64K 문맥을 제공하는 Z.ai의 텍스트·이미지·영상 오픈웨이트 모델
Llama 3.3 70B Instruct라마 3.3 70B Instruct
70.6B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
GLM-4.5-Air
전체 1060억·활성 120억으로 GLM-4.5의 추론·코딩 능력을 더 낮은 비용에 제공하는 MoE 모델
DeepSeek-R1-Distill-Llama-70B딥시크-R1-Distill-Llama-70B
70.6B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
DeepSeek-R1-Distill-Llama-8B딥시크-R1-Distill-Llama-8B
8.0B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
Nemotron Nano 9B v2네모트론 Nano 9B v2
Transformer와 Mamba 계열을 결합해 추론 효율과 긴 문맥을 노린 NVIDIA의 89억 하이브리드 모델
DeepSeek-R1-Distill-Qwen-7B딥시크-R1-Distill-Qwen-7B
7.6B 규모와 128K 문맥을 제공하는 DeepSeek AI의 텍스트·추론 오픈웨이트 모델
SmolLM2 1.7B Instruct스몰LM2 1.7B Instruct
1.7B 규모와 8K 문맥을 제공하는 HuggingFace의 텍스트 오픈웨이트 모델
Kimi K2 Instruct키미 K2 Instruct
전체 1조·활성 320억 파라미터와 도구 사용·코딩 능력을 강조한 Moonshot AI의 대형 MoE 모델
Llama 3.1 Nemotron Nano 8B v1라마 3.1 Nemotron Nano 8B v1
8.0B 규모와 128K 문맥을 제공하는 NVIDIA의 텍스트·추론 오픈웨이트 모델
GLM-4.5V
107.7B 규모와 64K 문맥을 제공하는 Z.ai의 텍스트·이미지·영상 오픈웨이트 모델
Phi-3.5 MoE Instruct파이-3.5 MoE Instruct
41.9B 규모와 128K 문맥을 제공하는 Microsoft의 텍스트 오픈웨이트 모델
GLM-4.5
전체 3550억·활성 320억 규모에서 추론·코딩·에이전트 성능을 결합한 오픈웨이트 MoE 모델
Midjourney V7미드저니 V7
고품질 스타일 이미지와 개인화에 맞춰 제공되는 Midjourney의 이미지 생성 생성 미디어 API·서비스 모델
Niji 7니지 7
애니메이션·일러스트 표현에 맞춰 제공되는 Midjourney의 이미지 생성 생성 미디어 API·서비스 모델
Runway Gen-4.5런웨이 Gen-4.5
고품질 장면 구성과 움직임에 맞춰 제공되는 Runway의 영상 생성 생성 미디어 API·서비스 모델
Runway Gen-4 Turbo런웨이 Gen-4 터보
빠른 이미지 기반 영상 제작에 맞춰 제공되는 Runway의 영상 생성 생성 미디어 API·서비스 모델
Kling 3.0클링 3.0
피사체 일관성과 멀티샷 영상에 맞춰 제공되는 Kuaishou · Kling AI의 영상·오디오 생성 생성 미디어 API·서비스 모델
Kling 3.0 Omni클링 3.0 옴니
멀티샷과 네이티브 오디오에 맞춰 제공되는 Kuaishou · Kling AI의 영상·오디오 생성 생성 미디어 API·서비스 모델
Seedance 2.0시댄스 2.0
멀티모달 장면 생성과 편집에 맞춰 제공되는 ByteDance · BytePlus의 영상·오디오 생성·편집 생성 미디어 API·서비스 모델
Seedream 5.0시드림 5.0
고해상도 이미지와 일관된 편집에 맞춰 제공되는 ByteDance · BytePlus의 이미지 생성·편집 생성 미디어 API·서비스 모델
FLUX.1 Kontext Max플럭스.1 콘텍스트 맥스
문맥 기반 정밀 이미지 편집에 맞춰 제공되는 Black Forest Labs의 이미지 생성·편집 생성 미디어 API·서비스 모델
Stable Image Ultra스테이블 이미지 울트라
상업용 고해상도 이미지에 맞춰 제공되는 Stability AI의 이미지 생성·편집 생성 미디어 API·서비스 모델
Eleven v3일레븐 v3
감정 표현과 다화자 음성에 맞춰 제공되는 ElevenLabs의 음성 합성 생성 미디어 API·서비스 모델
Suno v5수노 v5
완성형 노래와 음악 편집에 맞춰 제공되는 Suno의 음악 생성 생성 미디어 API·서비스 모델
Qwen3-Coder-480B-A35B큐원3-Coder-480B-A35B
전체 4800억·활성 350억 파라미터와 긴 문맥으로 저장소 규모 코딩·에이전트 작업을 겨냥한 모델
InternLM3 8B Instruct인턴LM3 8B Instruct
도구 사용과 긴 문맥·추론을 소형 규모에서 제공하는 Shanghai AI Laboratory의 88억 모델
Phi-4 Mini Reasoning파이-4 Mini Reasoning
3.8B 규모와 128K 문맥을 제공하는 Microsoft의 텍스트·추론 오픈웨이트 모델
Ministral 3 8B Instruct미니스트랄 3 8B Instruct
8.9B 규모와 256K 문맥을 제공하는 Mistral AI의 텍스트·이미지 오픈웨이트 모델
Granite 4.0 H Small그래니트 4.0 H Small
32.2B 규모와 128K 문맥을 제공하는 IBM의 텍스트·도구 오픈웨이트 모델
OLMo 2 7B Instruct올모 2 7B Instruct
7.3B 규모와 4K 문맥을 제공하는 Allen Institute for AI의 텍스트 오픈웨이트 모델
Granite 3.3 8B Instruct그래니트 3.3 8B Instruct
기업용 RAG·함수 호출과 긴 문맥을 겨냥해 Apache 2.0으로 공개된 IBM의 81억 모델
Kimi K2 Thinking키미 K2 Thinking
1.06T 규모와 256K 문맥을 제공하는 Moonshot AI의 텍스트·코드·추론 오픈웨이트 모델
SOLAR-10.7B-Instruct솔라-10.7B-Instruct
한국 Upstage가 depth up-scaling 기법으로 공개한 107억 규모의 영어 중심 지시형 언어 모델
Gemma 3n E4B IT젬마 3n E4B IT
E4B · 7.8B 저장 규모와 32K 문맥을 제공하는 Google의 텍스트·이미지·음성 오픈웨이트 모델
Moonlight 16B-A3B Instruct문라이트 16B-A3B Instruct
16.0B 규모와 8K 문맥을 제공하는 Moonshot AI의 텍스트 오픈웨이트 모델
Llama 4 Maverick라마 4 Maverick
128개 전문가와 17B 활성 파라미터를 사용해 고품질 멀티모달 응답을 목표로 한 Llama 4 모델
Falcon3 7B Instruct팰컨3 7B Instruct
7.5B 규모와 32K 문맥을 제공하는 Technology Innovation Institute의 텍스트 오픈웨이트 모델
Jamba2 3B잠바2 3B
3B 규모와 256K 문맥을 제공하는 AI21 Labs의 텍스트 오픈웨이트 모델
Solar Open 2 250B-A15B
250B 규모와 1M 문맥을 제공하는 Upstage의 한국어·영어·일본어 텍스트·도구 오픈웨이트 모델
Phi-4 Reasoning파이-4 Reasoning
14.7B 규모와 32K 문맥을 제공하는 Microsoft의 텍스트·추론 오픈웨이트 모델
EXAONE 4.0 32B엑사원 4.0 32B
한국어·영어와 추론·비추론 모드를 결합한 LG AI Research의 320억 오픈웨이트 모델
Llama 3.1 405B Instruct라마 3.1 405B Instruct
405.9B 규모와 128K 문맥을 제공하는 Meta의 텍스트 오픈웨이트 모델
Falcon-H1-7B Instruct팰컨-H1-7B Instruct
7.6B 규모와 256K 문맥을 제공하는 Technology Innovation Institute의 텍스트 오픈웨이트 모델
Command R7B 12-2024커맨드 R7B 12-2024
8.0B 규모와 128K 문맥을 제공하는 Cohere For AI의 텍스트·RAG·도구 오픈웨이트 모델
Yi-1.5-34B-Chat이-1.5-34B-Chat
영어·중국어 대화와 코딩·수학 성능을 개선해 Apache 2.0으로 공개한 01.AI의 340억 모델
OLMo 2 13B Instruct올모 2 13B Instruct
13.7B 규모와 4K 문맥을 제공하는 Allen Institute for AI의 텍스트 오픈웨이트 모델
Aya Expanse 8B아야 Expanse 8B
8.0B 규모와 8K 문맥을 제공하는 Cohere For AI의 다국어 텍스트 오픈웨이트 모델
Aya Expanse 32B아야 Expanse 32B
23개 언어의 다국어 대화와 생성 품질을 목표로 공개된 Cohere For AI의 320억 언어 모델
GLM-4-32B-0414
32.6B 규모와 32K 문맥을 제공하는 Z.ai의 텍스트·코드 오픈웨이트 모델
Falcon3 10B Instruct팰컨3 10B Instruct
10.3B 규모와 32K 문맥을 제공하는 Technology Innovation Institute의 텍스트 오픈웨이트 모델
GLM-Z1-32B-0414
32.6B 규모와 32K 문맥을 제공하는 Z.ai의 텍스트·추론 오픈웨이트 모델
DeepSeek-Coder-V2-Instruct딥시크-Coder-V2-Instruct
전체 2360억·활성 210억 MoE 구조와 긴 코드 문맥을 제공하는 DeepSeek의 코딩 특화 모델
Kanana 1.5 2.1B Instruct카나나 1.5 2.1B Instruct
2.3B 규모와 32K 문맥을 제공하는 Kakao의 한국어·영어 텍스트 오픈웨이트 모델
Granite 3.2 2B Instruct그래니트 3.2 2B Instruct
2.5B 규모와 128K 문맥을 제공하는 IBM의 텍스트·도구 오픈웨이트 모델
Phi-4 Reasoning Vision 15B파이-4 Reasoning Vision 15B
15B 규모와 16K 문맥을 제공하는 Microsoft의 텍스트·이미지·추론 오픈웨이트 모델
Kanana 1.5 8B Instruct카나나 1.5 8B Instruct
한국어와 영어 대화·지시 수행을 위해 Kakao가 Apache 2.0으로 공개한 80억 언어 모델
OLMo 2 32B Instruct올모 2 32B Instruct
32.2B 규모와 4K 문맥을 제공하는 Allen Institute for AI의 텍스트 오픈웨이트 모델
Granite 3.2 8B Instruct그래니트 3.2 8B Instruct
8.2B 규모와 128K 문맥을 제공하는 IBM의 텍스트·도구 오픈웨이트 모델
Falcon H1R 7B팰컨 H1R 7B
7B 규모와 262K 문맥을 제공하는 Technology Innovation Institute의 다국어 텍스트·추론 오픈웨이트 모델
Kanana 2 3B Instruct카나나 2 3B Instruct
3B 규모와 32K 문맥을 제공하는 Kakao의 한국어·영어 텍스트 오픈웨이트 모델
Falcon-H1-34B-Instruct팰컨-H1-34B-Instruct
Transformer와 Mamba 계열 상태공간 구조를 결합해 긴 문맥 효율을 노린 340억 하이브리드 모델
EXAONE Deep 7.8B엑사원 Deep 7.8B
7.8B 규모와 32K 문맥을 제공하는 LG AI Research의 한국어·영어 추론 오픈웨이트 모델
EXAONE Deep 2.4B엑사원 Deep 2.4B
2.4B 규모와 32K 문맥을 제공하는 LG AI Research의 한국어·영어 추론 오픈웨이트 모델
EXAONE Deep 32B엑사원 Deep 32B
32.0B 규모와 32K 문맥을 제공하는 LG AI Research의 한국어·영어 추론 오픈웨이트 모델
Olmo Hybrid Instruct DPO 7B
7B 규모와 32K 권장 출력 상한 문맥을 제공하는 Allen Institute for AI의 영어 텍스트·코드 오픈웨이트 모델
Command R+ 08-2024커맨드 R+ 08-2024
103.8B 규모와 128K 문맥을 제공하는 Cohere For AI의 텍스트·RAG 오픈웨이트 모델
StableLM 2 12B Chat스테이블LM 2 12B Chat
12.1B 규모와 4K 문맥을 제공하는 Stability AI의 텍스트 오픈웨이트 모델
오픈웨이트 모델은 2026년 8월 11일에 확인한 HuggingFace 다운로드를, 상용 API 모델은 공식 발표와 공개 관심도를 참고해 정렬합니다. 카드의 입력·출력 막대는 전체 202개 모델의 문맥과 지원 형식을 같은 척도로 환산한 상대 지표입니다. 비용은 공개 API 단가끼리 또는 오픈웨이트 BF16 가중치끼리 비교하며, 비교 가능한 숫자가 없는 모델은 막대에서 제외합니다. 이 지표들은 실제 사용자 수나 모델 품질 점수가 아닙니다.