Bonsai 27B
스마트폰에서 로컬로 구동되는 최초의 27B급 멀티모달 대형 모델. 알리바바 Qwen3.6 27B를 극한 양자화로 3.9GB까지 압축
Bonsai 27B
스마트폰에서 로컬로 구동되는 최초의 27B급 멀티모달 대형 모델. 알리바바 Qwen3.6 27B를 극한 양자화로 3.9GB까지 압축
Kimi K3 오픈소스판
문샷AI(월지암면)가 공개한 세계 최대 오픈소스 대형 모델. 2조 8천억 매개변수, 네이티브 멀티모달과 100만 토큰 초장문 컨텍스트 지원, 코딩 능력 세계 1위
즈푸 GLM-5.2
즈푸(Zhipu)가 출시·오픈소스화한 차세대 플래그십 대형 모델. 코딩과 장기 과제에서 세계 최고 폐쇄형 모델과 경쟁하며 MIT 라이선스로 공개, 중국산 컴퓨팅 칩에도 최적화
Osaurus
macOS 네이티브 오픈소스 AI 런타임으로, 로컬에서 AI 모델을 실행하고 에이전트를 관리하며 데이터와 프라이버시가 내 Mac에 완전히 머무름
Gemini 3.6 Flash
Google DeepMind가 에이전트 시대를 위해 내놓은 효율형 주력 모델로, 코딩·지식 작업·멀티모달 과제에서 더 강력하고 토큰을 더 절약
판스(Panshi)·과학 기초 대형 모델 2.0
중국과학원이 구축한 통합형 과학 전용 대형 모델로, 과학 연구에 고신뢰·설명 가능한 지능형 기반을 제공
SenseNova U1 Pro
센스타임(SenseTime)이 발표한 플래그십 네이티브 멀티모달 대형 모델로, 납품급 복잡한 이미지·텍스트 창작과 네이티브 8K 초고화질 출력을 주력
Qwen3.8
알리바바 통의 쿤웬(Qwen) 2.4조 매개변수 차세대 플래그십 멀티모달 대형 모델로, 코드 엔지니어링과 전문 오피스를 주력하며 미리보기 버전이 공개되고 가중치 오픈을 약속
Muse Spark 1.1
Meta 슈퍼인텔리전스 랩이 내놓은 플래그십 멀티모달 추론 모델로, 에이전트 작업과 코딩을 위해 설계되었으며 백만 토큰 컨텍스트에 가격은 동급 경쟁 제품의 4분의 1
AI21 Jamba2
이스라엘 AI21 Labs가 내놓은 오픈소스 하이브리드 SSM-Transformer 모델 계열로, 기업급 신뢰성과 256K 긴 컨텍스트의 메모리 효율을 주력
Gemini 5
Google DeepMind가 2026년 7월 발표한 플래그십 대형 모델 Gemini 3.5 Pro로, 200만 토큰 초장 컨텍스트와 Deep Think 확장 추론을 주력으로 합니다.
GPT-7
OpenAI의 현재 최강 최첨단 모델 패밀리 GPT-5.6(Sol/Terra/Luna)로, 에이전트 워크플로와 네이티브 도구 호출로 복잡한 작업 실행을 재구성합니다.
Claude Opus 6
Anthropic Opus 플래그십 최첨단 라인으로, 장거리 추론, 장시간 자율 Agent 및 '정직' 자가 보정을 주력으로 합니다.
Grok 6
xAI가 2026년 하반기 Grok 4.5(1.5조 파라미터, 프로그래밍과 Agent 주력)로 가격 전쟁을 일으키며, Grok 4.6(2조 파라미터)은 8월 후속 예정입니다.
Upstage Solar 2
한국 Upstage가 출시한 2세대 플래그십 대형 언어 모델 Solar Pro 2로, 310억 파라미터, 단일 카드 구동, 한국어 1위 및 기업용 레디가 탄탄합니다.
Fireworks 2
PyTorch 원팀이 창업한 오픈소스 모델 추론 및 학습 클라우드 플랫폼으로, 기업 사유 데이터로 '전용 지능'을 커스터마이즈하는 것을 주력으로 합니다.
DeepSeek V4.5
DeepSeek(딥시크)가 2026년 7월 출시한 플래그십 대형 모델 반복 버전으로, 코드, 중국어 장문 및 다회차 일관성을 강화하며 오픈소스와 바닥가 전략을 이어갑니다.
Claude Opus 5
Anthropic이 2026년 7월 출시한 차세대 Opus 플래그십 모델로, 백만 단위 컨텍스트와 초강력 agentic 코딩을 주력으로 하며 공식적으로 '세계 최강 프로그래밍 모델'로 불리고 Fable 5 능력에 약 절반 가격으로 근접합니다.
Gemini 4.5 Pro
Google 계열로 백만 토큰 장문 컨텍스트와 전 모달 이해를 주력으로 하는 고성능 플래그십 대형 모델입니다.
Aleph Alpha 콜럼버스(Columbus)
Aleph Alpha의 유럽 기업·정부 대상 주권 AI 플랫폼으로, 규정 준수, 데이터 통제 가능성 및 설명 가능성을 핵심으로 합니다.
NetEase 위옌 2(NetEase Yuyan 2)
NetEase(왕이) Fuxi(푸시) 자체 개발 중국어 롤플레잉 대형 모델로, 스토리 생성과 캐릭터 설정 대화에 특화되며 2026년 6월 규제 당국 등록을 통과했습니다.
SenseTime 르르신 6(SenseTime RiriXin 6)
SenseTime(센스타임) 6세대 네이티브 멀티모달 대형 모델 패밀리로, 통일 아키텍처로 텍스트, 이미지, 비디오, 음성의 심층 추론을 구현하며 6.7 Flash-Lite 오피스 에이전트와 오픈소스 U1 통합 모델로 확장됩니다.
iFlytek 싱화 6(iFlytek Spark 6)
iFlytek(쉰페이)이 전 국산 연산으로 학습한 인지 대형 모델로, 음성과 교육 두 시나리오가 매우 강하고 정부·기업 레디가 앞서며 범용 대화와 코딩 능력은 중하위입니다.
바이두 웬신 5.5(Baidu Wenxin 5.5)
바이두 계열 올라운드 AI 어시스턴트로, 중국어 지식 질문과 답변, 문학 창작 및 논리 추론 시나리오에 깊이 정통하며 비디오, 이미지, 음성 등 멀티모달 AI 능력을 갖추었습니다.
Qwen3.5-Coder
알리바바 Tongyi(퉁이) Qwen 3.5 패밀리의 코드 전용 개방 가중치 모델로, 7B/32B 듀얼 사이즈, 256K 컨텍스트, Apache 2.0 상업 사용 가능하며 로컬 배포형 저장소급 프로그래밍과 Coding Agent를 주력으로 합니다.
Grok 5.5
xAI의 실시간 AI 어시스턴트로, 유일하게 X 실시간 데이터 스트림에 네이티브 연결되며 Grok 5 베타는 6조 파라미터 MoE 플래그십입니다.
Nemotron Ultra 253B
NVIDIA 253B 개방 가중치 추론 모델로, 텍스트 추론과 코딩에서 폐쇄형 플래그십에 대응하며 상업 사용 가능합니다.
Gemma 5
구글 DeepMind 개방 가중치 모델 패밀리 최신 세대 Gemma 4(Apache 2.0, 휴대폰부터 서버까지 커버).
Claude Haiku 5
Anthropic의 가장 빠르고 저렴한 모델(현재 실제로는 Haiku 4.5)로, 플래그십에 근접한 코딩 능력으로 비용과 지연을 최소화합니다.
Mistral Codestral 2
Mistral 2세대 코드 전용 모델로, Apache 2.0 재인가 후 합법적 자체 호스팅과 상업 사용이 가능하며 IDE 인라인 완성에 능합니다.