Bonsai 27B
Mô hình lớn đa phương thức hạng 27B đầu tiên chạy cục bộ trên điện thoại, nén xuống 3,9GB từ Qwen3.6 27B của Alibaba bằng lượng tử hóa cực hạn
Bonsai 27B
Mô hình lớn đa phương thức hạng 27B đầu tiên chạy cục bộ trên điện thoại, nén xuống 3,9GB từ Qwen3.6 27B của Alibaba bằng lượng tử hóa cực hạn
Kimi K3 bản mã nguồn mở
Mô hình lớn mã nguồn mở lớn nhất thế giới do Moonshot AI phát hành: 2,8 nghìn tỷ tham số, đa phương thức native và ngữ cảnh siêu dài 1 triệu token, năng lực lập trình đứng đầu thế giới
Zhipu GLM-5.2
Mô hình lớn chủ lực thế hệ mới của Zhipu, phát hành mã nguồn mở theo giấy phép MIT: cạnh tranh với các mô hình đóng hàng đầu thế giới về lập trình và tác vụ dài hạn, tương thích với chip nội địa Trung Quốc
Osaurus
Runtime AI gốc macOS mã nguồn mở, chạy mô hình và quản lý tác tử cục bộ, dữ liệu và quyền riêng tư hoàn toàn ở lại trên máy Mac của bạn
Gemini 3.6 Flash
Mô hình chính hiệu quả của Google DeepMind cho kỷ nguyên tác tử, mạnh hơn và tiết kiệm token hơn trong lập trình, công việc tri thức và tác vụ đa phương thức
Panshi Scientific Foundation Model 2.0
Mô hình khoa học chuyên biệt toàn diện từ Viện Hàn lâm Khoa học Trung Quốc, cung cấp nền tảng thông minh độ tin cậy cao và có thể giải thích cho nghiên cứu khoa học
SenseNova U1 Pro
Mô hình đa phương thức thuần chủng chủ lực của SenseTime, chuyên tạo hình ảnh và văn bản phức tạp chất lượng bàn giao với đầu ra 8K gốc
Qwen3.8
Mô hình đa phương thức chủ lực mới 2,4 nghìn tỷ tham số từ Alibaba Tongyi Qianwen, chuyên về kỹ thuật mã và năng suất chuyên nghiệp, bản xem trước đã có sẵn với trọng số mã nguồn mở đã cam kết
Muse Spark 1.1
Mô hình suy luận đa phương thức chủ lực của Meta AI, được thiết kế cho tác vụ Agent và lập trình, ngữ cảnh một triệu token, giá chỉ bằng một phần tư đối thủ
AI21 Jamba2
Dòng mô hình hybrid SSM-Transformer mã nguồn mở từ AI21 Labs Israel, tập trung vào độ tin cậy doanh nghiệp và hiệu quả bộ nhớ với ngữ cảnh 256K
Gemini 5
Google DeepMind phát hành mô hình chủ lực Gemini 3.5 Pro vào tháng 7 năm 2026, với 2 triệu token ngữ cảnh và suy luận mở rộng Deep Think
GPT-7
Dòng mô hình tiên phong mạnh nhất của OpenAI hiện tại, GPT-5.6 (Sol/Terra/Luna), tái định nghĩa thực thi tác vụ phức tạp với quy trình tác tử và công cụ gốc
Claude Opus 6
Dòng sản phẩm tiên phong h��ng đầu của Anthropic Opus, chuyên về suy luận tầm xa, tác tử tự động kéo dài và tự hiệu chỉnh trung thực
Grok 6
xAI phát động cuộc chiến giá trong nửa cuối 2026 với Grok 4.5 (1,5 nghìn tỷ tham số, tập trung vào lập trình và Agent), Grok 4.6 (2 nghìn tỷ tham số) dự kiến tiếp nối vào tháng 8
Upstage Solar 2
Thế hệ th��� hai của mô hình ngôn ngữ chủ lực Upstage Hàn Quốc, Solar Pro 2, 31 tỷ tham số, chạy trên một GPU, thống trị tiếng Hàn với triển khai doanh nghiệp vững chắc
Fireworks 2
Nền tảng đám mây suy luận và huấn luyện cho mô hình mã nguồn mở do đội ngũ PyTorch gốc sáng lập, chuyên tùy chỉnh trí thông minh độc quyền trên dữ liệu riêng của doanh nghiệp
DeepSeek V4.5
Phiên bản kế tiếp của mô hình chủ lực DeepSeek ra mắt tháng 7/2026, cải thiện về mã nguồn, văn bản dài tiếng Trung và tính nhất quán đa lượt, tiếp tục chiến lược mã nguồn mở và giá rẻ
Claude Opus 5
Mô hình chủ lực Opus thế hệ mới của Anthropic ra mắt tháng 7/2026, với ngữ cảnh hàng triệu token và khả năng lập trình tác tử vượt trội, được công ty đánh giá là mô hình l��p trình mạnh nhất thế giới, tiệm cận năng lực của Fable 5 với mức giá chỉ bằng một nửa
Gemini 4.5 Pro
Mô hình chủ lực hiệu suất cao của Google với ngữ cảnh dài hàng triệu token và khả năng hiểu đa phương thức toàn diện
SenseTime SenseNova 6
Họ LLM đa phương thức gốc thế hệ thứ 6 của SenseTime, kiến trúc thống nhất cho suy luận sâu trên văn bản, hình ảnh, video và giọng nói
iFlyTek Spark 6
Mô hình nhận thức iFlyTek được huấn luyện trên năng lực tính toán nội địa, cực kỳ mạnh về giọng nói và giáo dục
Baidu Ernie 5.5
Trợ lý AI đa năng của Baidu, chuyên sâu về hỏi đáp kiến thức Trung Quốc, sáng tác văn học và suy luận logic
Qwen3.5-Coder
Mô hình trọng số mở chuyên mã của dòng Qwen 3.5 Alibaba, kích thước kép 7B/32B, ngữ cảnh 256K, Apache 2.0
Grok 5.5
Trợ lý AI thời gian thực của xAI, duy nhất kết nối gốc với luồng dữ liệu thời gian thực của X
Nemotron Ultra 253B
Mô hình suy luận trọng số mở 253B của NVIDIA, sánh ngang mô hình đóng, có thể dùng thương mại
Gemma 5
Họ mô hình trọng số mở mới nhất của Google DeepMind (Apache 2.0, từ di động đến máy chủ)
Claude Haiku 5
Mô hình nhanh nhất rẻ nhất của Anthropic, chi phí và độ trễ tối thiểu với khả năng mã hóa gần bằng flagship
Mistral Codestral 2
Mô hình mã thế hệ thứ 2 của Mistral, cấp phép lại Apache 2.0 để tự lưu trữ và sử dụng thương mại
Xiaomi MiMo 2
Dòng LLM nguồn mở của Xiaomi cho kỷ nguyên tác nhân, có thể dùng thương mại với giá chỉ bằng phần nhỏ