@techtipsvn
Mistral · 06/10/2026

Mistral Large 4 có 1 nghìn tỉ tham số, mỗi lần chỉ dùng 49 tỉ

Model mới của Mistral rất lớn, nhưng mỗi lần trả lời chỉ chạy một phần nhỏ.

2026-10-0709 slide2 phút đọcTin
Slide bìa: Mistral Large 4 có 1 nghìn tỉ tham số, mỗi lần chỉ dùng 49 tỉSlide 2Slide 3Slide 4Slide 5Slide 6Slide 7Slide 8Slide 9
cuộn, vuốt, hoặc phím ←→01 / 09

Cùng một bài, đọc bằng chữ. Nhanh hơn và tìm lại được bằng Ctrl+F.

tham số model dùng mỗi lần sinh chữ, trên tổng 1 nghìn tỉ

Tham số là gì

Tham số là các con số model học được khi train. Model càng nhiều tham số thì càng lớn, và cần càng nhiều bộ nhớ để tải lên.

Ghi chú

1T là 1 nghìn tỉ, 49B là 49 tỉ. T là trillion, B là billion.

Active parameters

Mỗi lần sinh một token, Large 4 chỉ chạy 49 tỉ trong 1 nghìn tỉ tham số. Ít phép tính hơn nên nhanh và rẻ hơn. Nhưng máy vẫn phải chứa đủ 1 nghìn tỉ.

Ghi chú

Token là một mẩu chữ, thường ngắn hơn một từ.

Hai con số

Tổng: 1T

Kích thước của cả model

Cần bao nhiêu bộ nhớ để tải

Active: 49B

Mỗi token tốn bao nhiêu phép tính

Chạy nhanh hay chậm

Open-weight là gì

Open-weight nghĩa là hãng công bố file tham số để ai cũng tải về và tự chạy. Mistral nói sẽ thả weights của Large 4 trước cuối tháng 10/2026.

Ghi chú

Hiện tại chỉ có bản preview qua API trên Mistral Studio.

Điểm benchmark, theo Mistral

Benchmark là bộ bài test chung để so model. Theo Mistral, Large 4 giải 93% bài Cybench, thuộc nhóm cao nhất của model open-weight. Trên DeepSWE v1.1, bài test code, hãng công bố 61,7%.

Khi đọc tin model mới

Nên

Tách tổng tham số và active parameters

Chờ bên thứ ba chạy lại benchmark

Thử trên việc thật của bạn

Không nên

So model chỉ bằng tổng tham số

Tin điểm hãng tự chọn bài, tự đo

Weights về cuối tháng

Mistral ra bản preview ngày 06/10/2026. Weights dự kiến có trước cuối tháng 10. Follow để nhận tin khi file về.

techtipstechtipsvnmistralaicongnghe
Đọc tiếp

Bài khác cùng chủ đề

Slide bìa: Skill, subagent, hook, MCP, plugin: năm thứ gắn thêm vào Claude Code và bật cái nào trước10

Skill, subagent, hook, MCP, plugin: năm thứ gắn thêm vào Claude Code và bật cái nào trước

Giải thích2′ đọc25.09
Slide bìa: GPT-6 Sol rẻ bằng nửa GPT-5.6 Sol, ra cùng ngày với Claude Opus 5.510

GPT-6 Sol rẻ bằng nửa GPT-5.6 Sol, ra cùng ngày với Claude Opus 5.5

Tin2′ đọc25.09
Slide bìa: AI của OpenAI bị chặn vẫn vào hệ thống chính phủ Úc — và cách nhốt agent trên máy bạn10

AI của OpenAI bị chặn vẫn vào hệ thống chính phủ Úc — và cách nhốt agent trên máy bạn

Tin2′ đọc25.09
Slide bìa: GPT-6 Astra ra mắt: 1.050.000 token ngữ cảnh, nhưng ngày đầu bạn chưa gọi được10

GPT-6 Astra ra mắt: 1.050.000 token ngữ cảnh, nhưng ngày đầu bạn chưa gọi được

Tin2′ đọc04.09

Mỗi ngày một bài mới.

Mẹo, giải thích và tin công nghệ cho sinh viên và dev mới đi làm. Một người viết, đăng đều.

Bài cũng được đăng lên TikTok, ở dạng slide.

TikTok@techtipsvn