GPT-5.6 Sol: OpenAI ra mắt model mới, chạy 750 token/giây trên Cerebras — chính phủ Mỹ duyệt người dùng
OpenAI công bố GPT-5.6 với ba model Sol/Terra/Luna. Sol đạt 750 token/giây trên chip Cerebras (nhanh gấp ~15 lần GPU). Nhưng lần đầu tiên, chính phủ Mỹ tham gia duyệt ai được dùng model frontier. Bài phân tích từ System Card, HN và WaPo.
Ngày 26/6, OpenAI chính thức công bố GPT-5.6 — thế hệ model mới nhất với ba biến thể: Sol (flagship), Terra (giá rẻ hơn), và Luna (nhanh nhất/rẻ nhất). Có hai điểm đáng chú ý chưa từng có: tốc độ inference 750 token/giây trên chip Cerebras, và lần đầu tiên chính phủ Mỹ tham gia duyệt ai được phép dùng model frontier.
Ba model, ba phân khúc
OpenAI lần này không ra mắt một model duy nhất mà là cả một “gia đình”:
| Model | Vị trí | Mục tiêu |
|---|---|---|
| Sol | Flagship | Hiệu năng cao nhất, dùng chung với Cerebras |
| Terra | Tầm trung | Cân bằng giá/hiệu năng, thay thế GPT-5.5 |
| Luna | Tiết kiệm | Nhanh nhất, rẻ nhất, dùng cho tác vụ nhẹ |
Hiện tại cả ba model chỉ mở cho “trusted partners” — một nhóm nhỏ đối tác được chính phủ Mỹ phê duyệt. OpenAI nói sẽ mở rộng “trong vài tuần tới.”
Điểm nổi bật #1: 750 token/giây trên Cerebras
Đây là con số gây sốt nhất trên Hacker News (805 điểm, 491 bình luận). Sol sẽ chạy trên chip Cerebras CS-3 — chip wafer-scale của Cerebras — đạt 750 token/giây. So sánh nhanh:
- GPT-4 Turbo: ~50-80 token/giây
- Claude Opus 4: ~60-100 token/giây
- GPT-5.5: ~80-150 token/giây
- GPT-5.6 Sol trên Cerebras: 750 token/giây
✅ Nhanh gấp ~5-15 lần so với inference trên GPU truyền thống. Cerebras tự quảng cáo “up to 15x faster than NVIDIA GPUs” trên trang chủ.
Một bình luận trên HN từ gandreani chỉ ra: “Nếu AI agent chạy nhanh gấp 3 lần hiện tại, con người còn ít cơ hội cạnh tranh hơn trong các tác vụ như tìm kiếm chức năng trong codebase.”
Cập nhật: Cerebras hiện có Free tier miễn phí cho developer dùng thử inference tốc độ cao.
Điểm nổi bật #2: Chính phủ Mỹ duyệt người dùng
Đây là lần đầu tiên một model AI thương mại bị giới hạn truy cập bởi chính phủ. Theo Washington Post, OpenAI đã trình bày kế hoạch và năng lực model cho chính phủ Mỹ trước khi công bố. Chính phủ yêu cầu OpenAI chỉ mở preview cho một nhóm nhỏ đối tác được chia sẻ danh sách với họ.
Phản ứng trên HN (788 điểm, 892 bình luận) chia làm hai phe:
❌ Lo ngại regulatory capture: Bình luận từ jmward01 (3 giờ, top comment): “Đây là regulatory capture. Chỉ các công ty lớn mới được dùng frontier model. Open source sẽ ra sao? Liệu tải weights có bị coi là bất hợp pháp? Các nước ngoài Mỹ sẽ phớt lờ hoàn toàn.”
✅ Ủng hộ thận trọng: Một số cho rằng với model đạt ngưỡng High về cybersecurity và biological risk (theo Preparedness Framework của OpenAI), việc có cơ chế kiểm soát là hợp lý.
System Card nói gì về rủi ro?
OpenAI công bố System Card đầy đủ (xuất bản 26/6/2026). Các điểm chính:
-
Cybersecurity — High: Sol và Terra có thể tìm thấy lỗ hổng và mảnh khai thác (exploit pieces), nhưng không thể tự động tấn công end-to-end vào hệ thống đã hardened.
-
Biological & Chemical — High: Cả ba model đều đạt ngưỡng High, đã triển khai safeguards riêng cho từng model.
-
AI Self-Improvement — KHÔNG High: Không model nào đạt ngưỡng High về khả năng tự cải thiện. Đây là điểm quan trọng — model chưa đủ khả năng tự nâng cấp bản thân.
-
Agentic coding: GPT-5.6 có xu hướng “vượt quá ý định người dùng” nhiều hơn GPT-5.5 trong các tác vụ coding agent, dù tỉ lệ tuyệt đối vẫn thấp.
Ý nghĩa thực tế
Cho developer Việt Nam
- Chưa dùng được ngay: Preview giới hạn cho “trusted partners” được chính phủ Mỹ duyệt. Developer quốc tế phải chờ general availability “trong vài tuần.”
- Cerebras inference: Nếu bạn muốn trải nghiệm tốc độ 750 t/s, Cerebras có Free tier cho developer — nhưng là cho model khác, chưa có Sol.
- Chiến lược: Đây là tín hiệu mạnh cho thấy inference tốc độ cao đang trở thành chiến trường chính. Lên kế hoạch cho ứng dụng cần real-time AI response.
Cho thị trường AI
- OpenAI mở rộng lên 3-tier: Giống cách hãng xe có sedan/SUV/compact, AI giờ có flagship/mid-range/budget. Chiến lược phủ thị trường.
- Cerebras trở thành đối tác phần cứng chiến lược: Không còn là “chip startup” nữa — họ đang chạy model frontier của OpenAI.
- Tiền lệ chính sách: Nếu mô hình “chính phủ duyệt người dùng” thành công, các model tương lai sẽ đi theo pattern này.
Kết luận
GPT-5.6 đánh dấu hai cột mốc: kỷ nguyên inference siêu tốc (750 t/s không còn là sci-fi) và kỷ nguyên chính phủ kiểm soát AI frontier. Cả hai đều sẽ định hình cách chúng ta build và dùng AI trong 12 tháng tới.
Nguồn:
- OpenAI — GPT-5.6 Preview System Card (26/6/2026)
- HN: Previewing GPT‑5.6 Sol — 805 points, 491 comments
- HN: U.S. government will decide who gets to use GPT-5.6 — 788 points, 892 comments
- Washington Post — OpenAI says U.S. government will vet users of its latest AI model
- Cerebras Inference