5acAI-Lab. Phòng thí nghiệm AI open-source của Việt Nam.
Tương lai AI của doanh nghiệp không nên dựa trên API nước ngoài và giấy phép đóng. Chúng tôi xây stack của riêng mình — mở, chạy tại chỗ, tự sở hữu. Fork nó. Dùng nó. Cải thiện nó. Sở hữu nó.
Vì sao 5ac là một AI Lab
5ac không chỉ vận hành OPC (G-Company OS) cho doanh nghiệp — 5ac còn là một phòng thí nghiệm mở, nơi các recipe serving, tuning và benchmark được viết lại, đo đạc và công bố bằng tiếng Việt. Mọi recipe trong repo đều chạy thật trên phần cứng mà chúng tôi sở hữu, không phải slide.
Mở, chạy tại chỗ, tự sở hữu — đó là cách chúng tôi tin rằng trí tuệ nhân tạo nên đến với doanh nghiệp.
Hai trụ của 5acAI-Lab
OPC — G-Company OS
Một người chỉ huy, một đội ngũ AI làm sẵn. Tầng outcome-first, kể chuyện kết quả cho doanh nghiệp.
outcome-first · giữ nguyên homepageLocal AI Engine
Cụm suy luận on-prem trong phòng server của bạn — dữ liệu không rời tòa nhà. Tầng hạ tầng, kể chuyện kỹ thuật cho technical buyer.
on-prem · infrastructureHai tầng, hai ngôn ngữ. Người mua OPC nghe kết quả; builder theo dõi Lab nghe kỹ thuật. Không trộn.
Repository & Recipe
Toàn bộ recipe public trên GitHub, giấy phép MIT. Chúng tôi fork, audit và bổ sung tiếng Việt từ hệ sinh thái open-source toàn cầu — rồi đo lại trên phần cứng của chính mình.
- DeepSeek V4 Flash trên 2× DGX Spark (TP=2, DSpark speculative, 1M context, NVFP4) — recipe đầy đủ ops script + hotfix fail-closed.
- Qwen3.8-27B trên GB10 (SGLang, DSpark/DFlash, tuning on-device).
- Ops scripts: start / stop / status / logs / smoke-test, systemd an toàn sau reboot.
- Live verifier: Responses API 4-gates (text/SSE, tool continuation, JSON schema, multi-turn prefix reuse).
Benchmark — đo thật, không phải slide
Mọi con số dưới đây đều đo trên GB10 thật (DGX Spark), n=5, cùng bộ weights NVFP4.
| Workload | DSpark (block-7) | MTP (EAGLE 3/1/4) | Người thắng |
|---|---|---|---|
| Code — LRUCache + test | 51,5 tok/s | 34,5 tok/s | DSpark ~1,5× |
| Chat ngắn (thinking on) | 23,2 tok/s | 21,0 tok/s | DSpark nhẹ |
| Essay dài (Babbage → GPUs) | 18,3 tok/s | 24,1 tok/s | MTP ~1,3× |
Kết luận Lab: dùng DSpark cho agents / code / chat thường; MTP chỉ khi viết essay dài. Tuning đã đo: GDN state bf16 (+3% vs float32), spec steps 3/1/4 là peak, pin 10 lõi Cortex-X5 (+2–7% decode).
(Nguồn: benchmark MiaAI-Lab + Kubesimplify 14–18/08/2026 — CTO xác nhận trước khi public.)
Roadmap
- P0 (đang làm): trang Lab, repo recipe public, 2 bài blog kỹ thuật (DeepSeek V4 Flash 2× Spark · DSpark vs MTP).
- P1: tuning Qwen3.8 trên GB10, FAQ + pricing Local AI Engine, docs vận hành tiếng Việt.
- P2: case study bàn giao on-prem thật, so sánh "tự build vs thuê agency".
Doanh nghiệp của bạn cần bản on-prem?
Chúng tôi cài đặt, bàn giao vận hành cụm AI trong phòng server của bạn — dữ liệu không bao giờ rời tòa nhà, bạn sở hữu toàn bộ hạ tầng. Có gói từ 175 triệu, kèm gói chăm sóc vận hành.
Tham gia xây dựng Lab
Mọi recipe đều cần người test, đóng góp và phản biện. Join cộng đồng 5ac để cùng đo benchmark, review hotfix và viết recipe tiếng Việt.