AI 大型語言模型 (LLMs)
AXIOM
AXIOM 是一個可啟動的 Rust 核心,透過以推論專用原語取代通用作業系統抽象,最佳化 Transformer 推論。
AXIOM
什麼是 AXIOM?
AXIOM 是一個研究用作業系統核心,專門設計用來在記憶體受限的硬體上有效執行 Transformer 推論工作負載,使用張量原生配置、層邊界排程和雙緩衝權重串流。
AXIOM 與相似工具比較
| 計價模式 | 免費 | 免費 | 免費 | 免費 |
| 免費額度 | ||||
| 主要功能 |
|
|
|
|
| 優點 |
|
|
|
|
| 缺點 |
|
|
|
|
| 適合對象 |
|
|
|
|
如何使用 AXIOM?
- 1設定 Rust nightly 工具鏈並安裝 bootimage。
- 2使用提供的 Python 腳本 (pack_weights.py) 打包模型權重。
- 3使用 cargo +nightly run --release 建置核心。
- 4在 QEMU 或裸機上啟動核心;它將執行推論並輸出遙測資料。
AXIOM 主要功能
- 張量原生記憶體配置,使用預留池
- 層邊界排程以防止層間搶佔
- 雙緩衝權重串流以重疊 I/O 和計算
- LayerLock 排程器用於快取駐留執行
- 量化推論 (Q4) 用於 SmolLM2-135M 和 TinyLlama-1.1B
AXIOM 使用情境
- 在記憶體受限的系統上執行大型語言模型
- 最佳化 Transformer 模型的推論延遲
- 研究 AI 工作負載的作業系統層級最佳化
- 評估核心層級排程對推論吞吐量的影響
AXIOM 價格與免費點數
AXIOM 目前採用 免費 模式。
AXIOM 優缺點
優點
- 將每層串流開銷從數秒減少到微秒
- 針對可預測的推論存取模式最佳化記憶體佈局
- 開放原始碼且可擴展以供研究
- 在基準測試中展示顯著的吞吐量提升 (14.8倍 TPS)
缺點
- 目前限於特定模型 (SmolLM2-135M, TinyLlama-1.1B Q4)
- 需要裸機 NVMe 以進行預期的低記憶體 7B 類評估
- 計算核心 (FFN 投影) 仍是瓶頸
- 非通用作業系統;缺乏使用者空間、網路、檔案系統
AXIOM 最適合哪些用途?
- AI 系統和作業系統的研究人員
- 在受限硬體上最佳化推論的開發人員
- 對 AI 核心層級效能工程感興趣的工程師