Laya-CoreML 0.1.0 釋出產物
在 Apple Silicon 上安裝公開的執行時:
python -m pip install 'laya-coreml[demo]==0.1.0'
wheel 包含推理、Hub 載入、終端 Snake 演示及其回放渲染器。模型權重單獨下載。PyTorch 是可選的匯出依賴;MLX 是可選的對比依賴。兩者都不是執行已釋出模型所必需的。見 PyPI 專案。
固定的模型釋出
全部六個倉庫都是公開的。每個都包含匯出的 Core ML 包、tokenizer、配置、模型卡、許可證、署名和驗證報告。ANE 包還包含與原始完全一致的主機端 embedding 和 action-head 張量。它們是獨立的推理包。
| Hugging Face 倉庫 | 釋出版本 |
|---|---|
| aac6fef/laya-coreml | fff78b2d9750c6b748fe8c90fcbf8bed0a1522a9 |
| aac6fef/laya-multilingual-coreml | 8139e9089273319512c730218903784074133187 |
| aac6fef/laya-multilingual-coreml-ane | 39d6a9b3d0f67f06da74fbade6121ea134cbdb21 |
| aac6fef/laya-multilingual-coreml-ane-w8 | 7503714810747a879b1e310074a9398bc573e739 |
| aac6fef/laya-multilingual-coreml-snake | e580bca9c1a8f5e6084afedc49cba4a166dfc6f2 |
| aac6fef/laya-typed-decisions-coreml | 28d24fa8d67a3264556b23391ec6c3fd98573056 |
例如:
hf download aac6fef/laya-multilingual-coreml-ane \
--revision 39d6a9b3d0f67f06da74fbade6121ea134cbdb21 \
--local-dir models/ane
laya-coreml-snake --model ./models/ane
或直接載入一個固定的 Hub 快照:
import laya_coreml as laya
agent = laya.load(
"aac6fef/laya-multilingual-coreml-ane",
revision="39d6a9b3d0f67f06da74fbade6121ea134cbdb21",
)
釋出清單、包雜湊、形狀和完整包體積在 hub-release.json。W8 包約 557 MB,含主機端 embedding 和 tokenizer;129 MB 只描述它的 Core ML 主體。W8 是配合 FP16 計算的權重調色盤化,不是整數啟用量化。
模型與包驗證
每個釋出的包在上傳前都對照其歸檔的、已驗證的匯出做了檢查。可移植的 ANE 包保留原始 Core ML 主體,並以逐元素完全相等的方式提取六個主機端張量。隨後打包時的推理重複了上游的 golden-fixture 檢查:
| 包 | 匹配的選定答案 | 最大校準機率漂移 | 重複呼叫 |
|---|---|---|---|
| 英文 FP16 | 63/63 | 0.003308 | 100 穩定 |
| 多語言 FP16 | 63/63 | 0.001578 | 100 穩定 |
| Typed Decisions FP16 | 63/63 | 0.002727 | 100 穩定 |
| Snake GPU,B3/L64 | 12/12 適配 | 0.001308 | 100 穩定 |
| ANE FP16,L96 | 59/59 適配 | 0.002925 | 100 穩定 |
| ANE W8,L96 | 59/59 適配 | 0.014393 | 100 穩定 |
短的匯出會拒絕超出其輸入容量的夾具。它們的適配子集是明確的;它們不是全上下文等價的說法。全部使用相同的 0.02 機率漂移閾值。通用 checkpoint 覆蓋 189/189 個問題;六個包合計覆蓋 319 個適配比較,checkpoint 之間有重疊。見 release-validation.json。
一個全新的 Python 3.12 環境安裝了構建好的 wheel 和 demo extra,沒有 Torch、MLX 或 Transformers。在 Python socket 連線被阻斷的情況下,六個本地包全部載入並給出穩定的預測。隨後載入了一個公開、固定的 ANE Hub 快照,接著在阻斷網路連線的情況下從快取做了第二次載入。沒有任何離線環節嘗試建立連線。這次檢查還驗證了 USAGE.md 中描述的 Core ML 符號連結物化修復。結果:wheel-runtime-smoke.json。
0.1.0 版於 2026-09-20 釋出到 PyPI。兩個公開分發包都被下載,其 SHA256 摘要與本地釋出產物一致。隨後又一個新環境在停用快取的情況下直接從公開 PyPI 索引安裝了 laya-coreml[demo]==0.1.0。README 中直接載入 Hub 的示例成功執行,返回零輸出 token,並在預測期間阻斷網路連線的情況下,三次重複呼叫給出相同答案。兩個已安裝的 CLI 入口也都成功啟動。見 釋出回執 和 公開安裝推理檢查。
復現釋出檢查
本地釋出門禁通過了 64 個測試、Ruff lint/format 檢查和嚴格的 Twine 包後設資料校驗。測試包括轉換語義、包快取完整性、遊戲不變數、離線模型解析,以及對已釋出 855 步錄製中每個棋盤/動作的精確回放。
構建後端被釘在 Hatchling 1.31.0。它的 Core Metadata 2.4 輸出能通過本釋出的 Twine 6 檢查器;一個最初使用更新的預設 2.5 後設資料的構建被拒絕。預設值的變化見 Hatchling 的版本歷史。已釋出的產物使用相容的構建,並在上傳前再次檢查。確切的 wheel 和原始碼分發包 SHA256 摘要記錄在 distribution-files.json。
在可取得原始已驗證據產的原始碼 checkout 中:
uv sync --extra convert --extra dev --extra compare --extra research --extra demo --extra publish
.venv/bin/python scripts/prepare_hub.py
.venv/bin/python -m benchmarks.release_validate models/hub/* \
--output benchmarks/results/release-validation.json
.venv/bin/ruff check .
.venv/bin/ruff format --check .
.venv/bin/pytest -q
.venv/bin/python -m build
.venv/bin/twine check --strict dist/*
prepare_hub.py 拒絕覆蓋已存在的包目錄。獨立的 wheel 檢查在原始碼樹之外的一個全新環境裡、下載或準備好六個包之後,用 scripts/wheel_smoke.py --hub-check 執行。完整的遊戲迴圈測量見 SNAKE_BENCHMARKS.md,確切的錄製媒體來源見 LAUNCH.md。
0.2.0 上游同步
本釋出通過上游 4aa6761 移植了適用的 prompt 校驗、自定義 noul 標籤、Unicode 指令、對話尾部截斷、選項摺疊診斷和答案置信度報告。它還發布了溫度鉗制,該鉗制在原始碼 0.1.1 中存在,但 PyPI 0.1.0 中沒有。Core ML 圖簽名、權重和 ANE 容量檢查保持不變。上面的歷史基準結果描述的是 0.1.0,不是一次新的效能執行。混合問題延遲和 Intel Mac 支援未由本次同步驗證。
更新 pyproject.toml、laya_coreml/__init__.py 和 uv.lock 之後,推送一個 v<version> 標籤。Release 工作流會執行可複用的 CI 檢查、對照標籤校驗這三個版本、構建並驗證 wheel/sdist、使用倉庫金鑰 PYPI_API_TOKEN 釋出到 PyPI,並用相同的分發包建立一個 GitHub release。CI 失敗會阻止釋出。