部署运维
后端是 Power 共享执行与证据契约背后的能力提供方。应根据模型格式、平台和信任边界选择后端,而不是把后端名称当作系统架构。
构建配置
llamacpp-mtp-fr 独立成 profile,是因为它会修改固定版本的源码。普通 llamacpp 构建不需要该实验补丁。
服务端点
健康检查与模型检查端点公开实际生效的非敏感配置,使基准和部署自动化能够拒绝配置漂移。
制品安装
制品安装器要求提供预期文件名、最大字节数与 SHA-256 摘要。它将数据流式写入私有暂存文件,验证精确字节,再在跨进程锁下原子提交。离线策略找不到已验证制品时会失败关闭。
托管模型仓库默认位于 ~/.a3s/power,采用内容寻址。模型别名指向 manifest,而不会削弱 blob 身份。
生产边界
- 除非经过审查的传输策略另有要求,开发服务只绑定回环地址。
- 显式选择 RA-TLS 或 vsock;构造嵌入式运行时不会替调用方选择传输。
- 模拟 TEE 模式只能用于开发。
- 不得因为 CPU TEE 放置就声称 GPU 推理具备机密性。
- 保存证明证据时保留原始报告字段。
- 混合量化与词表缩减 draft 都是需要质量门槛、与负载相关的技术。
- 每次性能验收都同时保存模型字节、ACL、二进制哈希、驱动与主机控制信息。
供应链与存储
纯 Rust tee-minimal 路径减少原生推理依赖;llama.cpp 路径则用更大的原生工具链换取成熟 GGUF 与 CUDA 能力。审计时必须以实际发布的 feature profile 为准。
Rust API 类型与 feature flag 参阅 docs.rs/a3s-power。
