C++HIPROCmAMD Ryzen AIWindowsLLM InferenceOpenAI API
AIMA AMD395 Qwen3.6 35B Windows Engine — Windows 原生推理引擎
在 AMD Ryzen AI Max+ 395 上原生运行 Qwen3.6-35B-A3B BF16:8K prefill 达 2,126 token/s、decode 达 30.55 token/s,131K 前缀复用场景 TTFT 为 8.59 秒。
个人项目与作品
在 AMD Ryzen AI Max+ 395 上原生运行 Qwen3.6-35B-A3B BF16:8K prefill 达 2,126 token/s、decode 达 30.55 token/s,131K 前缀复用场景 TTFT 为 8.59 秒。
面向 Intel PTL / Arc B390 的 Qwen3.6-35B-A3B OpenVINO U4 专用引擎:21/21 性能门通过,prefill 最差 95% LCB 为 1.48×、decode 为 1.59×,10,752 个 greedy token 全部一致。
为 AMD Ryzen AI Max+ 395 定制的 Qwen3.6-35B-A3B BF16 原生推理引擎:无需 Python、PyTorch、vLLM 或系统 ROCm,支持 262K 上下文、OpenAI 兼容 API、SSE 流式输出和函数调用。
告别 SSH 和手动排查。一行命令连接设备,用自然语言描述需求,AI Agent 自动完成诊断、安装、修复和升级。
把 1 小时的飞书应用配置压缩到 5 分钟。一键自动完成创建应用、配置权限、对接 OpenClaw 的全部流程,让开发者专注于产品而非平台对接。
让 AI 推理部署像安装 App 一样简单。AIMA 自动识别硬件、选择最优配置、一键部署,让每台机器都成为 AI 推理节点。