博客
所有文章 →Claude 4.8 让我失望,但这不是 Claude 一家的事
Opus 4.8 在研究和工程任务上连着让我失望,这些活我全转给了 GPT 5.5。但复盘下来,这不是 Claude 一家的问题。从英伟达、AMD 差点破产,到智谱掉队又翻身,顶尖模型一直在风水轮流转。别赌谁最强,赌谁还在牌桌上。
6 分钟阅读
C++HIPROCmAMD Ryzen AIWindowsLLM InferenceOpenAI API
AIMA AMD395 Qwen3.6 35B Windows Engine — Windows 原生推理引擎
在 AMD Ryzen AI Max+ 395 上原生运行 Qwen3.6-35B-A3B BF16:8K prefill 达 2,126 token/s、decode 达 30.55 token/s,131K 前缀复用场景 TTFT 为 8.59 秒。
C++OpenVINOIntel ArcLevel ZeroU4LLM InferenceOpenAI API
AIMA Intel PTL Qwen3.6 35B U4 Engine — Intel GPU 专用推理引擎
面向 Intel PTL / Arc B390 的 Qwen3.6-35B-A3B OpenVINO U4 专用引擎:21/21 性能门通过,prefill 最差 95% LCB 为 1.48×、decode 为 1.59×,10,752 个 greedy token 全部一致。
C++HIPROCmAMD Ryzen AILLM InferenceOpenAI API
AIMA AMD395 Qwen3.6 35B Linux Engine — AMD395 原生推理引擎
为 AMD Ryzen AI Max+ 395 定制的 Qwen3.6-35B-A3B BF16 原生推理引擎:无需 Python、PyTorch、vLLM 或系统 ROCm,支持 262K 上下文、OpenAI 兼容 API、SSE 流式输出和函数调用。





