生产力性能远超i9-14900HX!零刻GTR9 Pro迷你AI工作站评测:235B超大模型也能运行
一、前言
如果一台迷你主机,拥有远超i9-14900HX的生产力性能,比RTX 5050更强的游戏性能,能流畅运行70B、120B甚至235B超大模型,还配备了2个万兆网口……
那它无疑会是一款跨品类的 “性能怪兽”,不仅能填补当前迷你主机在 “极致性能” 与 “AI 本地化”领域的空白,还会直接冲击传统台式机、甚至是工作站的市场。
零刻GTR9 Pro迷你AI工作站正是这样的一款迷你主机。

锐龙AI Max + 395的CPU部分包含16个超大Zen5核心,32线程,加速频率5.1GHz,拥有64MB三级缓存,以及16MB二级缓存。
iGPU集显则拥有40组RDNA 3.5架构的计算单元,共计2560个流处理器,依托统一内存架构(UMA)技术最高可共享使用96GB LPDDR5x专用显存,位宽256bit,显存带宽256GB/s,整体规格已经超越了桌面版的RTX 4060独显。
AI 性能方面,得益于锐龙AI Max+ 395支持高达128GB超大内存,其中可分配最多96GB内存作为专用显存使用,因此它能运行RTX 5090都无法加载、运行的超大规模模型。
实际上,零刻GTR9 Pro迷你AI工作站可以运行Qwen3-235B-A22B的Q2量化模型,对于最新的OpenAI开源的GPT-OSS-120B原生的MXFP4模型,推理生成速度可以达到40tokens/s,这对于使用桌面游戏显卡的用户来说,是想都不敢想的事情。
二、图赏:2个USB 4.0接口 + 大面积VC均热板散热系统


全铝合金机身,经由细腻的CNC工艺精心打磨。
机身尺寸180*180*90.8mm,在保持迷你体型的同时还有足够的空间塞入强悍的散热模组。
机身左下角有一个方形电源按钮、右下角有3.5mm耳麦合一接口、SD插槽和一个USB-C 10Gbps接口,上方的4个小孔为阵列麦克风拾音孔。


上方是大面积散热栅格与散热孔,下方是各种I/O接口。
从背部就可以看出这台主机拥有非常强大的散热模组。

从左到右依次是电源插孔、2个USB4 40Gbps接口、3.5mm耳麦合一接口、HDMI 2.1 8K 60Hz、DP 2.1 8K 60Hz、2个万兆网口、2个USB 3.2 10Gps接口。

整个底部都是散热孔,同时还设计了一个底座可以托高机身,让内部空气交换更加顺畅。

打开大概可以看到供电电路的电容部分放在了主板的背面,采用了大量昂贵的片式聚合物电容。
右边有2个M.2接口,覆盖着散热鳍片。

2个M.2接口都支持PCIe 4.0 x4,右边一个插着一条2TB PCIe 4.0 SSD。

中间是锐龙AI MAX+ 395处理器,旁边是8颗美光LPDDR5X内存,内存总容量128GB,位宽256Bit、8Gbps速率,带宽256GB/s。

MSC 2.0散热系统,整个底部都是大面积VC均热板。

137mm宽散热鳍片。

2个超大静音风扇 、大面积VC均热板再加上 137mm宽散热鳍片配合底部进风贯穿式风道设计,可以带来稳定的性能释放。

DC电源设计在机身顶部,规格19V12.1A,输出功率230W。
三、理论性能测试:完胜i9-14900HX
1、CineBench R15

2、CineBench R20

3、CineBench R23

4、CineBench 2024

5、Blender Benchmark 4.5

6、Corona 10 benchmark

7、Indigo Benchmark

8、V-ray Benchmark 6.0

测试数据汇总如下:

可以看出,不论是理论性能还是生产力效能,锐龙AI Max + 395都远强于i9-14900HX,平均领先幅度达到了26.6%。
在Vray-Benchmark 6.0这种支持AVX-512指令集的应用中,锐龙AI Max+ 395处理器的领先幅度更是高达42.6%。
四、AI测试:可运行235B大模型
这种产品已经不单纯是传统意义上的迷你机,更是一台迷你AI工作站,非常适合AI开发者,尤其是个人和小企业开发者。
1、AI Image Generation Benchmark--Stable Diffusion 1.5(FP16)

当Radeon 8060S使用FP16精度进行AI Image Generation Benchmark测试时,总分为674。
2、AI Text Generation Benchmark

AI Text Generation Benchmark的测试,Radeon 8060S在LLAMA 2 13B的测试中,分数是RTX 5050的三倍。
3、DeepSeek R1
零刻GTR9 Pro迷你AI工作站配备了128GB LPDDR5X内存,最多可以分配96GB显存。测试时我们设置为64GB内存和64GB显存。

我们下载了各种模型组,直接使用QWEN3-235B A22B进行测试。

235B模型显存占用41GB,目前为止在消费级GPU仅有Radeon 8060S(最大可以分配96GB显存)可以流畅运行。
即便是RTX 5090,由于其显存只有32GB,强行加载235B模型只会出现爆显存的情况,算力断崖式暴跌。
我们试着让Deepseek模仿杜甫的《登高》,为黄鹤楼创作一首七言律诗,生成速度为9.62 tokens/s,总计耗时1分钟。
五、游戏性能测试:远强于桌面版RTX 5050