|
|
哈喽大家好!各位每天蹲在Hugging Face上刷最新开源模型、为了把一个70B参数的LLaMA跑出能用的推理速度不惜把RTX 4090的显存压榨到最后一兆、做梦都想拥有一台不用租云服务器就能在本地跑大模型的机器的AI炼丹师和深度学习从业者;各位出差住酒店第一件事就是把随身带的迷你主机掏出来接上电视当主力机用、对设备的体积重量和性能释放有着近乎苛刻的要求、恨不得把所有家当都装进登机箱的远程办公程序员和数字游民;各位家里书桌上摆着三四台不同品牌的迷你PC、从Intel NUC到华硕PN系列到零刻 SER系列全都摸过一遍、每次有新发布的迷你主机就忍不住下单回来测一测的数码硬件发烧友和折腾党;各位在公司里负责给研发部门和设计团队采购办公设备、既要控制预算又要确保每个人都能流畅运行本地AI工具和大型编译环境、经常被老板问为什么不能买便宜点的IT采购经理和行政主管;各位正在读计算机科学或者人工智能方向的研究生和博士生、实验室的服务器排队排到下个月、导师又不给批经费买显卡、只能自己想办法攒一台能跑实验的小型设备的在校学生和科研助理;各位在家里搭了一套完整的HomeLab、从群晖NAS到Proxmox虚拟化集群到OpenWrt软路由全都安排上了、对各种低功耗高性能的小主机有着天然好感、看到新出的迷你PC就想研究能不能塞进机柜的自建机房爱好者和家庭服务器玩家;各位做视频剪辑和3D建模渲染的自由职业者和小型工作室负责人、每个月在云渲染服务上花的钱比房租还高、一直在找一台能本地干活不用跟云服务商扯皮的性价比主机的创作者和内容生产者;各位本来对迷你PC没什么兴趣、但看到"192GB内存"和"3000亿参数大模型"这两个数字直接被震住了、虽然暂时想不出自己能用它干什么但就是想知道这台机器到底有多厉害的纯路人围观群众——
不管你属于上面说的哪一类人,今天这篇文章你都值得花几分钟好好看一看。因为就在昨天星期一,国内硬件厂商驰为(CHUWI)正式对外发布了一款在他们自家产品线里算得上性能天花板级别的新品——UniBox AI495 Pro。这台迷你主机的核心配置单如果单独拿出来摆在桌面上,足以让很多体型比它大好几倍的台式机和入门级工作站都感到脸上挂不住:它搭载了AMD目前面向移动端推出的最强APU——锐龙AI Max+ PRO 495,配备了高达192GB的LPDDR5X统一内存,而且最关键的是,用户可以从这192GB的总内存容量中拿出最多160GB来当作显存使用。整台机器的所有硬件全部被塞进了一个体积只有2.9升的小机箱里面,随机附带一个240瓦功率的电源适配器,而驰为官方声称这样一台巴掌大的小盒子就能在本地流畅运行参数规模高达3000亿的大语言模型。这条消息最早是由海外科技媒体Wccftech在2026年9月7日报道出来的,消息一经发出就在国内外硬件圈和AI圈里引发了不小的讨论热度。下面我就把这台机器的每一个值得关注的细节,从它搭载的处理器到底盘到内存到显卡到存储到网络接口到外观尺寸到竞品对比,全部掰开来一个一个跟你讲清楚,保证原文里出现的每一个信息点都不会被我漏掉。
先从这台机器的心脏部分说起——那颗AMD锐龙AI Max+ PRO 495处理器。这颗芯片属于AMD目前最新的Gorgon Halo系列SoC,也就是系统级芯片,采用了Zen 5微架构,拥有16个物理核心和32个线程。16核32线程这个规格如果放在桌面平台上,已经算是中高端处理器的水准了,而它竟然被集成在了这样一颗主要面向移动设备和紧凑型主板的APU里面,它的功耗控制和散热设计面临的挑战有多大,大家可以自己想象一下。但这颗处理器真正厉害的地方其实不在于CPU本身的传统算力,而在于它内部集成的NPU,也就是神经网络处理单元,再加上它那块性能相当不错的集成显卡,三者共同构成了一个完整的AI算力体系。驰为官方给出的数据是,整个平台的AI算力可以达到131 TOPS。这里有必要解释一下TOPS是什么意思——它是Tera Operations Per Second的缩写,中文翻译过来就是每秒万亿次运算。131 TOPS意味着这颗芯片每秒钟可以完成131万亿次的人工智能相关运算。这个算力水平用来在本地运行目前市面上主流的大语言模型,比如说Meta公司开源的LLaMA 3.1系列各个尺寸的版本、阿里巴巴开源的Qwen 2.5系列、以及Mistral AI公司推出的各种开源模型,都是完全够用的。驰为官方在发布会上明确表示,这台UniBox AI495 Pro可以流畅运行参数规模高达3000亿的本地大语言模型。3000亿参数是什么概念呢?我用一个对比来帮助大家理解:目前市面上绝大多数消费级独立显卡,哪怕是被很多人奉为卡皇的NVIDIA RTX 4090,它的显存容量也只有24GB。24GB的显存连一个70B参数的模型都没法跑完整的非量化版本,更不用说300B也就是3000亿参数规模的模型了。而UniBox AI495 Pro之所以能做到这一点,靠的就是它那192GB的统一内存架构。所谓统一内存,就是说CPU和GPU共用同一个内存池,不需要像传统独立显卡那样把数据在系统内存和显存之间来回搬运。大语言模型的权重文件可以直接存放在这192GB的庞大内存空间里面,这样一来就从根本上突破了传统显卡显存容量的物理限制。
说到内存这块,就不得不把驰为这台新机器和他们家上一代旗舰产品UniBox AI395放在一起做个对比了,因为内存恰恰是这两代产品之间差距最大的地方。上一代的UniBox AI395搭载的是锐龙AI Max+ 395处理器,最高支持128GB的LPDDR5X内存,内存运行速度为8000 MT/s。MT/s是Mega Transfers per Second的缩写,也就是每秒百万次传输。而这一次新发布的UniBox AI495 Pro直接把内存容量上限拉高到了192GB,比上一代多了整整64GB,这是一个相当夸张的跨越式提升。与此同时,内存的运行速度也从8000 MT/s提升到了8533 MT/s,提高了533 MT/s。533这个数字单独看可能让人觉得不算太大,但对于统一内存架构来说,内存带宽的高低直接决定了CPU和GPU之间交换数据的速度上限,也直接影响到大语言模型在进行推理运算时生成token的效率。更让人吃惊的是,在这192GB的总内存容量当中,用户可以根据自己的实际使用需求分配出最多160GB来当作显存使用。160GB的显存意味着什么呢?意味着很多以前只能在数据中心里用NVIDIA A100或者H100这种专业级计算卡才能跑得动的超大模型,现在可以被搬到这台体积只有2.9升的小盒子里面来本地运行了。对于从事AI开发的工程师、做机器学习研究的科研人员、以及对数据隐私有严格要求的企业用户来说,这无疑是一个巨大的利好——你再也不用把自己手里的数据上传到别人的云服务器上去跑推理了,不用担心数据在传输过程中被截获或者在云端被泄露,坐在你自己的办公桌前就能完成大模型的推理和微调工作。
除了内存方面的巨大升级之外,处理器的换代也顺带着让集成显卡的性能往上提了一档。锐龙AI Max+ PRO 495内部集成的图形核心叫做Radeon 8065S,这块集成显卡拥有40个计算单元,也就是Compute Units,架构基础是AMD的RDNA 3.5。这个规格跟另一款名叫Radeon 8060S的集成显卡非常接近,两者在核心规格上几乎一模一样,唯一的区别在于8065S的加速频率比8060S高了100MHz。100MHz的频率提升单独拿出来说可能算不上什么惊天动地的变化,但在实际的游戏帧率和图形渲染任务当中,这100MHz还是能带来可以感知到的性能改善的。当然了,对于大多数打算购买这台机器的目标用户来说,游戏性能可能只是一个锦上添花的加分项,他们真正看重的东西还是AI算力和超大容量内存带来的本地大模型运行能力。
在存储方面,UniBox AI495 Pro基本上沿用了上一代的设计方案,提供了三个M.2 2280规格的PCIe 4.0插槽。这意味着用户最多可以同时安装三块NVMe协议的固态硬盘,组建一套读写速度相当可观的高速存储阵列。对于需要加载几百GB甚至上TB大小的大模型文件的AI应用场景来说,固态硬盘的读写速度直接决定了模型从硬盘加载到内存所需要的时间,高速的NVMe SSD可以明显缩短这个等待过程,提升整体的使用体验。在网络连接方面,这台机器同样给到了目前消费级市场上能找到的最顶级配置:支持WiFi 7无线网络标准,支持蓝牙5.4协议,并且配备了两个10GbE也就是万兆速率的有线网口。双万兆网口这种配置在迷你PC这个品类里面是非常罕见的,一般只有在高端网络附加存储设备或者工作站级别的机器上才能见到。对于需要组建高速局域网、经常在几台设备之间传输大量数据的用户来说,这两个万兆网口的存在无疑是一个非常有吸引力的卖点。接口方面,机身提供了多个USB Type-A和USB Type-C端口,可以方便地连接各种外接设备。所有这些硬件全部被整合在了一个容积为2.9升的机箱里面,整机配备一个240瓦的电源适配器。2.9升的体积到底有多大呢?为了方便大家理解,我打个比方:大概相当于两瓶1.5升装的可口可乐并排放在一起的那个大小,放在桌面上几乎不会占用什么空间。
有一点值得注意:驰为并不是目前市场上唯一一家推出这种配置方案的迷你主机厂商。就在几天前,另外一个在迷你PC圈子里知名度很高的品牌Minisforum发布了他们的MS-S1 MAX-P495,同样搭载了锐龙AI Max+ PRO 495处理器并且支持192GB内存。除此之外,GMKtec也推出了他们的EVO-X5 Pro。这三款产品的硬件规格高度相似,都是围绕着AMD这颗旗舰级别的APU来设计的。这说明上游芯片厂商AMD在移动端APU产品线上的持续发力,正在催生出一波高性能迷你PC的集中发布潮。各家厂商之间的竞争焦点,已经从单纯的处理器型号选择,逐渐转移到了散热方案的设计水平、内存支持的极限容量、接口种类的丰富程度以及最终的市场定价策略上。
不过到目前为止,驰为方面还没有对外公布UniBox AI495 Pro的具体零售价格和正式上市销售的时间。考虑到这台机器配备了192GB的超大容量LPDDR5X内存和目前AMD移动端最顶级的APU,它的物料成本肯定不会低。我们可以参考上一代UniBox AI395上市时的定价情况,再结合当前内存颗粒和芯片的市场行情来做一个大致的推测:这台机器的最终售价大概率会落在人民币一万元以上,甚至有可能逼近两万元。但即便价格真的到了这个区间,对于那些确实需要在本地运行大语言模型但又不想花大价钱去购买专用服务器或者工作站的人来说,这台机器依然有着很强的吸引力——你想一想,用不到两万块钱买到一台能在本地跑3000亿参数大模型的小主机,相比之下那些动不动就要十几万甚至几十万的搭载A100或者H100的工作站,性价比的差距一下子就出来了。
从一个更宏观的行业视角来看待这件事,驰为UniBox AI495 Pro的亮相实际上传递出了一个明确的信号:本地AI推理这项能力,正在从过去那种只能依赖云端服务器和专业数据中心的状态,一步一步地向普通消费者的桌面端渗透。随着AMD、英特尔以及未来可能入局的其他芯片厂商不断地在APU中集成更强大的AI加速引擎和更大容量的内存支持方案,我们有理由相信在未来几年之内,会有越来越多的普通消费者在自己家里的电脑上就能运行那些以前只能在数据中心里才能跑得动的大型AI模型。这种趋势对于推动AI技术的普及化、降低AI应用的入门门槛、保护个人和企业用户的数据隐私安全,都有着非常积极的意义。当然,这台机器目前仍然面临一些有待验证的问题,比如说在高负载长时间运行的情况下散热表现究竟怎么样、实际的AI推理速度能不能达到宣传中说的那么流畅、以及各种开源大模型和AI框架在这套硬件平台上的兼容性和稳定性如何——这些问题都需要等到产品正式上市、经过第三方评测机构的实测之后才能得出确切的答案。
好了,关于驰为UniBox AI495 Pro这台迷你PC目前所有公开的已知信息,今天就跟大家聊到这里。从192GB的超大容量统一内存到最多160GB可以分配给集成显卡当作显存使用,从131 TOPS的AI总算力到两个万兆有线网口,这台体积只有2.9升的小盒子里确实塞进了太多让人看完之后忍不住多看两眼的东西。如果你是一个需要在本地频繁跑大模型的AI开发者或者研究者,或者你是一个对各种迷你主机有着天然好感的硬件爱好者,这台机器绝对值得你把它列入重点关注名单。至于它最终上市时的定价是多少、实际用起来表现如何,让我们耐心等待驰为官方的后续消息。你对这台号称能在本地跑3000亿参数大模型的迷你PC有什么看法?如果价格合适的话你会考虑买一台来玩玩吗?欢迎在评论区留言说说你的想法。
|
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
x
|