大模型跑在云端,每次调用都在“烧钱”,数据上传又伴着合规焦虑。能不能把AI“请”进公司,在办公室里跑出属于自己的本地大模型和Agent?
答案是能——承载它的设备,叫端侧人工智能算力工作站(以下简称“端侧AI工作站”)。
8月26日,国内首个端侧AI工作站团体标准——《端侧人工智能算力工作站通用技术规范》(T/AIIA 023—2026)正式发布。该标准由深圳奥尼电子股份有限公司提出并牵头起草,联合产业链上下游共14家单位共同制定,由深圳市人工智能产业协会归口管理,将于2026年9月1日起实施。

这意味着,过去市场上“各说各话”的端侧AI工作站,开始有了统一的产品定义、性能指标、安全要求和测试方法。
随着Agent加速进入真实业务,政企、金融、医疗、科研等场景对本地AI推理的需求快速增长。但与此同时,端侧AI工作站仍处于产业发展的早期阶段:
〉算力参数如何定义?
〉不同产品如何分级?
〉一台设备到底能跑多大的模型?
〉断网后还能不能正常运行?
〉企业数据如何确保不外泄?
产品形态和技术路线快速演进,行业标准却相对缺位。从“能不能跑AI”,走向“到底能跑到什么水平”,端侧AI工作站需要一套可量化、可验证、可比较的统一标准。这正是该标准制定的现实背景。
标准涵盖分级与标识、推理性能、Agent运行环境、环境与信息安全、兼容性五大技术要求,并配套测试方法与检验规则,让标准不仅能够定义产品,更能够真正用于检测和选型。

首创算力三级分级+统一标识
给AI工作站“上牌照”
首次以综合推理算力划分消费级(C)、专业级(P)、企业级(E)三级,并配套统一标识规则,AI算力以INT8精度、模型规模以MoE量化为统一口径:
● 消费级C:≥50 TOPS,支持4B模型;
● 专业级P:≥100 TOPS,支持14B模型;
● 企业级E:≥500 TOPS,支持27B模型。
选购端侧AI工作站,从此像看酒店星级一样一目了然。
首次定义“Agent OS”
把Agent运行环境写进标准
标准首次对Agent运行环境提出技术要求,构建硬件管理、模型管理、智能体管理、安全管理四大能力的一体化操作系统,并要求提供Web管理面板实时展示运行状态。
“AI员工”不再是云端一次性会话,而是能扎根本地、持续积累的“常住员工”。
把“断网可用”写成硬指标
出厂即预置可对话模型
断网环境下须正常运行已安装的模型与Agent,且出厂应预置至少1个可用对话模型——开箱即用,断网也能对话。
标准还规定了测试方法:断开全部外部网络,全程监测流量,确认推理数据不得外发。断电断网不“断脑”,这是端侧部署区别于云端的核心价值。
首创S1/S2/S3三级安全模式
从“开放”到“堡垒”
S1开放(完全联网,可接入云端大模型)、S2企业(内网运行,可按需授权访问云端)、S3堡垒(推理100%本地完成,数据不出设备),并要求RBAC访问控制与防篡改审计日志。对法律、政务等高隐私场景,AI处理敏感数据终于有了可审计的安全等级。
此外,标准进一步建立统一的推理性能测试方法,围绕首Token延迟、推理吞吐量等关键指标,明确测试模型、推理引擎、测试参数与流程,为端侧AI工作站性能评价提供统一依据;兼容性方面明确要求支持Linux内核,为国产操作系统留足空间。
奥尼是国内最早布局端侧AI工作站的厂商之一,其产品实践为标准制定提供了技术依据和产业经验。这份标准也凝聚着全产业链共识——14家起草单位、25位技术骨干与行业专家逐条打磨技术条款,是上下游协同共建的"产业公约"。

一份标准,三重价值
对行业——终结参数杂乱、标注不一的混沌期,为设计、制造、选型提供统一标尺。
对用户——从"看不懂参数"到"按标准选型",采购有依据,数据安全有界定。
对产业——标准落地正加速数据安全合规与国产替代的双重进程。
作为标准的提出与牵头起草单位,奥尼将继续以产品实践反哺标准建设,让每一家企业都能安心用上属于自己的AI。

