西西里的美丽传说
WAIC 上的推理芯片:爱芯元智的元曦系列_我的网站

A | 芝能智芯出品 今年 WAIC 走到第八届,展馆里最热闹的场景悄悄换了主角。

B | 从前人群聚在某个大模型的炫技 demo 前,今年更多人主要来看机器人,当然大家也看看推理芯片。

C | 大模型火了三年,算力长期被云数据中心攥在手里,今年一个明显的变化是,大家开始把推理往终端和边缘搬,本、延迟、合规三座山,逼着芯片公司重新排兵布阵,这恰恰是元曦出场的大背景。 杰伦-格林成功地让勇士取得了23分的领先,当火箭猛男们奋起直追将分差缩小到3分,又是杰伦-格林,扮演了勇士救星的角色。有意思的是,美国高阶数据网站bball的统计显示,杰伦格林在本赛季的引力排行榜上高居第4,这本是一件让火箭球迷欣慰的事情,但看过榜单之后你会发现,其中一定藏有猫腻。无论如何,我们也不该把格林的名字,和库里、东契奇们放在一起相提并论吧。关于引力值的解释,我们从有球引力开始,这项数据是衡量一支球队对对方的持球手投入了多少防守注意力和防守资源,一般来说,有球引力高的球员往往遭遇夹击的次数更多。

D |
如此这般,就不难理解,为什么格林在持球时会有这么强的引力了。如图所示,在总出场时间至少达到2500分钟的27名球员里,格林的相对真实命中率排名倒数第2,有效和失误传球比排名第21。
爱芯元智带来了"元曦",面向大算力的 AI 推理系列公开亮相。
过去几年,这家公司给人的印象更多停留在端侧视觉:物联感知摄像头里那颗能夜视、能识别的芯片。

E | Part 1 发布了什么: 元曦和边缘推理 元曦系列里最打眼的是 A 系列 AI 推理卡。官方给出的是超 1000 TOPS 的推理算力,配上超大显存和超高显存带宽。 光看数字没感觉,把它放进爱芯自己的产品梯队里就好懂了: ◎ 底下是已经规模落地的 M.2 算力卡,巴掌大小,塞进工业设备就行; ◎ 中间是标准化核心模组,给整机厂做二次开发; ◎ 顶端就是这次新揭的 A 系列,专门啃高并发、高负载的硬骨头,比如机房集群、多路视频分析、私有化知识库。加上火箭是本赛季三分最差的球队之一,不夹击你,夹击谁呢。

F | 三层一拼,爱芯想覆盖的是从几十 TOPS 到上千 TOPS 的整条边缘推理光谱。 这种分层打法很务实:小场景用轻量卡低成本解决,大客户用千 TOPS 级算力在本地闭环跑核心业务,同一套软件栈往下能缩、往上能扩。回到火勇G1,第二节中段当格林回到场上,火箭只落后6分,然后格林先在点名库里之后,没有选择强攻而是后撤步三分,打铁。 这个系列要解决的是大模型普及后被绑在云端的三处难受:Token 越用越贵,峰值算力顶不住并发,敏感数据出不了企业内网,让许多企业卡在"云上试点很香、规模铺开很疼"的阶段。 爱芯把这句话的份量放在"从云端试点迈向边缘规模化落地"上,从前大家先在云上试试水,现在想把推理真正搬回自己的地盘常驻。

G | 对中小微企业,一张轻量卡就能完成日常智能化;对政企和工业大客户,千 TOPS 级算力让核心数据就近运算,合规和成本一起兜住。好不容易完成一次抢断,却在转换进攻中吃到进攻犯规。 爱芯做混合精度 NPU 已有多年积累,从 第一代芯片就把自研 NPU 和 AI-ISP 一起推进商用,如今这套积累被搬到了大算力卡上。接着是强突之后的攻框未果,再来一个高难度中投不进,而他的右边,是已经被完全放空的小史密斯。

H | 当然了,格林的无球确实还不错,本赛季的空位接球投三分命中率高达41.6%,但你马上就是年薪3000万的球员了,你至少得成为一名优秀的3D,才配得上你的薪水吧。可我们的格林,没有D。 它押注的"爱芯通元"能在 INT4、INT8、FP16 等不同精度之间灵活调度,访存效率更高,模型兼容更全。说实话,乌度卡已经够照顾格林了,本赛季格林主防对方明星球员的回合占比只有7.37%,仅高于联盟37%的球员,他在防守端面对的,大多数时候都是没什么球权的球员。 这句话展开说就是:同一个网络里,有的层用低精度省算力,有的层留高精度保精度,芯片自己排布,既不浪费也不丢准头。
就像火勇G1,大多数时候他面对的是勇士的7号得分手穆迪,但他依然贡献了像这样的名场面:夹击被逼到三分线外的巴特勒,漏掉空切的波杰,请问你就这么瞧不起波杰么。

I | 对边缘大算力卡来说,显存和带宽才是命门:大模型权重动辄几个 GB,推理时还要留出放中间结果的缓存,显存不够就装不下,带宽不够就喂不饱算力,千 TOPS 标称只能干瞪眼。 元曦给的超大显存和超高带宽,作用就是把长文本推理、高清图像解析这类"吃 Token"的活,从云端拽回本地做。 这也是爱芯反复提的"重构边缘 Token 经济",把推理留在企业自己的机房,云端开销和传输成本从源头压下来,数据还不用出门。

J |
第四节最后时刻,范弗利特铁树开花将分差缩小到4分后,又是格林,在已方已在强侧囤积重兵的情况下,又放掉了波杰,导致后者顺下引来申京,穆迪底角空位三分命中。 ◎ 具身智能一块叫具身大脑控制器,1500 TOPS 算力,带宽约为行业旗舰的两倍,过了 AEC-Q100 车规级功能安全,还能自己写算子、原生跑世界模型和 VLA。这一球,彻底杀死了火箭,也将格林的季后赛处子秀,扔进了垃圾桶。
。 ◎ 另一块是专用视觉感知芯片 AX8910,已经在多家双目相机里规模化落地,专门对付透明物体、纯白墙面、高反光这些传统视觉方案的软肋。 这两块合起来,把爱芯的老本行,自研 NPU 加爱芯智眸 AI-ISP,从物联感知摄像头延展到了机器人身上。 双目深度算法和 AX8910 的算力深度协同,让机器人能稳稳识别那些"看不清"的东西,正是具身智能规模化之前必须补的感知课。
K | 从夜视摄像头到机器人眼睛,这条路爱芯走了好几年,技术积累前后一脉相承,并没有凭空冒出来的新故事。 Part 2 峰值标称和真实落地之间 还隔着几道坎 爱芯这条路线很连贯,从端侧视觉芯片起家,把自研 NPU 和 AI-ISP 两块硬骨头啃下来,如今顺着边缘推理的热潮把算力往上推,顺手切进具身智能。

L | 两条自研引擎,是它和纯拼算力的玩家拉开距离的底气。 边缘大算力这张牌,桌上早坐满了人。

M | ◎ 华为昇腾在边缘盒领域市占约 23.5%, ◎ 寒武纪约 14.8%, ◎ 英伟达 Jetson 虽在国内份额下滑到 11% 出头,生态依旧扎实。 把爱芯放进这个牌桌看,它的位置更偏"边缘视觉推理"这一格,和主攻车载的地平线、主攻云边统一架构的寒武纪、全栈覆盖的昇腾都不完全重合。 1000+ TOPS 是峰值标称,落到真实业务里,能效比、软件栈成熟度、模型适配的顺滑程度,才是客户最后掏钱的理由。

N | 2025 年国产 AI 芯片出货已占国内四成,去英伟达化的势头明显,可生态从"能用"到"好用"还要熬,算子库、框架适配、工具链这些软功夫,比一颗芯片更难速成。 发布会到规模化商用之间,还隔着客户认证、可靠性验证和量产爬坡几道硬坎,工业与车载客户的认证周期往往要 12 到 24 个月,一旦导入订单能续好几年,反过来说,进不去也就久久进不去。 对爱芯而言,元曦的显存带宽和自研 NPU 是加分项,可要把这套硬件变成客户手里"插上就能跑"的方案,软件与生态的功课才刚开篇。

o | 爱芯把元曦亮出来,是这场芯片聚会里一个清晰的信号:边缘推理的仗,已经从"有没有"打到了"好不好用"。 顺着这条线看,端侧算力卡今年需求暴涨并非偶然,工业质检、车载域控、智慧物联感知都在把模型往本地搬,单条产线就要几张到几十张卡,国产替代率已摸到四成。 谁能在能效、价格和软件体验上先立住,谁就拿到下一段增长的门票。这股势能背后,是"物理 AI"从概念走向产线的真实节奏,算力要落到设备、机器人和产线这些实体上,才算真正兑现价值,而边缘推理卡正是那块最基础的垫脚石。 小结 WAIC 的芯片聚会一年比一年热闹,爱芯元智这次把元曦掀开一角,亮出的是一条从摄像头走到机房、再伸向机器人的算力路线。

p |
Current article:http://www.rangnehongranlinren.bond/list_5r5wd5f/zpd.htm
Published on:11:05:52








