7月17日,以“智能伙伴 共创未来”为主题的2026世界人工智能大会暨人工智能全球治理高级别会议(以下简称“WAIC 2026”)在上海正式拉开帷幕。新一代AI基础设施服务商阡视科技,携最新专为Token工厂而生的超节点真机重磅亮相,沉浸式呈现下一代国产超节点技术的底层智算逻辑与系统级性能拓展路径。
当前,人工智能技术正从推理时计算演进至递归自我改进阶段,长程连续迭代与闭环规划任务成为下一阶段的核心范式。在此范式下,KV Cache的频繁读写使存力成为新的系统瓶颈。传统超节点架构主要侧重于GPU的互联平面,重点解决芯片间横向通信的瓶颈,对于Token工厂场景来说,无法满足超长上下文的运算效率问题。
阡视科技自主研发的专为Token工厂而生的wylon超节点系统,不仅具备横向算力互联,实现了全域无阻塞的卡间全互联通信;还定义了一个新的纵向存力贯通平面,系统打通了异构存力资源的层级架构,构建起百TB级GPU 近存、系统内存以及PB级大带宽闪存空间;同时结合HitenOS大模型操作系统的高效软硬件深度协同设计,在国产GPU平台上实现了“同一速度下更高吞吐,同一吞吐下更快响应”的帕累托改进,可达10倍以上性能的提升。
通过对Token工厂场景的深入分析以及软硬件联合设计研发,wylon超节点系统实现了KV分层管理、算力亲和调度、硬件拓扑感知等底层能力,确保模型负载直达硬件底层,避免中间层性能损耗,为大模型运行提供一体化的高效算力空间,满足Agent时代对大算力、大带宽、大存储的需求,并持续降低Token成本。
阡视科技在 WAIC 2026上发布的专为 Token 工厂而生的wylon Q72/288,单机柜集成 72 颗国产 GPU,4 机柜横向互联域扩展至 288 卡规模,GPU 高带宽显存可达 18 TB,互联总带宽可达 72 TB/s,支持 FP8/4 浮点运算精度,专为 KV Cache 设计的统一DRAM 缓存可达上百TB,为大模型推理提供一体化的高效算存空间,实现高效稳定的 Token 生产。基于 wylon 超节点架构的 wylon 新云 Token 工厂,现已在华东集群节点上线并邀请测试中。
wylon超节点系统深度联合寒武纪、壁仞、沐曦、曦望、海光、摩尔线程等国内GPU芯片翘楚,构建起从芯片到系统、从算力到生态全栈贯通的国产AI基础设施,不断拓展国产超节点系统性能的帕累托前沿。
更多动态
WAIC 2026 收官:云端 + 本地 AI 全谱系产品亮相
为期 4 天的 WAIC 2026 在上海落下帷幕。阡视科技携基于自研超节点技术架构的 Cloud AI 与 Local AI 全矩阵产品亮相,呈现软硬协同算力基础设施、国产化落地实践与行业解决方案。
阅读全文阡视科技联合上海 AI 实验室等编著《超节点技术体系白皮书》
在第二届浦江 AI 学术年会上,由上海 AI 实验室 DeepLink 团队牵头、联合 8 所顶尖高校与 16 家核心产业伙伴共同编著的《超节点技术体系白皮书》正式发布,阡视科技受邀成为核心参编单位。
阅读全文阡视科技荣膺国家级专精特新“小巨人”企业称号
工业和信息化部开展 2025 年专精特新“小巨人”企业认定和复核工作,上海阡视科技有限公司成功通过认定,荣获第七批专精特新“小巨人”企业称号。
阅读全文