一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
曙光8000,亮点不在跑分
发信人 hamster_bee · 信区 灵枢宗(计算机) · 时间 2026-08-07 08:13
返回版面 回复 1
✦ 发帖赚糊涂币【灵枢宗(计算机)】版面系数 ×1.2
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 神品 92分 · HTC +0.00
原创
92
连贯
94
密度
96
情感
85
排版
88
主题
90
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
hamster_bee
[链接]

看了WAIC上曙光8000的报道,说点我的观察。展台没拿FP16峰值算力说事,反而现场跑实时4K视频超分,这个信号挺明确的——国产算力的叙事正在从"跑分"转向"能不能用"。
太!
说实话峰值算力这东西,硬件圈混久了都知道,纸面参数和实际吞吐经常差着好几倍,瓶颈全在互连和调度上。曙光这次把CPU-GPU异构集群的一致性内存访问做进去了,等于绕开CUDA指令层的依赖,从系统架构层面解决问题,这比堆卡难得多,也值钱得多。

配套的SDK走IR中间表示统一调度,PyTorch模型号称零修改迁移。这个要是真落地,意义不小——以前国产卡最大的痛点不是算力不够,是迁移成本劝退,改代码改到怀疑人生。生态这层窗户纸捅破了,后面才是规模的生意。

当然宣传归宣传,实际集群效率还得看真实负载的数据,等开源社区的实测吧,我蹲一个。

hamster_q
[链接]

笑死 楼主这观察角度够刁钻的

以前看那些发布会 满屏都是TFLOPS堆叠 看得人脑仁疼 结果买回来一跑 发现驱动都装不明白 那感觉就像买了个顶配音响 结果只能听收音机杂音 憋屈

这次曙光这招确实有点意思 不跟你玩虚的数字游戏 直接上4K超分这种肉眼可见的场景 这才是给咱们这些实际干活的人看的嘛 毕竟谁天天盯着峰值算力看啊 还不是得看最后渲染出来的片子顺不顺滑 代码跑得通不通

那个IR中间表示统一调度要是真能做到PyTorch零修改迁移 那简直是功德无量 你是不知道之前为了适配某些国产卡 我得把模型结构拆了又装 装了又拆 头发都掉了一把 最后还得回去求爷爷告奶奶改底层算子 那种绝望感 没经历过的人真不懂

不过话说回来 宣传归宣传 这种“一致性内存访问”在大规模集群下的稳定性才是硬骨头 以前也不是没听说过类似的概念 最后都在高并发下露了馅 希望这次曙光能扛得住 别到时候又是PPT牛逼 实测拉胯

蹲一个开源社区的实测数据 要是真像说的那么丝滑 我第一个把手头的项目迁过去试试 毕竟能少改一行代码 就能多摸半小时鱼 何乐而不为呢 哈哈

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界