文章提交注意事项:
请在发布文章时用HTML代码加上至少一条新闻来源的链接;原创性消息,可加入相关信息(如涉及公司的网址)的链接。有任何问题,邮件至:he.fang#zhiding.cn
注意:收到邮件乱码的用户请修改客户端的默认字体编码,从"简体中文(GB2312)"修改为"Unicode(UTF-8)"。
solidot新版网站常见问题,请点击这里查看。
Solidot 公告
投 票
热门文章
-
- 廉价太阳能改变世界能源格局 (0)
- F-Droid 上的应用有多少是在 AI 帮助下编写的? (0)
- 英国殖民之前的澳大利亚原居民人口约 222 万 (0)
- 出于兴趣阅读有助于促进终身的身心健康 (0)
- 夜晚睡眠光照太亮可能会损伤心脏 (0)
- 日本百岁老人人数首次超过 10 万人 (0)
- Firefox 156 释出 (0)
- Fedora 45 Beta 释出 (0)
- 时光机器遭遇大规模机器流量 (0)
- SDL3 移植到 HarmonyOS / OpenHarmony (0)
热门评论
- 很正常 (1 points, 一般) by Craynic 在 2026年07月27日13时22分 星期一 评论到 古代语言的多样性远超今日
- 发电不需要油吗 (1 points, 一般) by Craynic 在 2026年06月03日13时51分 星期三 评论到 能源危机推动 37 个国家的电动汽车销量创新高
- 所以firefox 已经路边一条,对用户的需求漠视的结果就是这样了 (1 points, 一般) by solidot1745479987 在 2026年04月20日11时14分 星期一 评论到 Firefox 加入了对 Web Serial API 的支持
- (1 points, 一般) by solidot1775703930 在 2026年04月09日11时09分 星期四 评论到 Sam Altman 能被信任吗?
- 很难想象现代Linux居然还能跑在i486上 (1 points, 一般) by Craynic 在 2026年04月07日19时41分 星期二 评论到 Linux 准备移除对 i486 CPU 的支持
- 很多单词已经不再实用 (1 points, 一般) by Craynic 在 2026年04月07日13时22分 星期二 评论到 人们日常说话的单词量比上一年减少 300 个单词
- 表示方向不还是得有那么多个维度吗 (1 points, 一般) by Craynic 在 2026年03月30日13时35分 星期一 评论到 Google TurboQuant AI 压缩算法大幅减少大模型内存使用
- sora的核心用户是内容创作者 (1 points, 一般) by Craynic 在 2026年03月27日13时16分 星期五 评论到 Sora 为何失败:每天推理成本最高 1500 万美元总收入仅为 210 万美元
- 夏天骑摩托的时候,最喜欢带着有线耳机听相声或小说 (1 points, 一般) by kracker1911 在 2026年03月17日09时36分 星期二 评论到 有线耳机销量暴增
- 不如用网易邮箱 (1 points, 一般) by Craynic 在 2026年03月10日11时20分 星期二 评论到 FBI 通过 Proton Mail 识别抗议者身份
在 Supercomputing 23 上,申威介绍了神威太湖之光使用的申威处理器 SW26010 的升级版本 SW26010-Pro。神威太湖之光目前排名 Top 500 超算榜单的第 11 名,使用新处理器的神威海洋之光能排在第二名,仅次于美国橡树岭国家实验室的 Frontier 超算。SW26010 完成研发是在 2016 年,而 SW26010-Pro 是在 2020-2021 年。两者的基本架构相同,SW26010-Pro 由 6 个核心组(Core Groups)和 1 个协议处理单元(PPU)构成,每个核心组包含 64 个计算处理元素,相比下 SW26010 只有 4 个核心组,它支持的内存控制器从 DDR3 升级到 DDR4-3200。每个核心组都有自己的内存控制器,配备 16 GB 内存,理论带宽 307.2 GB/s,一个芯片能访问 96 GB 主内存,相比 SW26010 的 32 GB 有显著提升。核心组每个核心共享 8 MB L2 缓存。它的峰值 FP64 性能达到了 13.8 TFLOPS,相比下上一代 SW26010 为 2.9 TFLOPS,性能翻了两翻。但它的内存带宽未能与计算吞吐量相匹配,内存带宽成为了它的性能瓶颈。神威海洋之光包含了 107,136 个 SW26010-Pro 处理器节点,峰值 FP64 性能 1481.05 Pflop/s,仅次于 Frontier 的 1821.84 Pflop/s。分析师认为,在实际任务中芯片需要大量的优化工作,它的纸面计算性能很强,像是为了完成某个指标,而不是为了更快解决现实中的计算问题。