文章提交注意事项:
请在发布文章时用HTML代码加上至少一条新闻来源的链接;原创性消息,可加入相关信息(如涉及公司的网址)的链接。有任何问题,邮件至:he.fang#zhiding.cn
注意:收到邮件乱码的用户请修改客户端的默认字体编码,从"简体中文(GB2312)"修改为"Unicode(UTF-8)"。
solidot新版网站常见问题,请点击这里查看。
Solidot 公告
投 票
热门文章
-
- 微软放弃封禁 Microslop (0)
- 部分三星智能冰箱在升级固件之后停止工作 (0)
- 蝙蝠起源于欧洲 (0)
- F-Droid 2.0 发布 (0)
- 中国各地推动 AI 视频产业化 (0)
- 全球平均气温每上升 1C 德国夏天气温上升 2.62C (0)
- 大象使用药用植物治疗自己 (0)
- 黑手党可能阻止了芬太尼流入意大利 (0)
- Velum:方便部署的CosyVoice推理程序 (0)
- YouTube、TikTok 和 Meta 都拒绝投放马斯克纪录片的商业广告 (0)
热门评论
- 很正常 (1 points, 一般) by Craynic 在 2026年07月27日13时22分 星期一 评论到 古代语言的多样性远超今日
- 发电不需要油吗 (1 points, 一般) by Craynic 在 2026年06月03日13时51分 星期三 评论到 能源危机推动 37 个国家的电动汽车销量创新高
- 所以firefox 已经路边一条,对用户的需求漠视的结果就是这样了 (1 points, 一般) by solidot1745479987 在 2026年04月20日11时14分 星期一 评论到 Firefox 加入了对 Web Serial API 的支持
- (1 points, 一般) by solidot1775703930 在 2026年04月09日11时09分 星期四 评论到 Sam Altman 能被信任吗?
- 很难想象现代Linux居然还能跑在i486上 (1 points, 一般) by Craynic 在 2026年04月07日19时41分 星期二 评论到 Linux 准备移除对 i486 CPU 的支持
- 很多单词已经不再实用 (1 points, 一般) by Craynic 在 2026年04月07日13时22分 星期二 评论到 人们日常说话的单词量比上一年减少 300 个单词
- 表示方向不还是得有那么多个维度吗 (1 points, 一般) by Craynic 在 2026年03月30日13时35分 星期一 评论到 Google TurboQuant AI 压缩算法大幅减少大模型内存使用
- sora的核心用户是内容创作者 (1 points, 一般) by Craynic 在 2026年03月27日13时16分 星期五 评论到 Sora 为何失败:每天推理成本最高 1500 万美元总收入仅为 210 万美元
- 夏天骑摩托的时候,最喜欢带着有线耳机听相声或小说 (1 points, 一般) by kracker1911 在 2026年03月17日09时36分 星期二 评论到 有线耳机销量暴增
- 不如用网易邮箱 (1 points, 一般) by Craynic 在 2026年03月10日11时20分 星期二 评论到 FBI 通过 Proton Mail 识别抗议者身份
Nala Ginrut 写道:
HardenedLinux 最近发布了可用于推理CosyVoice的Velum,它用modern C++开发,编译成一个单一的可执行文件,方便部署。
CosyVoice是目前比较优秀的一款 TTS 模型,但其推理程序使用的Python体系比较老旧,需要在部署的时候做一些处理,而且Python依赖占用空间较大,不利于大量能力情况下的Agent部署。要是每个agent能力都要一堆Python十几G的依赖,每一堆还有版本冲突,那就不要卖产品了,不如回家卖红薯。 Velum编译之后只有一个可执行文件,所谓部署更新就是拷贝。一些预处理的模型相关的东西虽然需要用Python生成,但运行时是不需要任何Python的东西。
Velum同时也是一个例证,它是由人类做架构规划,DeepSeek-v4-pro完成的项目,也就是说,DeepSeek足以做这种程度的Vibe。在目前Claude只需要两轮配额就烧干的今天,稍微复杂点的程序,如果不能用DeepSeek做,最后还是要回家卖红薯。
希望以后Codex和Claude也能增强自己的竞争力,把价格向DeepSeek靠拢,让天下无红薯可卖,也未尝不是一件美事。
CosyVoice是目前比较优秀的一款 TTS 模型,但其推理程序使用的Python体系比较老旧,需要在部署的时候做一些处理,而且Python依赖占用空间较大,不利于大量能力情况下的Agent部署。要是每个agent能力都要一堆Python十几G的依赖,每一堆还有版本冲突,那就不要卖产品了,不如回家卖红薯。 Velum编译之后只有一个可执行文件,所谓部署更新就是拷贝。一些预处理的模型相关的东西虽然需要用Python生成,但运行时是不需要任何Python的东西。
Velum同时也是一个例证,它是由人类做架构规划,DeepSeek-v4-pro完成的项目,也就是说,DeepSeek足以做这种程度的Vibe。在目前Claude只需要两轮配额就烧干的今天,稍微复杂点的程序,如果不能用DeepSeek做,最后还是要回家卖红薯。
希望以后Codex和Claude也能增强自己的竞争力,把价格向DeepSeek靠拢,让天下无红薯可卖,也未尝不是一件美事。
两年前 Zhu Zhili 选择了深圳作为其 AI 电影工作室的办公地点,今年他接到了来自中国各地政府和产业园官员的电话,内容基本相同,即希望将 AI 电影业务带到当地。中国各地正在推动 AI 视频的产业化,类似太阳能、电动汽车和机器人。AI 电影制作人表示,低廉的制作成本是吸引他们投身 AI 创作的主要原因。CCTV 报道 2026 年上半年,AI 短剧的制作成本从每分钟 5,000 元降至几百元。可能和太阳能等领域一样,AI 视频行业也正面临产能过剩。DataEye 的数据显示,今年上半年,抖音上推出了 221,900 部新 AI 视频,其中只有 1,055 部播放量逾 1 亿次。国家电影局已向 90 分钟科幻史诗片《三星堆未来启示录》颁发公映许可证,这是中国大型制片厂制作的首部获批在院线上映的 AI 电影,出品方博纳影业集团表示影片计划于今年上映。
Anthropic 声称其模型 Claude Mythos 在发现软件漏洞上胜过大多数安全专家。随后发生了 OpenAI–Hugging Face 安全事件,此后 Anthropic(自豪)和 Meta(不情愿)也披露了各自模型的类似事件。紧接着 Anthropic 宣称其模型取得了数学领域的突破;OpenAI 也声称自己取得了数学突破。Anthropic 工程师 Jacob Coxon 在宣布离职时引发了广泛关注,他声称该公司与 OpenAI 正“冲向自我进化的超级智能,并拿我们的生命在赌博”。媒体大肆报道了这些事件,且沿用了相关公司赋予其软件的拟人化叙事——即把软件描绘成不仅功能强大,而且已初具通用人工智能(AGI)雏形的产物。但深入研究的专家则给出了不同的答案,虽然这些发现并不能吸引眼球。网络安全专家指出,涉及模型的安全事件更多是 OpenAI 的疏忽大意,未能采取基本的安全措施,而不是“模型失控”或“AI 智能体创造文明”。OpenAI 模型在解决数学难题上的突破其原创性也相当可疑。数学家公开对 AI 企业利用其专业领域进行炒作提出了警告。AI 公司通过炒作模型失控也将自己置身事外,将责任归咎于大模型而不是公司本身,逃避应承担的责任。以 OpenAI 为例,当该公司开发的恶意软件被用于入侵另一家公司时,媒体、名人和议员谈论是“失控模型”而不是 OpenAI 的责任,仿佛大模型真的会自动发动攻击,公众的注意力被转移到虚构的“超级智能”的恐惧之上。我们不要被 AI 公司的炒作所愚弄。
英国竞争监管机构 CMA 想要让 Android 和 Chrome 用户对 AI 助手和搜索引擎有更大的选择权和控制权。CMA 公布了一份提案,要求 Google 在用户首次设置 Android 手机或打开 Chrome 浏览器时,向其展示多种搜索引擎供选择,并且每年提示用户选择一个默认搜索引擎;符合技术与安全标准的 AI 助手也必须获准出现在选择屏上上。该提案目前进入公众咨询阶段,截止日期为 10 月 9 日,CMA 预计将在今年底前做出最终决定。
丰田的员工正在帮助训练人形机器人,它计划未来几年部署 40 万台工厂机器人,人形机器人是其中的一部分,但高管否认它们会替代人类员工。丰田在装配线上部署了 ELEY 人形机器人,而员工则通过佩戴基于机器人手指的装置去训练这些通过轮子移动的机器人执行需要精细手部动作的任务。丰田是全球最大的汽车公司之一,在全世界有 60 座工厂,雇佣了 1.8 万员工。丰田执行副总裁 Hiroki Nakajima 表示,公司的目标是创造一个“机器人与人类共存,而非取代人类”的世界。根据国际机器人联合会的数据,仅 2024 年中国就部署了 200 万台工业机器人,日本以 45.05 万台位居第二。美国和韩国分别以 3.42 万台和 3.06 万台的部署量排名第三和第四。
阿里巴巴 CEO 吴泳铭在阿里云年度云栖大会上透露,该公司的千问(Qwen)团队正持续研究模型架构与数据优化,目标是完成更复杂、长周期任务,向人工智能超级智能(artificial superintelligence)前进。阿里巴巴的旗舰模型 Qwen 3.8 Max 有 2.4 万亿参数,正在训练中的 Qwen 4 将会继续扩大参数规模,未来的 Qwen 4.5 和 Qwen 5 系列将扩大至 5-10 万亿参数规模。吴泳铭表示,阿里巴巴自研的 M890 AI 超级节点能处理参数规模逾 2 万亿模型的推理任务,新一代的真武 V900 性能三倍于上一代的 M890,预计于 2027 年第一季度量产。
Saturn 的一项研究显示,ChatGPT、Claude、Copilot、Grok 和 Gemini 等主流 AI 模型在回答财务相关问题时,平均有 57% 会给出错误答案。研究使用了逾百个财务相关问题,分别测试了 ChatGPT、Gemini、Claude 和 Copilot 提供的免费及付费 AI 模型。每个问题最多重复提问五次,向 18 种 AI 模型共提出了逾 10,000 个问题。研究发现,AI 模型的回答中包含计算错误、遗漏即将实施的税收政策变更,或是凭空捏造规则(即幻觉)。在最严重的情况下,依赖 AI 对税务问题的回答可能导致严重的经济损失。研究发现,付费模型的回答比免费模型更准确,较新的模型表现优于较旧的模型。表现最好的是推理模式的 Claude Opus 5,但仍然有 39% 的答案存在错误。
在开发者发现 ZCode 会将用户整个工作区打包上传后,AI 公司智谱推出数据不留存功能。智谱星期天晚在微信公众号宣布,其“模型即服务”(Model as a Service,MaaS)平台将于近期正式推出“数据内容不留存”功能,将不对用户的模型调用输入、输出内容进行任何形式的静态存储,数据仅在当次调用过程中临时使用。企业和开发者用户可通过智谱 Maa S控制台提交开通申请。零数据留存即用户提交给模型的提示词(Prompt)、模型返回的生成结果,仅在服务器内存中参与当次推理计算;一旦请求处理完成,相关数据不会存储,也不会被用于模型迭代训练。智谱同时明确,数据不留存机制存在两种例外情况。一是由产品形态决定的功能型存储,包括 Batch API(批处理接口)、Files API(文件管理接口),其存储逻辑由产品特性需求决定。另一类是合规性,根据国家法律法规要求,或为核查涉嫌违规、滥用服务的行为,平台可能留存对应数据 30 天及以上。
微软利用使用 GPT-5.6 Sol 和 Claude Opus 4.8 的 AI 智能体、历时 14.5 周,花费 12 万美元 token 将 Copilot 运行时从 TypeScript 语言移植到 Rust 语言。该项目采用逐个更新运行时模块的方式执行,共进行了 135 次发布,平均每天提交约 1.3 个 Pull Request,最终将 43 万行 TypeScript 代码转换为 80 万行可用于生产的 Rust 代码。测试显示,原 TypeScript 代码每秒能完成 7.55 个生命周期(one-turn session lifecycles),而 Rust 代码每秒 120 个——意味着在特定工作负载下速度提升了 15.9 倍。包含 10 个客户端的智能体在 TypeScript 语言下消耗了 1383 MB 内存,而 Rust 语言版本仅消耗了 126 MB。Rust 版本将任务保持在进程内执行,无需像 TypeScript 版本那样启动外部后台进程完成任务。
根据内部文件,微软应用科学总监 Brent Hecht 警告,抓取新闻内容训练 AI 是一次规模空前的盗窃,可能是人类历史上最大规模的劳动成果盗窃。他不认为抓取新闻内容训练 AI 是合理使用,认为这种做法完全是对合理使用理念的嘲弄。微软的另一份文件认为会形成“恶性循环”,会同时伤害模型和整个 Web。OpenAI 的产品如 ChatGPT 可能会危及新闻出版商的经济基础。OpenAI 和微软的数据都显示这一预测是正确的。微软的数据指出,部分新闻出版商网站的点击率下降了 83%-93%,其它新闻机构的点击率下降了 51%-94%。Hecht 承认,“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。”微软 CEO 纳德拉(Satya Nadella)在作证时表示,AI 公司不应该通过绕过付费墙违反新闻网站的使用条款。但 OpenAI 的内部信息显示,当一名员工通知总裁 Greg Brockman OpenAI 爬虫找到了绕过《纽约时报》付费墙的漏洞时,Brockman 表示好极了。
日本计算机娱乐协会(Computer Entertainment Supplier's Association )的年度行业报告《Video Game Industry Report》显示,85.8% 的日本游戏开发者在工作中使用生成式 AI——63% 的开发者表示每天都在使用,22.8% 的开发者则是偶尔使用,去年这一比例是 51%。开发者使用生成式 AI 最主要是为了“改进运营效率与生产力”,其次是“缩短开发周期”以及“降低开发与运营成本”。多数受访者表示不会直接使用 AI 生成内容。报告称,AI 最常见用途是生成视觉素材和图像,其次是故事和文本生成,最后是编程辅助。32% 的游戏公司利用 AI 协助开发自研游戏引擎。Capcom 工程师称,AI 技术主要是用于减少“日常任务”,称最聪明的 AI 在感性上也无法与创作者相比拟。
陈奕龙有 20 年出演影视剧的经验,由于工作机会日益稀少,他在 8 月与一家 AI 工作室签约,授权对方使用其面部肖像。陈奕龙的工作就是坐在摄像机前,根据导演的指令做出不同面部表情——如无表情凝视、怒视或惊讶。这家工作室将利用 AI 技术,以陈奕龙的面部图像为基础生成虚拟数字人,让其主演一部由 AI 生成的电影。现年 38 岁陈奕龙说道,“如果你无法战胜它,那就加入它。”雇佣陈奕龙的是总部位于深圳的 Feixiang Universe 工作室,创始人 Sun Wei 表示,之所以为一部唐朝背景的 AI 电影项目获取真人肖像授权主要是担心无意中窃取他人肖像。她指出,受 AI 训练数据偏差的影响,AI 生成的演员通常面部特征相似,长相千篇一律。这促使她和其他中国 AI 电影制作人去搜寻和购买新面孔,将演员的真实表情数字化。根据广电总局的数据,今年首八个月,中国上线微短剧共 43 万部,是去年全年的 13 倍,其中 AI 剧占比超过九成。Sun Wei 的团队则计划以 50 万美元的预算制作一部 90 分钟的 AI 长片。
被现代商船逐渐淘汰的风帆正以新的形式再次回归。散货船、油轮到集装箱船等各类商船正在安装高耸的转子帆、刚性翼帆以及吸风式推进系统。此举并非是要将现代船舶重新变成帆船,而是让基于风帆的系统与现代推进系统协同合作,在条件允许时利用风力降低油耗。International Windship Association 协会的数据显示,已有逾百艘大型商船配备了现代风力推进系统,总载重吨位逾 500 万吨。Maersk 公司计划在一艘有 8700 个标准箱的集装箱货船上安装一座 35 米高的转子帆,预计于 2027 年在大西洋常规航线上启动测试。它有望成为第一艘安装转子帆的集装箱货船。Vale 旗下一艘载重吨位达 40 万吨的巨型矿砂船 Sohar Max 已经安装了五座 35 米高的转子帆,风帆系统将油耗降低多达 6%。韩国船舶制造公司最近宣布研究在液化天然气货船(LNG)上安装风帆系统。如果研究取得成功,那么将进一步证明风帆技术重新迈向主流。
法国 AI 公司 Mistral 与 Mozilla 合作推出注重隐私保护的 AI 浏览助手 Firefox Smart Window(beta)。Smart Window 使用了 Mistral 的开放权重模型,能帮助用户梳理复杂搜索,记住浏览过的重要信息,根据当前标签页查找关键信息,目前主要为法国和北美用户提供服务,今年晚些时候会扩大到英国和德国用户。Smart Window 的对话内容默认不会存储在 Mozilla 的服务器上,Mistral 等合作伙伴也承诺不保留任何数据。
Mozilla 发表《State of Open Source AI》报告,称美国科技公司的前沿 AI 模型性能仅领先中国公司最优秀的开放权重模型 4.4 个月。由于前沿模型价格更昂贵,很多公司都将开放权重模型用于处理日常工作,将前沿模型用于处理特定工作负荷。美国闭源前沿模型优势主要在于专家级专业工作、高强度检索以及长上下文。
配送公司 DoorDash 将月之暗面的 Kimi 模型用于处理日常工作,将 Anthropic 的闭源模型 Fable 用于更复杂的任务。前沿模型完成一项任务的成本经常达到了最先进开放权重模型的五倍。
今天有无数开发者在 LLM 帮助下编写程序,其中包括了开源开发者。那么 Android FOSS 应用商店 F-Droid 中 AI 辅助开发应用的比例有多高?一位 FOSS 维护者对 9 月 12 日 F-Droid 推送更新的 102 款应用及其代码库进行了分析,发现其中 74 款应用(72.5%)主要是 AI 编写的,10 款应用难以明确归类(9.8%),
18 款应用几乎没有 AI 参与的迹象(17.6%)。有 4 个托管在 Codeberg 上的应用主要是 AI 编写的,而 Codeberg 最近宣布了 AI 政策,禁止了此类 AI 应用,但要清除此类应用显然需要更多时间。
西南联合研究生院与云南大学研究员研究员张文华与合作者研究表明,太阳能电池可在南海海面下 10 米处正常运行,可在水下工作两小时,可产生 324 兆瓦时的电能,足以给锂离子电池充电;若持续置于 10 米水深的环境中,其运行寿命可达约 5.5 年。这些发现表明,水下太阳能电池有望为远离陆地的水下传感器、摄像头和通信系统提供动力。尽管太阳能电池早已能够为陆地上的各类技术提供绿色能源,但由于阳光在水下短距离内就会迅速衰减,研究人员一直难以在海底收集太阳能,用于水产养殖监测及其他用途。为克服这一难题,张文华团队首先开发了一套定制化的实验室系统,配备定制的光学滤光片,以模拟不同水深下的光照条件。研究人员开发的高效宽能带隙浸没式太阳能电池,能够吸收从蓝光到橙光的光谱。将电池在充满氮气的手套箱中储存 300 天后,其效率仍保留了初始值的约 96%。此外,在模拟 10米 水深条件下运行 1160 小时后,电池几乎未出现性能衰减,表明其在水下具有卓越的耐久性。研究团队将钙钛矿太阳能电池与水下机器人集成,并将其部署在南海涠洲岛附近 10 米水深处,以测试其实际应用性能。
微软上周推送了 9 月份的例行安全更新,修复了近千个 bug。一周后,微软证实这次更新又给用户带来了一系列新 bug:Windows 11 26H1 和 Windows Server 2012 等多个 Windows 版本的远程桌面服务(RDS)出现问题; Windows 11 26H1、25H2 和 24H2 版本对 USB Audio Class 1.0 设备的支持出现问题,受影响的用户可能会遇到无音频输出、声音设置和音量控制失效,多声道音频问题;对电子表格 Excel 的 bug 修正导致粘贴功能失效。
微软表示它正在着手修复新 bug,但没有给出修复时间。
律师在法律文件中使用 AI 工具捏造不存在的信息不是什么大新闻,AI 捏造的通常是不存在的案例,然而本案的特殊之处在于 AI 捏造了证词。律师 Stephen Aaron 在一起谋杀案中代表其客户提起上诉,在递交的法律文件中包含了捏造的警方证词以及虚构的证人。Aaron 声称他将一份由计算机生成的庭审记录及其它案卷材料输入了 ChatGPT,想当然地认为它会生成一份“无懈可击的摘要”。他不清楚 AI 工具会产生“幻觉”——即虚构信息。
法官对此难以置信,反问他没看新闻吗?法官对他处以 5000 美元罚款,将把他移交至律师纪律委员会进行调查。
今天越来越多的汽车都配备了中央显示屏,厂商也将越来越多的功能整合到触摸屏控制系统中。但中国工信部起草了新规定,要求新车恢复提供关键功能的物理控制。新规将于 2027 年 7 月 1 日生效,增加了对实体控制的要求,明确规定物理控制应易于触及和使用,支持在驾驶过程中进行盲操作——即驾驶员无需视线注视即可操作相应的按键与开关。将雨刷器启动、转向灯控制等功能从触摸屏中剥离出来,旨在减少驾驶员在行车过程中注视并操作屏幕而产生的分心。奔驰等汽车厂商也开始重新引入物理按键。