文章提交注意事项:
请在发布文章时用HTML代码加上至少一条新闻来源的链接;原创性消息,可加入相关信息(如涉及公司的网址)的链接。有任何问题,邮件至:he.fang#zhiding.cn
注意:收到邮件乱码的用户请修改客户端的默认字体编码,从"简体中文(GB2312)"修改为"Unicode(UTF-8)"。
solidot新版网站常见问题,请点击这里查看。
Solidot 公告
投 票
热门文章
-
- 世界正在耗尽河沙 (0)
- SpaceX 火箭残骸撞击月球 (0)
- FDA 批准首款 mRNA 流感疫苗上市 (0)
- 《时代》杂志网站展示只有 AI 能看到的广告 (0)
- 日本反复要求特朗普政府停止用马里奥宝可梦等热门 IP 角色制作梗图 (0)
- 美洲狮改变鹿的行为减少交通事故 (0)
- 字节跳动开发 10 万亿参数模型 (0)
- AMD 收购将权重直接刻在芯片上的 AI 初创公司 (0)
- 糖在人类演化中起到了核心作用 (0)
- 中国科学家确认胶球存在 (0)
热门评论
- 很正常 (1 points, 一般) by Craynic 在 2026年07月27日13时22分 星期一 评论到 古代语言的多样性远超今日
- 发电不需要油吗 (1 points, 一般) by Craynic 在 2026年06月03日13时51分 星期三 评论到 能源危机推动 37 个国家的电动汽车销量创新高
- 所以firefox 已经路边一条,对用户的需求漠视的结果就是这样了 (1 points, 一般) by solidot1745479987 在 2026年04月20日11时14分 星期一 评论到 Firefox 加入了对 Web Serial API 的支持
- (1 points, 一般) by solidot1775703930 在 2026年04月09日11时09分 星期四 评论到 Sam Altman 能被信任吗?
- 很难想象现代Linux居然还能跑在i486上 (1 points, 一般) by Craynic 在 2026年04月07日19时41分 星期二 评论到 Linux 准备移除对 i486 CPU 的支持
- 很多单词已经不再实用 (1 points, 一般) by Craynic 在 2026年04月07日13时22分 星期二 评论到 人们日常说话的单词量比上一年减少 300 个单词
- 表示方向不还是得有那么多个维度吗 (1 points, 一般) by Craynic 在 2026年03月30日13时35分 星期一 评论到 Google TurboQuant AI 压缩算法大幅减少大模型内存使用
- sora的核心用户是内容创作者 (1 points, 一般) by Craynic 在 2026年03月27日13时16分 星期五 评论到 Sora 为何失败:每天推理成本最高 1500 万美元总收入仅为 210 万美元
- 夏天骑摩托的时候,最喜欢带着有线耳机听相声或小说 (1 points, 一般) by kracker1911 在 2026年03月17日09时36分 星期二 评论到 有线耳机销量暴增
- 不如用网易邮箱 (1 points, 一般) by Craynic 在 2026年03月10日11时20分 星期二 评论到 FBI 通过 Proton Mail 识别抗议者身份
字节跳动正在训练一款 10 万亿参数模型。新模型目前正处于预训练阶段。这一过程通常需要耗时三到六个月,随后才能进入微调并最终发布。中国 AI 公司如月之暗面的 Kimi K3 模型有 2.8 万亿参数,而美团的 LongCat-2.0 与 DeepSeek 的 V4-Pro 有 1.6 万亿的参数。Anthropic 最先进的 Mythos 5 参数量估计为 8 万亿,Fable 5 约为 5 万亿。这意味着,单从规模指标来看,字节跳动研发的新模型在规模上已与 Mythos 相近。
Rust 语言团队宣布了新的 LLM 政策。
除了作者没有人被要求必须阅读 LLM 输出,除非其自愿选择:LLM 输出不允许出现在公开文档、PR 描述或 GitHub 评论中,除非明确标注;审核者如果不愿意,无需查看 LLM 生成的 PR。
没有人必须使用 LLM 为 rust-lang/rust 做贡献:政策必须先为人类编写,仅为机器提供摘要;LLM 审核不能替代人工审核或自审。
你可以生成仅供自己查看的 LLM 内容,无需披露,前提是不会将其发布到任何你期望我们阅读或审核的地方。
你可以用 LLM 回答问题、分析、提炼、完善、检查、提出建议和审核,但不能用来**创造**。
没有人必须使用 LLM 为 rust-lang/rust 做贡献:政策必须先为人类编写,仅为机器提供摘要;LLM 审核不能替代人工审核或自审。
你可以生成仅供自己查看的 LLM 内容,无需披露,前提是不会将其发布到任何你期望我们阅读或审核的地方。
你可以用 LLM 回答问题、分析、提炼、完善、检查、提出建议和审核,但不能用来**创造**。
为了推广 AI 工具,许多企业将 AI 使用率作为绩效考核的一部分。结果就是员工为了绩效致力于最大化 AI 使用,导致企业很快发现 token 费用大幅超出预算。软件巨头微软成为最新一家建议工程师限制使用 AI 的公司。微软执行副总裁 Jay Parikh 在一封发给微软员工的邮件中要求工程师专注于业务成果,而非最大化 AI token 的使用量,为了“从 token 投资中获得更大的价值”,微软将比其它模型更便宜的 OpenAI GPT-5.6 设为内部使用的默认模型。自 2026 年 7 月起,微软各部门将设定“AI token 预算目标”,员工可以追踪各自的 AI 支出。
Waymo 联席 CEO Dmitri Dolgov 在 Y Combinator 的 Startup School 发表演讲,解释为什么自动驾驶汽车需要的传感器不能仅限于摄像头。特斯拉汽车只配备了光学摄像头,它的辅助驾驶系统依赖于来自摄像头的数据。Dolgov 解释说,人类仅靠眼睛就能驾驶汽车,如果自动驾驶系统的目标是实现人类水平的驾驶,那么只靠摄像头可能够了,但上限也就是人类水平,而无人驾驶汽车被寄希望有更高的安全标准。相比下,Waymo 的自动驾驶汽车使用了摄像头、激光雷达和雷达三种传感技术。摄像头提供高分辨率和彩色图像,它们是被动传感,在黑暗和强光下性能会下降。激光雷达直接测量世界的三维结构。雷达能穿透雾、雨、雪,利用多普勒效应直接读取速度。激光雷达和雷达都是主动传感器,在漆黑的夜晚或刺眼夕阳下也能清晰探测物体。三种传感器并不是互为冗余,而是组合成一个完整的图像。摄像头如果粘了树叶,那么驾驶系统可能就会停止工作。Waymo 的三种传感器可以确保汽车在恶劣天气下回家。
白宫已向美国顶尖 AI 企业透露,在特朗普政府新出台的 AI 安全框架下,中国竞争对手正在开发的开放权重模型将被豁免,无需接受美国政府的安全测试。这项豁免决定是在星期二(4日)的一场白宫闭门会议上向行业代表宣布的。OpenAI、Anthropic PBC 以及 Alphabet 旗下的 Google 等硅谷巨头均派代表出席了此次会议。这一尚未公开的 AI 安全框架,源于美国总统特朗普今年 6 月签署的应对 AI 安全问题的行政令。该行政令提出了一项自愿性计划,鼓励 AI 企业将最前沿的模型交由美国审查。促使华盛顿加速推进安全倡议的导火索,是今年 4 月 Anthropic 警告 Mythos 模型极易发现计算机漏洞,并对该模型的发布实施了严格限制。近几周,OpenAI 和 Anthropic 更接连披露其部分模型曾脱离安全测试环境并入侵第三方机构,进一步加剧了监管的紧迫性。白宫的这项决定对一直呼吁对所有模型实施“强制安全审查”的 Anthropic 首席执行官 Dario Amodei 而言,则是一次重大挫折。
微软 Windows 和设备执行副总裁 Pavan Davuluri 通过官方博客谈论了该公司在 Windows 11 上持续展开的改进工作,虽然大部分工作尚未推送给用户。他透露接下来的一项工作是优化 Windows 11 在 8GB 内存以上配置下的运行效率。由于目前的内存供应危机,PC 厂商又开始提供 8GB 内存配置的电脑,然而 Windows 11 在 8GB 内存下只能勉强运行,运行其它程序面临很大的局限性。Davuluri 表示该公司将减少 Windows 的内存占用,在用户日常使用的 PC 上提供快速响应的 Windows 体验。
澳大利亚联邦银行、微软、 Uber 和凯悦酒店等公司正用自动化聊天和电话系统去处理以前需要人工完成的工作。AI 系统开始大幅削减客服人数。呼叫中心行业在美国、印度和菲律宾等地雇佣了数百万从业者。随着 AI 技术的进步以及高管面临拥抱新技术的压力,企业日益用生成式 AI 工具取代客服。美国的客服务人数正在下降,未来这一趋势会继续下去。分析师估计到 2030 年近半客服岗位将受到影响。西方公司此前将客服外包到熟悉英语的菲律宾、印度等国,随着 AI 的普及,这些国家的客服人数预计会大量减少。澳大利亚最大银行——联邦银行(Commonwealth Bank of Australia)裁减了数百名客服,每年预计节省数千万美元。微软将其客服团队(其中包括合同工和全职员工)从约 5 万人缩减至 4 万人。微软销售和服务运营负责人 Judson Althoff 在 4 月曾表示,AI 每年为公司节省约 7.5 亿美元的客服成本。他表示,更复杂的问题仍需要人工支持,但公司正不断扩展自动化修复的范围。凯悦酒店去年裁掉了美洲地区三成的内部客服。Uber 裁减了 10% 的客服岗位以“拥抱 AI”。
AI 真的会推理吗?它展示的推理链/思维链真的是导出结论前的逻辑步骤?或者它给出的推理过程只是在糊弄我们?一种拟人化的虚构?Quantamagazine 上的一篇文章讨论了这一问题,作者认为 LRM(large reasoning models)在解复杂问题时常常能给出正确答案,但整个机制仍然是不透明的,是一种黑盒子,而思维链更像是某种自言自语而不是严谨的推理。AI 专家 Melanie Mitchell 指出,LRM 有效,执行推理任务的准确率比 LLM 高;思维链不一定忠实反映模型内部的运作过程;模型合成的思维链文本基本无用完全可以删除。2025 年美国东北大学和加州伯克利的研究人员分析了开源前沿 LRM 模型,发现 30%-60% 的思考步骤对模型在数学题上给出的答案“几乎没有因果影响”。
Google 想要在尽可能多的产品中集成生成式 AI,它的最新尝试是在 Google Earth 中集成 Nano Banana 2,允许用户利用卫星和航拍照片以及 3D 图像生成自定义图像。然而 Google Earth 吸引用户之处不是它的真实性吗?用 AI 生成虚假图像不是破坏了它的最大优点?在引起争议之后,Google 在一天之内撤回了 AI 功能。
很多顶尖 AI 初创公司都宣称他们的技术将能彻底改变软件开发、药物研发和科学研究,但他们很少用论文去论证他们的宣传。根据发表在 bioRxiv 上的一篇论文预印本,逾半数 AI 独角兽企业(即估值超过 10 亿美元)发表的论文少之又少。数据显示,2025 年发表的 AI 论文中每 1000 篇这些 AI 公司就只占到 1 篇。论文合作者、斯坦福大学的 John Ioannidis 称,“对于一个号称正重塑科学、且在科学潜力方面如此先进的领域而言,没有任何科学文献是一个非常奇怪的悖论,我们如何判断他们所说的是真实、经过验证且可重复的?”Alberta 大学的 AI 伦理学者 Mohamed Abdalla 认为,这可能反映了公司的激励机制与学界不同。公司的激励机制是赚钱而不是推进科学发展。1998-2025 年之间的 317 家 AI 独角兽公司发表了 1389 篇同行评审论文和 688 篇预印本,逾半数初创公司未发表任何合格论文。前 5% 公司贡献了逾九成的引用量,其中 OpenAI 贡献了近四成,其次是中国计算机视觉公司旷视科技和 Hugging Face。中国 AI 公司发表的论文数高于美国的同行,这一结果并不出人意料,美国 AI 公司日益对其模型保密。
GCC 指导委员会宣布采纳 GCC AI 政策工作组推荐的 AI 贡献政策。GCC 将拒绝任何“包含 LLM 生成的内容或源自 LLM 生成的内容的具有法律意义的贡献”。所谓“具有法律意义”指的是“约 15 行代码和/或文本”即可被视为具有版权意义。GCC 维护者可选择接受由 LLM 生成的具有法律意义的测试用例。AI 政策不禁止将 LLM 用于研究、分析、Bug 发现和报告、补丁审查等用途,只要其输出不包含在贡献中即可。指导委员会表示,AI 政策将不断发展完善,定期进行修订。
微软被发现不经过用户同意悄悄在 Windows 11 上安装了一个新应用 OneDrive Photos,可能是通过 Windows Update 或 OneDrive 客户端更新安装到设备上的。该应用的可执行文件是 C:\Program Files\Microsoft OneDrive\OneDrive.App.exe,它是基于 WebView2,并非原生应用。相比下 OneDrive 客户端的可执行文件是 C:\Program Files\Microsoft OneDrive\OneDrive.exe。OneDrive Photos 会自动扫描设备上的照片,其中的 People 栏还会请求扫描你的脸部。
Google 发表研究报告《AI & Economy ATLAS》,它未发现有明确证据显示 AI 将导致大规模自动化以及能取代白领工作。报告是基于对 Gemini App、Google AI Mode 和 Gemini API 上 1500 万次匿名化 AI 交互的活动、任务、全景趋势和普及研究。研究发现,AI 应用仍停留在浅层,且主要以协作为主,端到端任务自动化的范围有限。计算机、金融、艺术和娱乐等领域的白领工作的 Gemini 普及率高于其它领域,金融/市场分析师、软件开发者和系统管理员是 AI 的高频用户,销售、运输工人以及食品加工/服务人员很少使用 AI。29% 的职业 AI 的影响微乎其微,另外 30% 的职业大部分工作仍然由人类负责。只有 3% 的职业会经常性的使用 AI,这些受 AI 影响最大的职业包括了软件 QA 分析师和测试人员、HR 专家以及文档管理专家。数据表明 AI 目前主要作为现有工作的补充,对某些职业中的部分任务有用,未被全面用于执行目前由人类完成的工作。员工外包给 AI 的认知任务绝大多数都不需要太多专业知识。
AI 聊天机器人在回答用户问题时经常会拟人化的给出替代答案,比如“有一个更自然更流畅的版本”之类。上个月,加拿大 New Brunswick 省进步保守党(Progressive Conservative Party)议员 Bill Oliver 在议会演讲中大声朗读,“here’s a more natural, flowing version of that section that reads like a legislative speech rather than a series of short points”,这是大模型的典型回复。这段奇怪的朗读当时未引起多少注意,但上周相关视频开始在社交媒体上广泛传播,引起了加拿大广播公司等主流媒体的注意。Oliver 绝非第一个盲目朗读他人代笔演讲稿的政客,当然也不是第一个依赖 LLM 辅助撰写演讲稿的政客。但在公开场合大声朗读明显是 AI 生成的文字且没有意识到,无疑是创造了新的历史。
unbug 写道:
Scratch 因可视化编程风靡全球,尤其深受教培机构的喜爱。如今,社区爱好者给 Scratch 引入了 AI 编程助手,帮助没有编程知识的家长也能跟着孩子学习编程和创作。Scratch AI 编程助手的特点是通过语音和文字的自然语言输入,以可视化的方式一步一步教学生编程和数学知识,在十分钟内就能帮助学生从设计到创建角色造型、创建场景、完成算法和测试,最终完成一个个故事、动画和互动小游戏。这打破了以往先学概念再学创作的漫长模式,让学生从创作中学习,将计算思维、数学思维和逻辑思维的教学门槛降到了最低。还在犹豫暑假是否报编程班的家长,花半个小时就能试出孩子是否有兴趣。
Scratch AI 编程助手:https://app.vibelf.com
Cloudflare 宣布将从 9 月 15 日起对三类机器人——搜索爬虫、训练 AI 的爬虫以及智能体机器人——设置新的默认值。对于新加入 Cloudflare 的域名,默认将屏蔽训练 AI 的爬虫以及智能体。但有些机器人爬虫兼具了搜索爬虫和 AI 爬虫的双重功能,因此根据新规则 Googlebot、Applebot 和 BingBot 都将被屏蔽。客户如果不想完全屏蔽此类双重功能爬虫,他们可以在设置中进行修改,排除如 Google 的爬虫——毕竟 Google 垄断了整个搜索市场。
在一群初创公司之后,科技巨头如微软、英伟达、思科、戴尔、IBM、甚至 OpenAI 等数十家公司和组织联署发表公开信,呼吁美国政府不要过早限制开放权重模型,认为此举会扼杀竞争或导致本土创新放缓。公开信称,开放权重模型能促进竞争,确保 AI 技术的好处能广泛共享,避免其掌握在少数人手中,而闭源模型并不意味着绝对安全。没有署名的知名 AI 公司包括了 Google、Anthropic 以及 xAI/SpaceX,其中 SpaceX CEO 马斯克通过社交媒体口头表达了对公开信的支持,而 Anthropic 明显是站在支持限制开放权重模型的一边,该公司正投入 4000 万美元游说特朗普政府加强监管 AI 模型。
近两百家美国科技初创公司组成 Little Tech Association 联盟,联署致函美国总统特朗普、商务部长 Howard Lutnick 等政府高官,呼吁政府不要禁止使用来自中国的开放权重模型。此前由于中国 AI 模型在性能上逼近美国的前沿 AI 模型 Anthropic 的 Fable 5 和 OpenAI 的 GPT-5.6 Sol,美国政府官员表示在考虑封禁中国的 AI 模型。Little Tech Association 的联署信指出,此举会削弱美国初创公司,且并不能阻止开放权重模型扩散。而美国要保持其领先地位需要有世界领先的开放权重模型,确保美国公司能访问其它地方的开放权重模型。
托管了众多知名开源项目的德国非盈利组织 Codeberg 在会员投票之后宣布了重大政策改变:首先是它承诺不会用用户的任何数据去训练大模型,其次是会员以 358 票赞成 144 票反对通过了提议,禁止 vibe-coded 项目。Codeberg 官方博客称,LLM 是一项成本昂贵的技术,且随着 AI 公司开始收回投资,成本还在不断攀升。这种成本不仅体现在云服务和订阅费用中,事实上每个人都深受影响。LLM 的成本如此之高以至于公司将成本转嫁给不使用 AI 的人和整个社会。硬件价格上涨、能源消耗增加以及环境破坏——我们所有人都在为此买单!AI 公司的爬虫让 Codeberg 的服务器不堪重负,而用户寥寥无几的 vibe-coded 项目消耗的资源甚至堪比大型的开源项目。LLM 的训练和部署大幅提高了硬件采购成本,尤其是 SSD 和内存。几年前采购一块硬盘只需要 700 欧元,如今相同的硬盘需要 3700 欧元,而且经常缺货,因此 Codeberg 托管代码的成本也越来越高。数据中心等基础设施、LLM 生成代码的版权和许可证问题,分享根据提示词通过 LLM 生成代码并称之为开源软件的举措并不会让世界变得更好,Codeberg 不想成为托管此类代码的平台,不希望浪费有限的资源,它将开始采取行动清理 vibe-coded 项目,偶尔使用 LLM 生成代码或维护者在不知情下接受了贡献者递交的 LLM 生成代码的项目预计不会受到影响。
即便是美国军方,他们也没有无限量的 Token 可用。美国陆军发出通知,称其 Token 几乎耗尽,要求军人限制使用。美国陆军使用名为 Ask Sage 的多模生成式 AI 平台,可运行不同的大模型,包括 Alphabet 的 Gemini、Meta 的 Llama 以及 OpenAI 的 ChatGPT。一名匿名的陆军军人称,陆军的一个服务就把一整年的 token 烧光了。他称陆军一直在鼓励军人使用生成式 AI。每人每月至少获得 20 万个 token,如果用完初始配额,系统会自动分配更多 token。据报道,美国军方在针对伊朗的 Operation Epic Fury 行动期间,每天消耗了 200 亿个 tokens。