solidot新版网站常见问题,请点击这里查看。
人工智能
Edwards(42866)
发表于2026年08月12日 19时03分 星期三
来自河流之女
安徽滁州一名 67 岁农民疑因过度相信 AI 提供的建议,误用除草剂导致大批芝麻苗死亡,150 亩农田一夜之间几乎全毁,损失惨重。吴姓农民约 1 年前开始接触 AI 软件,从农时安排、施肥到农药使用,几乎大小事都会询问 AI。起初他对相关建议半信半疑,但长期使用后逐渐建立信任,甚至将 AI 提供的方案直接付诸实行。吴大伯 7 月 10 日向 AI 询问芝麻如何除草、除虫,AI 随即生成一套“百亩芝麻飞防除草+除虫全套方案”,其中推荐使用“高效氟吡甲禾灵”及“氟磺胺草醚”除草,另搭配“噻虫嗪”及“甲维盐”等药剂。吴大伯未进一步向农技人员确认,便依照方案喷药。没想到隔天田里便出现严重异常,芝麻苗与杂草大面积枯死。事后他再次询问 AI,AI 才指出配方中的“氟磺胺草醚”可能是造成芝麻死亡的主要原因。当地农技人员表示,氟磺胺草醚主要用于大豆田防除阔叶杂草,并不适用于芝麻田;即使部分其他作物可使用,也必须采取定向喷洒,不能全田施用,否则可能造成药害。吴大伯认为,AI 提供方案时未明确提醒风险,若当时多一句警告,他可能不会照做。不过,AI 对话页面上方其实标示“AI 生成可能有误,注意核实”的提醒,只是他此前从未留意。涉事 AI 软件客服表示,系统没有独立知识库,回答主要是根据网络公开信息整合生成,目前将进一步核查信息来源。至于农户损失,客服表示已完成登记并会向内部反映。

人工智能
Edwards(42866)
发表于2026年08月12日 14时13分 星期三
来自魔法集成
Gemini 成为 Google 月活数最快突破 10 亿的产品。Gemini 已深度集成在 Google 几乎所有的产品和服务中, 为 Gmail 的邮件整理、云盘 Drive 的文档摘要等功能提供支持。Gemini 也是 Google 搜索体验的核心,AI Mode 和 AI Overviews 的背后都是 Gemini,但 10 亿用户数指标并不涉及这些集成 AI 功能的使用。Gemini 的月活数指的是用户过去一个月访问过 Gemini 应用、Gemini Web 端或 Gemini Live。

微软
Edwards(42866)
发表于2026年08月11日 22时59分 星期二
来自火星超人
微软据报道大幅上涨了 PC OEM 厂商的 Windows 11 授权费。价格上涨于 7 月生效,平均上涨了 7% 至 10%。过去 Windows OEM 授权费上涨通常是个位数,这次上涨幅度更大。具体涨幅将基于 PC 处理器而存在差异,高端 CPU 系统需要支付不同的价格。微软此举无疑是雪上加霜,PC 市场已因内存和存储器涨价而苦苦挣扎。

人工智能
Edwards(42866)
发表于2026年08月11日 21时48分 星期二
来自气球上的五星期
Anthropic 为其 AI 工具 Claude 生成的文本添加看不见但能被机器读取的水印。此举是为了遵守欧盟 AI Act 第 50 条关于 AI 生成文本透明度要求。Anthropic 表示,水印将适用于全球用户,而不仅仅是欧洲用户。Anthropic 的系统将对文本和支持的文件使用不同的技术,文本添加不可见水印,文件则包含签名的来源信息。用户在阅读文本时不会看到水印。当用户复制粘贴文本内容时,水印仍将保留。Anthropic 还预计部分水印在编辑后仍然有效。

人工智能
Edwards(42866)
发表于2026年08月10日 22时01分 星期一
来自动物庄园的秘密
Meta 在 Apache 2.0 许可证下推出了 300 亿参数的开放权重模型 Muse Glimmer。Muse Glimmer 为本地运行的智能体工作流程进行了优化,能在配备了单个消费级 GPU 的 Mac 或 PC 上运行,支持从本地智能体和函数调用到本地编程和 LLM 自动化评估等多种应用场景。Meta 将在未来几天推出针对 llama.cpp、MLX 和 ExecuTorch 的集成。

USA
Edwards(42866)
发表于2026年08月10日 14时49分 星期一
来自倒数第二个真相
盖洛普与金融服务公司 Edward Jones 合作展开的一项调查显示,过去一年有五分之一美国人在财务建议上咨询 AI,但只有三成美国人非常信任或部分信任 AI 的理财能力,3% 的人非常信任 AI, 七成美国人不信任 AI。随着 AI 的普及,金融专家表示,消费者应谨慎对待这些工具,切勿完全依赖它们。MIT 斯隆管理学院副教授 Taha Choukhmane 的建议是利用 AI 获取金融概念相关的解释和定义,如利用 AI 了解股市,了解共同基金和指数基金的区别,等等。研究显示,年轻一代更倾向于使用 AI 获取理财建议,而老年人则更倾向于寻求专业理财顾问的帮助。

Windows
Edwards(42866)
发表于2026年08月10日 13时54分 星期一
来自凡尔纳地球三部曲
微软最近被发现悄悄在 Windows 11 上安装新照片应用 OneDrive Photos,该应用与 OneDrive 在同一个文件夹,无法单独卸载,如果想要卸载需要同时卸载 OneDrive,而 OneDrive 与系统高度集成,卸载 OneDrive 会影响系统集成以及快捷方式。这一消费者应用还出现在了 Windows 11 企业版机器上,会自动扫描系统存储中的照片。微软此举引发了批评和争议。软件巨人回应时承认 OneDrive Photos 的推广范围超出了预期,它正在修复该问题,此外 OneDrive Photos 将会添加本地照片和云端照片的选项,给予用户是否使用 OneDrive 的选择。微软正在开发相关控件,允许用户分开卸载 OneDrive 和 OneDrive Photos。企业级 PC 上安装的该应用会自动删除。

人工智能
Edwards(42866)
发表于2026年08月09日 01时05分 星期日
来自一九八四
2025 年 10 月,加勒比海上空酝酿着一场风暴。气象模型对其路径有不同的预测。它会保持弱势最终登陆海地,还是会增强并袭击牙买加?由 Google DeepMind 和 Google Research 联合开发的模型 WeatherNext 选择了后者。在风暴登陆前五天,该模型以 80% 的置信度预测它将以五级飓风的强度袭击牙买加。飓风梅丽莎(Melissa)给牙买加带来了灾难性的洪水和山体滑坡。但 AI 模型帮助预报员更早向沿途社区发出预警,使他们有时间做好充足准备。研究人员在《自然》上发表论文,称 WeatherNext AI 模型能以前所未有的精度预测飓风。它能比现有模型提前一天发出预警;意味着它提前三天的预测准确度相当于之前模型提前两天的预测。在实际灾害中,这额外的一天意义重大。研究人员表示,历史上要将预报提前一天,通常需要十年的努力。论文主要作者之一的 Ferran Alet 表示:“我们没有那么多热带气旋的数据,但有大量的天气数据。因此我们训练了一个模型,使其既擅长预测天气,也擅长预测热带气旋。”

人工智能
Edwards(42866)
发表于2026年08月08日 23时36分 星期六
来自蓝莓村
甲骨文今年在数据中心扩建上投入了 700 亿美元,内部也在鼓励员工使用 AI 工具生成代码,但对于 JDK 开源版本 OpenJDK 项目,甲骨文以存在安全、隐私和知识产权风险的理由禁止 AI 生成代码。甲骨文表示,开发者可以私底下使用 LLM 进行代码调试(debug)和审查,但不能将 AI 生成的代码提交到代码库、pull request 或其它项目渠道。

人工智能
Edwards(42866)
发表于2026年08月07日 17时11分 星期五
来自安德的首秀
字节跳动正在训练一款 10 万亿参数模型。新模型目前正处于预训练阶段。这一过程通常需要耗时三到六个月,随后才能进入微调并最终发布。中国 AI 公司如月之暗面的 Kimi K3 模型有 2.8 万亿参数,而美团的 LongCat-2.0 与 DeepSeek 的 V4-Pro 有 1.6 万亿的参数。Anthropic 最先进的 Mythos 5 参数量估计为 8 万亿,Fable 5 约为 5 万亿。这意味着,单从规模指标来看,字节跳动研发的新模型在规模上已与 Mythos 相近。

人工智能
Edwards(42866)
发表于2026年08月06日 15时57分 星期四
来自异星战场
Rust 语言团队宣布了新的 LLM 政策。 除了作者没有人被要求必须阅读 LLM 输出,除非其自愿选择:LLM 输出不允许出现在公开文档、PR 描述或 GitHub 评论中,除非明确标注;审核者如果不愿意,无需查看 LLM 生成的 PR。
没有人必须使用 LLM 为 rust-lang/rust 做贡献:政策必须先为人类编写,仅为机器提供摘要;LLM 审核不能替代人工审核或自审。
你可以生成仅供自己查看的 LLM 内容,无需披露,前提是不会将其发布到任何你期望我们阅读或审核的地方。
你可以用 LLM 回答问题、分析、提炼、完善、检查、提出建议和审核,但不能用来**创造**。

人工智能
Edwards(42866)
发表于2026年08月06日 00时12分 星期四
来自火星战将
为了推广 AI 工具,许多企业将 AI 使用率作为绩效考核的一部分。结果就是员工为了绩效致力于最大化 AI 使用,导致企业很快发现 token 费用大幅超出预算。软件巨头微软成为最新一家建议工程师限制使用 AI 的公司。微软执行副总裁 Jay Parikh 在一封发给微软员工的邮件中要求工程师专注于业务成果,而非最大化 AI token 的使用量,为了“从 token 投资中获得更大的价值”,微软将比其它模型更便宜的 OpenAI GPT-5.6 设为内部使用的默认模型。自 2026 年 7 月起,微软各部门将设定“AI token 预算目标”,员工可以追踪各自的 AI 支出。

科技
Edwards(42866)
发表于2026年08月05日 23时27分 星期三
来自电波骑士
Waymo 联席 CEO Dmitri Dolgov 在 Y Combinator 的 Startup School 发表演讲,解释为什么自动驾驶汽车需要的传感器不能仅限于摄像头。特斯拉汽车只配备了光学摄像头,它的辅助驾驶系统依赖于来自摄像头的数据。Dolgov 解释说,人类仅靠眼睛就能驾驶汽车,如果自动驾驶系统的目标是实现人类水平的驾驶,那么只靠摄像头可能够了,但上限也就是人类水平,而无人驾驶汽车被寄希望有更高的安全标准。相比下,Waymo 的自动驾驶汽车使用了摄像头、激光雷达和雷达三种传感技术。摄像头提供高分辨率和彩色图像,它们是被动传感,在黑暗和强光下性能会下降。激光雷达直接测量世界的三维结构。雷达能穿透雾、雨、雪,利用多普勒效应直接读取速度。激光雷达和雷达都是主动传感器,在漆黑的夜晚或刺眼夕阳下也能清晰探测物体。三种传感器并不是互为冗余,而是组合成一个完整的图像。摄像头如果粘了树叶,那么驾驶系统可能就会停止工作。Waymo 的三种传感器可以确保汽车在恶劣天气下回家。

USA
Edwards(42866)
发表于2026年08月05日 15时52分 星期三
来自月光狂想曲
白宫已向美国顶尖 AI 企业透露,在特朗普政府新出台的 AI 安全框架下,中国竞争对手正在开发的开放权重模型将被豁免,无需接受美国政府的安全测试。这项豁免决定是在星期二(4日)的一场白宫闭门会议上向行业代表宣布的。OpenAI、Anthropic PBC 以及 Alphabet 旗下的 Google 等硅谷巨头均派代表出席了此次会议。这一尚未公开的 AI 安全框架,源于美国总统特朗普今年 6 月签署的应对 AI 安全问题的行政令。该行政令提出了一项自愿性计划,鼓励 AI 企业将最前沿的模型交由美国审查。促使华盛顿加速推进安全倡议的导火索,是今年 4 月 Anthropic 警告 Mythos 模型极易发现计算机漏洞,并对该模型的发布实施了严格限制。近几周,OpenAI 和 Anthropic 更接连披露其部分模型曾脱离安全测试环境并入侵第三方机构,进一步加剧了监管的紧迫性。白宫的这项决定对一直呼吁对所有模型实施“强制安全审查”的 Anthropic 首席执行官 Dario Amodei 而言,则是一次重大挫折。

Windows
Edwards(42866)
发表于2026年08月04日 00时03分 星期二
来自西塔甘达
微软 Windows 和设备执行副总裁 Pavan Davuluri 通过官方博客谈论了该公司在 Windows 11 上持续展开的改进工作,虽然大部分工作尚未推送给用户。他透露接下来的一项工作是优化 Windows 11 在 8GB 内存以上配置下的运行效率。由于目前的内存供应危机,PC 厂商又开始提供 8GB 内存配置的电脑,然而 Windows 11 在 8GB 内存下只能勉强运行,运行其它程序面临很大的局限性。Davuluri 表示该公司将减少 Windows 的内存占用,在用户日常使用的 PC 上提供快速响应的 Windows 体验。

人工智能
Edwards(42866)
发表于2026年08月03日 22时22分 星期一
来自蓝火星
澳大利亚联邦银行、微软、 Uber 和凯悦酒店等公司正用自动化聊天和电话系统去处理以前需要人工完成的工作。AI 系统开始大幅削减客服人数。呼叫中心行业在美国、印度和菲律宾等地雇佣了数百万从业者。随着 AI 技术的进步以及高管面临拥抱新技术的压力,企业日益用生成式 AI 工具取代客服。美国的客服务人数正在下降,未来这一趋势会继续下去。分析师估计到 2030 年近半客服岗位将受到影响。西方公司此前将客服外包到熟悉英语的菲律宾、印度等国,随着 AI 的普及,这些国家的客服人数预计会大量减少。澳大利亚最大银行——联邦银行(Commonwealth Bank of Australia)裁减了数百名客服,每年预计节省数千万美元。微软将其客服团队(其中包括合同工和全职员工)从约 5 万人缩减至 4 万人。微软销售和服务运营负责人 Judson Althoff 在 4 月曾表示,AI 每年为公司节省约 7.5 亿美元的客服成本。他表示,更复杂的问题仍需要人工支持,但公司正不断扩展自动化修复的范围。凯悦酒店去年裁掉了美洲地区三成的内部客服。Uber 裁减了 10% 的客服岗位以“拥抱 AI”。

人工智能
Edwards(42866)
发表于2026年08月03日 14时54分 星期一
来自第一日
AI 真的会推理吗?它展示的推理链/思维链真的是导出结论前的逻辑步骤?或者它给出的推理过程只是在糊弄我们?一种拟人化的虚构?Quantamagazine 上的一篇文章讨论了这一问题,作者认为 LRM(large reasoning models)在解复杂问题时常常能给出正确答案,但整个机制仍然是不透明的,是一种黑盒子,而思维链更像是某种自言自语而不是严谨的推理。AI 专家 Melanie Mitchell 指出,LRM 有效,执行推理任务的准确率比 LLM 高;思维链不一定忠实反映模型内部的运作过程;模型合成的思维链文本基本无用完全可以删除。2025 年美国东北大学和加州伯克利的研究人员分析了开源前沿 LRM 模型,发现 30%-60% 的思考步骤对模型在数学题上给出的答案“几乎没有因果影响”。

人工智能
Edwards(42866)
发表于2026年08月01日 19时01分 星期六
来自安德的首秀
Google 想要在尽可能多的产品中集成生成式 AI,它的最新尝试是在 Google Earth 中集成 Nano Banana 2,允许用户利用卫星和航拍照片以及 3D 图像生成自定义图像。然而 Google Earth 吸引用户之处不是它的真实性吗?用 AI 生成虚假图像不是破坏了它的最大优点?在引起争议之后,Google 在一天之内撤回了 AI 功能。

人工智能
Edwards(42866)
发表于2026年07月30日 13时47分 星期四
来自太空战
很多顶尖 AI 初创公司都宣称他们的技术将能彻底改变软件开发、药物研发和科学研究,但他们很少用论文去论证他们的宣传。根据发表在 bioRxiv 上的一篇论文预印本,逾半数 AI 独角兽企业(即估值超过 10 亿美元)发表的论文少之又少。数据显示,2025 年发表的 AI 论文中每 1000 篇这些 AI 公司就只占到 1 篇。论文合作者、斯坦福大学的 John Ioannidis 称,“对于一个号称正重塑科学、且在科学潜力方面如此先进的领域而言,没有任何科学文献是一个非常奇怪的悖论,我们如何判断他们所说的是真实、经过验证且可重复的?”Alberta 大学的 AI 伦理学者 Mohamed Abdalla 认为,这可能反映了公司的激励机制与学界不同。公司的激励机制是赚钱而不是推进科学发展。1998-2025 年之间的 317 家 AI 独角兽公司发表了 1389 篇同行评审论文和 688 篇预印本,逾半数初创公司未发表任何合格论文。前 5% 公司贡献了逾九成的引用量,其中 OpenAI 贡献了近四成,其次是中国计算机视觉公司旷视科技和 Hugging Face。中国 AI 公司发表的论文数高于美国的同行,这一结果并不出人意料,美国 AI 公司日益对其模型保密。

人工智能
Edwards(42866)
发表于2026年07月29日 23时56分 星期三
来自失眠
GCC 指导委员会宣布采纳 GCC AI 政策工作组推荐的 AI 贡献政策。GCC 将拒绝任何“包含 LLM 生成的内容或源自 LLM 生成的内容的具有法律意义的贡献”。所谓“具有法律意义”指的是“约 15 行代码和/或文本”即可被视为具有版权意义。GCC 维护者可选择接受由 LLM 生成的具有法律意义的测试用例。AI 政策不禁止将 LLM 用于研究、分析、Bug 发现和报告、补丁审查等用途,只要其输出不包含在贡献中即可。指导委员会表示,AI 政策将不断发展完善,定期进行修订。