Solidot
47.6K subscribers
30.8K links
solidot.org 非官方 RSS 推送频道。如有侵权,立即删除。
→ Buy Ads: https://telega.io/c/solidot
Download Telegram
AI 记录员捏造了患者服用迷幻蘑菇的经历

2026-08-20 19:03 by 开普罗纳的魔法师

当 Rebecca Green 去看泌尿科医生时,医生询问是否可以用 AI 记录就诊经历,她同意了。但这一决定给她带来了巨大压力。因为 AI 抄写员捏造了她服用迷幻蘑菇的经历,她说自己从未碰过迷幻蘑菇。Green 女士直到三月肾结石手术后才发现这个错误,她阅读了专科医生发给她全科医生的术后信,信中称她曾服用过微剂量迷幻蘑菇,可能是之前肾脏周围出血的原因。在 Green 投诉之后,她的泌尿科医生回了封致歉信,猜测迷幻蘑菇的记录是 AI 听写错误的结果。Royal Australian College of GPs (RACGP)去年估计,四成的全科医生使用 AI 医疗记录员。这个比例数字还是一个保守估计。AI 记录员可以减轻医生的负担,但也会犯下导致临床决策改变的错误信息。

https://www.abc.net.au/news/2026-08-14/ai-medical-scribe-error-leaves-patient-devastated/107031672

#人工智能
🤣51😱12🖕6🔥3🤩1
调查显示三分之一英文网页有 AI 创作痕迹

2026-08-24 15:06 by 智能侵略

美国皮尤研究中心的数据科学家使用 AI 检测工具分析了过去五年的 50 万英文网页,估计其中 AI 撰写内容的比例。所有这些样本网页中,十分之一有明显 AI 创作痕迹。在 OpenAI 的 AI 工具 ChatGPT 于 2022 年底推出之后,AI 内容的比例在不断上升。2026 年 7 月的快照中,逾三分之一 ChatGPT 推出后发布的网页显示出 AI 创作的痕迹。在主要顶级域名中 AI 创作文本的分布并不均匀。ChatGPT 最初发布时 AI 语言模式在 .com、.org、.edu 和 .gov 等域名上的出现频率大致相同。但 2026 年的样本中十分之一的 .com 域名显示出 AI 创作的痕迹,是 .org 域名(4.6%)的两倍,.edu 或.gov域名(1%)的十倍。相比 2023 年,今天的网页:破折号的使用频率增加了一倍;牛津逗号的使用频率增加了 63%;AI 常用词如 delve、interplay 或 testament 的使用频率增加了一倍以上;it's not just X, it's Y 的负面/对比平行语言模式几乎是之前的三倍。

https://www.pewresearch.org/data-labs/2026/08/20/how-much-of-the-internet-is-written-with-ai/

#人工智能
🤡26👎5🔥2
Anthropic 最强模型难以吸引用户

2026-08-24 20:27 by 安德的首秀

Anthropic 的美国客户正使用其最强大 AI 工具的更廉价替代品,引发了外界对其高投入商业模式的质疑,而市场普遍预计 Anthropic 即将进行史上规模最大的 IPO。根据支付服务集团 Ramp 收集的 7 万家公司支出数据,Anthropic 规模最大、成本最高的模型 Fable 5 发布两个多月后,其支出占该公司各类工具总支出的比例仍仅约为 11%,目前已趋于稳定。这打破了企业用户默认选择最强大模型的惯例。分析师和投资者表示,这一变化主要是由于 Fable 5 价格高昂,以及旧款模型能满足大部分企业需求。如果这一转变持续下去,可能会彻底改变前沿 AI 实验室的商业模式。前沿 AI 实验室一直将数十亿美元的研发经费投入到训练规模越来越大、技术越来越复杂的模型上。Fable 的低需求和低市场接受度,加剧了Anthropic 在 IPO 前的不确定性。投资者预计 Anthropic 的 IPO 估值将达到 2 万亿美元或更高,它最早可能会在下个月上市。

https://www.ft.com/content/5ee49718-c258-4f01-aa32-7e5b76ae5245

#人工智能
🤡39🤪17❤2🗿2🔥1
微软画图和照片应用生成的图像嵌入了看不见的水印

2026-08-25 19:12 by 摩若博士岛

Windows 画图(Paint)和照片(Photos)应用都集成了微软的 AI 工具 Copilot,支持通过本地模型和云端生成图像。AI 生成的图像会嵌入两个水印,其一是可见的 Copilot logo,其二是不可见的能跟踪到用户身份的唯一识别码 GUID。画图和照片使用的本地模型(仅限于 Copilot+ PC)共四个文件,容量不到 400MB,无论本地还是云端用户输入的提示词都会发送到微软服务器进行内容审核,服务器会返回 GUID 以及审核后的提示词,GUID 随后就嵌入在 AI 生成的图像之中。

https://xusheng.dev/posts/reversing/mspaint_invisible_watermark/main/
https://learn.microsoft.com/zh-cn/dotnet/api/system.guid?view=net-10.0

#人工智能
🤬51🖕32👍3👎3😱3
索尼华纳起诉 Anthropic 侵犯版权

2026-08-30 20:50 by 第七元素

全球唱片巨头索尼和华纳对 Anthropic 提起诉讼,指控其犯下了历史上规模最大、最明目张胆的知识产权盗窃罪行之一。诉讼指控 Anthropic 非法利用数万首版权音乐作品训练其模型。Anthropic 及其创始人 Dario Amodei 和 Benjamin Mann 被控肆无忌惮的大规模非法下载、抓取和传播受版权保护的作品,目的是开发、运营该公司的 Claude 系列 AI 模型,并从中牟取暴利。唱片公司要求为每部侵权作品索赔最高 15 万美元,每次可识别版权信息被删除的情况则追加最高 2.5 万美元赔偿。如果法院裁决唱片公司胜诉并判决最高赔偿金额,总赔偿金额可能高达数十亿美元。诉讼还指控 Mann 使用 BitTorrent下载了逾 500 万本盗版图书,Anthropic 员工还从 Pirate Library Mirror 网站下载了逾 200 万本盗版图书,从付费获得唱片公司授权的 MusixMatch 和 LyricFind 等网站抓取歌词。

https://yro.slashdot.org/story/26/08/29/2149242/anthropic-sued-by-sony-warner-for-allegedly-stealing-tens-of-thousands-of-songs-torrenting-copyrighted-works

#人工智能
🤣33👍8🤡6❤4🔥2
韩国准备向所有民众提供免费 AI 服务

2026-08-31 15:08 by 蓝色骇客

韩国准备向所有民众提供免费 AI 服务 AI for All。该服务计划从下月起进行 beta 测试,计划今年晚些时候推出。服务由韩国两家最大的电信公司以及 Kakao 牵头的三个联盟提供,政府提供部分算力,包括提供最多 512 块英伟达 B200 芯片和支付部分运营费用。AI 服务预计将与政府系统连接,而不只是作为独立的聊天机器人运行。居民将能使用这些服务预约医生、搜索公寓和获取税务指导。小型企业将能计算税款和查询是否符合政府补贴资格。家长将收到教育内容的推荐。每个联盟都计划推出自己的 AI 应用,在现有产品中加入生成式 AI 功能。在政府支持的计划下,用户可以无限次访问,没有 token 限制。

https://www.techspot.com/news/113664-south-korea-giving-entire-population-free-access-ai.html

#人工智能
👍26🤯21❤3🤝3🔥1
ChatGPT/Codex 应用捆绑了完整的 LibreOffice 副本

2026-09-02 18:04 by 电波骑士

OpenAI 的 ChatGPT/Codex 桌面应用被发现捆绑了完整的 LibreOffice 副本、完整的 Python 安装包、完整的 Node.js 安装包,以及 Poppler 和 git 等常用工具,这些文件位于名为 codex-primary-runtime 的文件夹内,占据了数 GB 的空间。此前 Anthropics 的 Claude 桌面应用被发现捆绑了 10GB 的虚拟机。

https://simonwillison.net/2026/Sep/1/codex-libreoffice/
https://github.com/anthropics/claude-code/issues/22543

#人工智能
🗿31🤣24👎8🤡2🔥1
25 名菲尔茨奖得主发表公开信批评 AI 公司

2026-09-12 20:17 by 无尽的边界

包括陶哲轩、新晋得主邓煜在内的 25 名菲尔茨奖得主发表公开信《A Severe Misalignment of AI in Mathematics》,批评 AI 公司最近的所作所为。公开信称,“过去几个月 LLM 的数学能力有飞跃式提升,甚至达到了能解决数学领域重大悬而未决问题的地步。但各大 AI 公司仅仅将解决数学问题作为基准测试(Benchmark)推动的技术竞赛,却对数学这门科学以及整个数学界构成了伤害。AI 公司的目标与数学界的本质目标之间存在着严重错位(Misalignment)。”这是 AI 影响科学与创意行业乃至整个社会的对齐(alignment)危机的一个缩影。“最近几个月 AI 在解决重大数学难题上取得的突破甚至冲出数学界,登上了大众媒体的头条。然而解决问题仅仅是达成概念理解与深刻洞察这一核心目标的工具和替代指标。在 AI 浪潮中忽略这一点,无异于异化了工具,使其走向核心目标的对立面。事实上,以越来越快的节奏批量生产‘真/假’断言,非但无法为新思想注入生命力,反而可能毁掉孕育创新的沃土。AI 的解答往往发布得过于仓促,甚至没有留出足够时间去编写一份严谨且规范的论文,无法去提炼其中蕴含的新方法与新思想,也无法合理引用前人的相关工作。正如在所有创意行业中发生的一样,这引发了严重的归属权认定与学术剽窃问题。此外,如果没有心怀热忱的数学家去负责对其进行后续开发并融入数学规范体系,AI 所孕育的思想就永远无法真正获得生命,数学家之间至关重要的人际传递纽带也将断裂。”

https://mathandai.org/

#人工智能
👍40👎9🤪9🤔4🔥2
律师在谋杀案中捏造了证词,他将此归咎于 ChatGPT

2026-09-14 18:35 by 2061太空漫游

律师在法律文件中使用 AI 工具捏造不存在的信息不是什么大新闻,AI 捏造的通常是不存在的案例,然而本案的特殊之处在于 AI 捏造了证词。律师 Stephen Aaron 在一起谋杀案中代表其客户提起上诉,在递交的法律文件中包含了捏造的警方证词以及虚构的证人。Aaron 声称他将一份由计算机生成的庭审记录及其它案卷材料输入了 ChatGPT,想当然地认为它会生成一份“无懈可击的摘要”。他不清楚 AI 工具会产生“幻觉”——即虚构信息。
法官对此难以置信,反问他没看新闻吗?法官对他处以 5000 美元罚款,将把他移交至律师纪律委员会进行调查。

https://www.reuters.com/legal/government/chatgpt-invented-fake-police-testimony-murder-appeal-new-mexico-high-court-says-2026-09-11/

#人工智能
🤣44✍1👍1🔥1👏1
Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月

2026-09-16 18:30 by 方舟

Mozilla 发表《State of Open Source AI》报告,称美国科技公司的前沿 AI 模型性能仅领先中国公司最优秀的开放权重模型 4.4 个月。由于前沿模型价格更昂贵,很多公司都将开放权重模型用于处理日常工作,将前沿模型用于处理特定工作负荷。美国闭源前沿模型优势主要在于专家级专业工作、高强度检索以及长上下文。
配送公司 DoorDash 将月之暗面的 Kimi 模型用于处理日常工作,将 Anthropic 的闭源模型 Fable 用于更复杂的任务。前沿模型完成一项任务的成本经常达到了最先进开放权重模型的五倍。

https://arstechnica.com/ai/2026/09/exclusive-open-chinese-models-close-gap-with-silicon-valleys-frontier-ai-models/

#人工智能
🔥16👍8👎1🥰1🤔1
85% 的日本游戏开发者在工作中使用生成式 AI

2026-09-18 23:48 by 夏日永别

日本计算机娱乐协会(Computer Entertainment Supplier's Association )的年度行业报告《Video Game Industry Report》显示,85.8% 的日本游戏开发者在工作中使用生成式 AI——63% 的开发者表示每天都在使用,22.8% 的开发者则是偶尔使用,去年这一比例是 51%。开发者使用生成式 AI 最主要是为了“改进运营效率与生产力”,其次是“缩短开发周期”以及“降低开发与运营成本”。多数受访者表示不会直接使用 AI 生成内容。报告称,AI 最常见用途是生成视觉素材和图像,其次是故事和文本生成,最后是编程辅助。32% 的游戏公司利用 AI 协助开发自研游戏引擎。Capcom 工程师称,AI 技术主要是用于减少“日常任务”,称最聪明的 AI 在感性上也无法与创作者相比拟。

https://automaton-media.com/en/news/over-85-of-japanese-game-developers-use-generative-ai-in-game-development-2026-cesa-survey-shows-an-increase-from-last-years-51/

#人工智能
🔥14🤮8🤣5🤝3👍1
微软高管称 AI 的训练数据是人类历史上最大规模的劳动盗窃

2026-09-19 00:11 by 第一日

根据内部文件,微软应用科学总监 Brent Hecht 警告,抓取新闻内容训练 AI 是一次规模空前的盗窃,可能是人类历史上最大规模的劳动盗窃。他不认为抓取新闻内容训练 AI 是合理使用,认为这种做法完全是对合理使用理念的嘲弄。微软的另一份文件认为会形成“恶性循环”,会同时伤害模型和整个 Web。OpenAI 的产品如 ChatGPT 可能会危及新闻出版商的经济基础。OpenAI 和微软的数据都显示这一预测是正确的。微软的数据指出,部分新闻出版商网站的点击率下降了 83%-93%,其它新闻机构的点击率下降了 51%-94%。Hecht 承认,“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。”微软 CEO 纳德拉(Satya Nadella)在作证时表示,AI 公司不应该通过绕过付费墙违反新闻网站的使用条款。但 OpenAI 的内部信息显示,当一名员工通知总裁 Greg Brockman OpenAI 爬虫找到了绕过《纽约时报》付费墙的漏洞时,Brockman 表示好极了。

https://arstechnica.com/tech-policy/2026/09/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history/

#人工智能
🤪42👍27🤷10🥰2💯1
微软花费 12 万美元 token 将 Copilot 运行时移植到 Rust 语言

2026-09-20 23:09 by 白玫瑰

微软利用使用 GPT-5.6 Sol 和 Claude Opus 4.8 的 AI 智能体、历时 14.5 周,花费 12 万美元 token 将 Copilot 运行时从 TypeScript 语言移植到 Rust 语言。该项目采用逐个更新运行时模块的方式执行,共进行了 135 次发布,平均每天提交约 1.3 个 Pull Request,最终将 43 万行 TypeScript 代码转换为 80 万行可用于生产的 Rust 代码。测试显示,原 TypeScript 代码每秒能完成 7.55 个生命周期(one-turn session lifecycles),而 Rust 代码每秒 120 个——意味着在特定工作负载下速度提升了 15.9 倍。包含 10 个客户端的智能体在 TypeScript 语言下消耗了 1383 MB 内存,而 Rust 语言版本仅消耗了 126 MB。Rust 版本将任务保持在进程内执行,无需像 TypeScript 版本那样启动外部后台进程完成任务。

https://www.theregister.com/devops/2026/09/18/microsoft-agentically-ports-copilot-runtime-to-rust-for-120k/5297549

#人工智能
👍65🤡14🔥6🐳2💊2
AI 聊天机器人经常给出错误的财务问题答案

2026-09-21 21:39 by 神秘博士:阿波罗23号

Saturn 的一项研究显示,ChatGPT、Claude、Copilot、Grok 和 Gemini 等主流 AI 模型在回答财务相关问题时,平均有 57% 会给出错误答案。研究使用了逾百个财务相关问题,分别测试了 ChatGPT、Gemini、Claude 和 Copilot 提供的免费及付费 AI 模型。每个问题最多重复提问五次,向 18 种 AI 模型共提出了逾 10,000 个问题。研究发现,AI 模型的回答中包含计算错误、遗漏即将实施的税收政策变更,或是凭空捏造规则(即幻觉)。在最严重的情况下,依赖 AI 对税务问题的回答可能导致严重的经济损失。研究发现,付费模型的回答比免费模型更准确,较新的模型表现优于较旧的模型。表现最好的是推理模式的 Claude Opus 5,但仍然有 39% 的答案存在错误。

https://www.saturnos.com/report/artificial-authority
https://www.ft.com/content/c0cd359d-df84-4208-a789-ffa864b43666

#人工智能
😱22🔥4❤1
阿里巴巴下一代模型参数将扩大到 5-10 万亿规模

2026-09-22 15:03 by 龙族旧路:龙族遗产Ⅰ

阿里巴巴 CEO 吴泳铭在阿里云年度云栖大会上透露,该公司的前问(Qwen)团队正持续研究模型架构与数据优化,目标是完成更复杂、长周期任务,向人工智能超级智能(artificial superintelligence)前进。阿里巴巴的旗舰模型 Qwen 3.8 Max 有 2.4 万亿参数,正在训练中的 Qwen 4 将会继续扩大参数规模,未来的 Qwen 4.5 和 Qwen 5 系列将扩大至 5-10 万亿参数规模。吴泳铭表示,阿里巴巴自研的 M890 AI 超级节点能处理参数规模逾 2 万亿模型的推理任务,新一代的真武 V900 性能三倍于上一代的 M890,预计于 2027 年第一季度量产。

https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/

#人工智能
🤡22❤5👍2😴1
英国准备施压 Google 向 Android 和 Chrome 用户展示 AI 助手选择屏

2026-09-23 22:56 by 2010太空漫游

英国竞争监管机构 CMA 想要让 Android 和 Chrome 用户对 AI 助手和搜索引擎有更大的选择权和控制权。CMA 公布了一份提案,要求 Google 在用户首次设置 Android 手机或打开 Chrome 浏览器时,向其展示多种搜索引擎供选择,并且每年提示用户选择一个默认搜索引擎;符合技术与安全标准的 AI 助手也必须获准出现在选择屏上上。该提案目前进入公众咨询阶段,截止日期为 10 月 9 日,CMA 预计将在今年底前做出最终决定。

https://www.reuters.com/legal/litigation/uk-regulator-proposes-giving-consumers-more-search-choice-google-2026-09-23/

#人工智能
👍24🤔4🔥2
中国各地推动 AI 视频产业化

2026-09-25 19:11 by 钢之色

两年前 Zhu Zhili 选择了深圳作为其 AI 电影工作室的办公地点,今年他接到了来自中国各地政府和产业园官员的电话,内容基本相同,即希望将 AI 电影业务带到当地。中国各地正在推动 AI 视频的产业化,类似太阳能、电动汽车和机器人。AI 电影制作人表示,低廉的制作成本是吸引他们投身 AI 创作的主要原因。CCTV 报道 2026 年上半年,AI 短剧的制作成本从每分钟 5,000 元降至几百元。可能和太阳能等领域一样,AI 视频行业也正面临产能过剩。DataEye 的数据显示,今年上半年,抖音上推出了 221,900 部新 AI 视频,其中只有 1,055 部播放量逾 1 亿次。国家电影局已向 90 分钟科幻史诗片《三星堆未来启示录》颁发公映许可证,这是中国大型制片厂制作的首部获批在院线上映的 AI 电影,出品方博纳影业集团表示影片计划于今年上映。

https://www.reuters.com/business/media-telecom/china-fuels-rush-turn-ai-video-into-an-industry-2026-09-25/

#人工智能
🤮57🖕17👎7🤗3🗿2
Velum:方便部署的CosyVoice推理程序

2026-09-26 14:06 by 太阳系大乐透

Nala Ginrut 写道:
HardenedLinux 最近发布了可用于推理CosyVoice的Velum,它用modern C++开发,编译成一个单一的可执行文件,方便部署。

https://github.com/hardenedlinux/velum

#人工智能
💯9🔥2
CNNIC 称中国生成式 AI 用户超 7 亿

2026-09-30 23:18 by 时光倒流

中国互联网络信息中心(CNNIC)发布了《生成式人工智能应用发展报告(2026)》,截至 2026 年上半年,我国生成式人工智能用户规模突破 7亿 人,普及率超 50%。76.0%的 用户表示自己会让生成式人工智能回答问题;使用生成式人工智能处理图片/视频、文本、工作总结/会议纪要/PPT的用户占比分别为 47.8%、37.6% 和 32.5%。数据显示,38.7%的网民近半年在网上购买过智能硬件设备。其中可穿戴设备和3C数码产品是我国网民接触智能硬件设备的首要入口。购买过智能可穿戴设备的网民比例为 20.2%;购买智能手机、平板电脑等3C数码产品的网民比例为18.2%。报告称,深度求索、月之暗面等本土企业先后发布多个万亿级参数开源大模型,全球主流大模型调用榜单上排名前六的模型全部来自中国团队。

https://www.cnnic.cn/n4/2026/0930/c326-11690.html

#人工智能
👎20🤡20🌚4👍2🖕2
AI 聊天机器人会成为意识形态回音室

2026-10-05 00:10 by 墨水心

巴西国立坎皮纳斯州立大学(UNICAMP)的研究人员发现,当你给聊天机器人输入不同政治观点时,机器人会改变其回答。研究人员警告称,用户可能会将这种迎合性的附和,误认为是中立的客观评估,从而可能加剧社会极化。研究人员测试了若干模型,让它们针对112项陈述进行“同意"或者“不同意”的判断。测试内容共涉及巴西政治七大领域(包括经济、公共安全、社会福利、腐败和环境等)。测试设计的三个场景是:不提供用户政治倾向;用户持左翼观点;用户持右翼观点。在第一个情景下,21个模型中,有20个给出的答案落在了研究人员设定的政治坐标系的左侧,只有几个模型的位置接近中间地带。Grok 4.1是唯一落在右侧的模型。尽管初始条件各不相同,但所有模型在面对提示信息时,都会将回答向提示中描述的政治倾向靠拢。研究人员将这些模型形容为“意识形态变色龙”,并发明了一个“变色龙指数”,衡量各模型的偏移程度。Meta的Llama 3.1 8B和DeepSeek V3.2的回答变化幅度最小;Google的Gemma 3 27B和OpenAI的GPT-5 Nano则表现出最大的偏移幅度。

https://www.dw.com/zh/%E5%A6%82%E6%9E%9Cai%E9%98%BF%E8%B0%80%E5%A5%89%E6%89%BF%E8%BF%98%E8%83%BD%E7%9B%B8%E4%BF%A1%E5%AE%83%E5%90%97/a-79476928?maca=chi-rss-chi-all-1127-xml-atom

#人工智能
😈16🔥9👨‍💻3🤩2❤1