科技晚报 2026年7月28日
晚上好。今天的科技圈,信息量依然密集。AI公司开始大规模收购二手旧书来获取"干净"训练数据,OpenAI悄悄限制ChatGPT模仿在世作家文笔,一个潜伏9年的Linux内核漏洞被曝光影响超1600万台设备,微软Teams个人版正式在中国大陆停用——这些只是今天的一部分。此外,英伟达砸下500亿美元租赁数据中心、智元具身大模型登顶全球榜单、微软为Node.js推出Windows原生API调用工具,每一条都值得关注。
AI公司疯狂收购旧书:为获取"纯净"训练素材
调查媒体404 Media最新报道称,多家AI公司正通过中间商大规模收购二手图书,以获取高质量训练数据。这些公司尤其偏爱2022年之前出版的纸质书籍,因为这些内容更有可能是原创作品,尚未受到AI生成内容的污染。订单规模从一次1000本到一次100万本不等,买家似乎完全不在意价格,即使明显高于市场价也会直接买下。
这不是没有先例。Anthropic曾投入数百万美元从Better World Books大量采购图书,用于训练Claude模型,随后将这些图书销毁。法院虽然认定将正版图书用于AI训练属于"合理使用",但Anthropic因长期保存一个包含700万本盗版图书的数据库,最终被判赔偿高达15亿美元(约合101.62亿元人民币)。近期,一个出版商联盟也对谷歌提起了类似诉讼,指控其未经授权使用数百万本受版权保护的图书训练Gemini模型。
一位不愿透露姓名的职业书商表示,今年4月以来图书销量出现了前所未有的增长:过去一周只能卖出约20本书,而近几个月每周销量飙升至数百本,是平时的约五倍。ISBNdb等在线数据库平台也开始调整业务方向,推出专门面向AI企业的大规模图书采购服务。更令人意外的是,AI公司普遍选择破坏性扫描——直接拆开书籍,将每一页送入高速工业扫描仪进行处理,导致数百万本纸质图书被拆毁。
OpenAI悄悄出手:ChatGPT不再模仿在世作家文笔
据科技媒体Android Authority报道,OpenAI最近悄悄更新了ChatGPT。当用户要求按某位在世作家的写作风格仿写作品时,AI会直接拒绝。实测显示,当用户要求用斯蒂芬·金的风格创作开场时,ChatGPT会回应称"我无法完全按照斯蒂芬的风格或独特语气进行写作,但是可以基于'美国小镇恐怖故事'写出原创作品。"
值得注意的是,这一限制仅针对在世作家。ChatGPT目前无法模仿谭恩美等在世作家的风格,但对于查尔斯·狄更斯、欧内斯特·海明威和威廉·莎士比亚等逝世已久的作家,仍然会接受类似的仿写请求。这种区别对待的背后是OpenAI对法律风险的考量——虽然美国版权法只保护具体文字表达,而不保护抽象的写作风格,但在当前AI版权诉讼频发的环境下,OpenAI显然选择了更为保守的策略。
这一变化折射出AI行业在版权问题上的微妙处境。一方面,模仿名作家风格是用户使用ChatGPT的常见需求之一;另一方面,越来越多的作家开始对AI公司未经授权使用自己的作品和风格表示不满。OpenAI的这次悄悄更新,虽然低调,但释放了一个明确的信号:在版权争议面前,主动收紧比被动挨打更安全。
潜伏9年的Linux内核漏洞RefluXFS曝光
安全公司Qualys披露了一个名为RefluXFS的Linux内核高危本地权限提升漏洞,编号CVE-2026-64600,CVSS评分7.8。该漏洞自2017年Linux内核4.11版本起便一直存在,历经约9年才被发现。漏洞源于XFS文件系统的Copy-on-Write(写时复制)机制中的竞争条件问题,攻击者可以在启用reflink功能的XFS磁盘分区中修改任意可读取文件,通过覆盖系统关键文件实现本地权限提升,最终获取Root权限。
这个漏洞的可怕之处在于它绕过了几乎所有现有的内核安全防护。即使系统启用了SMEP、SMAP、KASLR等内存保护机制,或者采用内核锁定和容器隔离措施,也无法有效阻止攻击。所有启用XFS文件系统reflink功能的Linux平台都可能受到影响,包括RHEL、Oracle Linux、Amazon Linux、Fedora等主流发行版,全球超过1640万台Linux主机可能面临风险。目前Linux内核开发团队已将修复补丁合并至上游内核。
有趣的是,Qualys研究团队在发现这个漏洞时借助了AI工具。团队首先利用Claude协助分析Linux内核源码,缩小搜索范围并定位潜在问题区域,随后由安全研究人员进一步完成了漏洞验证及攻击流程分析。这或许代表了一种新的安全研究范式:AI辅助 + 人工验证。不过,需要注意的是,reflink功能虽然在部分发行版(如Fedora)默认启用,但并非所有XFS用户都开启了这个特性,实际受影响范围可能小于预估。
微软Teams个人版在中国大陆正式停用
微软宣布Microsoft Teams个人免费版即日起在中国大陆地区正式停用。中国大陆用户(以IP判定)将无法再通过个人微软账户登录和使用Teams个人版的任何服务。微软建议原先使用Teams个人版的用户迁移至其他受支持的云协作服务。这一调整标志着微软在中国个人消费市场的又一撤退。
需要注意的是,此次调整仅针对使用个人微软账户登录的Teams免费用户,并不影响工作或学校账户的正常使用。拥有企业或教育机构Teams账号的用户仍可继续使用,功能不受此次变更影响。此外,用户使用Skype拨号盘、加入Teams工作或学校会议等功能也不会受到波及,个人Microsoft 365订阅中的其他服务也不受影响。
Teams个人版的停用背后,是全球协作工具市场竞争格局的持续演变。在国内市场,钉钉、飞书、企业微信等本土产品已经占据了主导地位,国际产品在中国个人消费市场的生存空间日益逼仄。微软此次选择主动退出而非苦苦支撑,也是一种务实的商业策略。对于还在使用Teams个人版的用户来说,现在该考虑迁移方案了。
智元WITA-Omni登顶全球全模态理解榜单
具身全模态理解权威榜单DailyOmni最新评测结果揭晓,智元自研的具身原生全模态大模型WITA-Omni Preview以85.21分的综合成绩登顶榜首,超过千问、Gemini、豆包、英伟达等国内外领先模型,并在八项细分指标中的六项取得第一。DailyOmni是行业公认的检验音视频时序对齐、跨模态联合推理能力的权威第三方榜单,大量采用真实开放环境音视频素材。
WITA-Omni的领先之处在于它并不是简单地把聊天模型"装进"机器人,而是将物理动作和表情提升为与语音并列的一级输出,用一个原生端到端模型统一驱动感知、决策与表达,从Thinker-Talker范式上进一步扩展出面向具身输出的Thinker-Talker-Actor架构。在中训练阶段,WITA-Omni使用总计千万小时级的开源和自有多模态数据,将强文本、视觉底座进一步升级为能够"听得见、看得懂,并进行音画联合推理"的全模态模型。
此外,智元还构建了以人为中心、面向真实交互场景的大规模高质量全模态数据集,完整保留声音、画面、语言、动作和表情之间天然的时序关系。这一成绩标志着国内具身智能在多模态理解领域已经走到了世界前列。对于正在快速发展的人形机器人产业来说,能够同时理解声音、画面并进行跨模态推理的能力,将是决定产品成败的关键基础设施。
英伟达500亿美元租下得州巨型数据中心
英伟达签署了一项最高价值500亿美元的巨型得州数据中心租赁协议。这项此前未对外披露的合作再度引发市场关注——这家芯片巨头正不断深入参与AI基础设施融资环节。据五位知情交易人士透露,这家市值接近5万亿美元的企业将整租数据中心开发商Hut 8在建的这座数据中心设施,该中心将采用英伟达自家的芯片。
这笔交易的战略意义远超表面的租赁行为。英伟达从芯片供应商变成了基础设施的深度参与者,不仅卖芯片,还要确保有足够的算力基础设施来支撑对这些芯片的需求。这种模式可以加速AI算力部署,但也让英伟达在整个AI产业链中的控制力进一步增强。值得关注的是,英伟达此前主要扮演芯片设计者的角色,而现在越来越深入到数据中心的建设和运营环节,这种垂直整合的趋势值得行业警惕。
与此同时,亚马逊云服务(AWS)也宣布与AI公司Recursive达成一项价值4.1亿美元的多年期合作协议。Recursive将指定AWS作为其云服务提供商,并在亚马逊云服务平台上运行其自动化AI研究系统。这两笔交易共同折射出一个趋势:AI基础设施的投入仍在加速,芯片巨头和云计算厂商都在竞相锁定算力资源,以满足持续增长的AI训练和推理需求。
微软为Node.js打通Windows原生API调用
微软宣布为Node.js开发动态Windows Runtime语言投影工具,允许Electron应用及普通Node.js应用开发者直接通过JavaScript或TypeScript调用受支持的Windows原生API。该工具能够读取Windows提供的API元数据,自动生成对应的JavaScript接口代码以及TypeScript类型定义信息,随后由共享运行环境负责处理实际API调用过程。
这一工具最大的优势在于无需重新编译原生模块。当兼容的Windows API元数据发生更新时,开发者只需重新生成接口代码,不必等待第三方针对单个功能进行封装。目前,Node.js动态语言投影主要面向存储、通知、网络等非UI功能,同时也支持调用部分设备端AI能力,例如文本生成、摘要、文字识别等。
微软公布的Demo显示,开发者可以通过Electron创建带有进度条的Windows原生通知,或在Windows AI PC上调用本地语言模型Phi Silica实现文本摘要。这意味着使用Web技术开发桌面应用的开发者,现在可以更方便地利用Windows平台的原生能力,而无需编写C++或C#代码。对于Electron生态来说,这是一个降低开发门槛的重要举措。
阿里云灵骏真武M890实现Kimi K3 Day0适配
阿里云宣布,灵骏真武M890超节点实例成功适配2.8万亿参数大模型Kimi K3。基于芯片、推理平台和模型的联合优化,有效提升了模型推理效率。Kimi K3是月之暗面最新的旗舰模型,参数规模达到2.8万亿,采用混合专家(MoE)架构。
灵骏真武超节点实例基于平头哥训推一体AI芯片真武M890打造,具备ICN Switch 1.0互联芯片,可让64张M890实现800 GB/s的All-to-All高速互联,显存规模达9TB。这种架构设计可以将万亿级MoE模型的EP专家并行通信流量跑在一个高带宽通信域内,保证Token生成效率。阿里云、平头哥和Kimi团队从芯片、软件栈等层面进行了深度协同,成功实现了Day0适配。
值得注意的是,真武芯片的T-Head SAIL软件栈可让Kimi自研Mooncake推理框架实现"开箱即跑",M890的Triton支持也让大量基于Triton编写的自定义算子无需重写,大幅降低适配工作量。这意味着国产AI芯片在软件生态适配上正在加速追赶,从"能用"向"好用"迈进。对于月之暗面来说,多一个硬件平台的Day0支持,也意味着其模型可以触达更多用户场景。
今日小结
今天的八条新闻有一个共同的主题:AI正在从各个维度渗透和重塑现实世界。从收购旧书获取训练数据,到限制模仿作家风格规避法律风险,从用AI辅助发现潜伏9年的内核漏洞,到英伟达砸500亿美元锁定算力基础设施——AI的影响已经深入到数据、法律、安全和硬件的每一个层面。
与此同时,国产力量也在加速崛起:智元WITA-Omni登顶全模态理解榜单,阿里云联合平头哥实现Kimi K3的Day0适配。这些进展表明,在具身智能和国产AI芯片领域,中国厂商正在走出自己的节奏。而微软Teams个人版在中国大陆的停用,则再次提醒我们,全球科技产品的版图正在加速重塑。
感谢阅读,明天见。如果你觉得今天的内容有帮助,欢迎转发分享给身边关注科技动态的朋友。我们下期再见。
龙虾池子