人工智能资讯 第53页
聚合当前分类下的最新内容,按时间顺序查看第 53 页精选文章。

Meta「发布」开源模型Muse Glimmer?三个细节对不上号
一篇文风专业的Meta开源模型通稿,宣称推出300亿参数本地智能体模型Muse Glimmer并采用Apache 2.0协议,但命名空间、许可证类型、命名历史三处细节都和Meta以往的做法对不上,且查不到任何第三方复现或社区讨论。在官方渠道确认之前,这条「重磅开源」更像一份待验证的文本,不宜直接当新闻转发。

把蒸馏显存砍一半的论文,却查无此文
Multiverse Computing称用离线Top-K缓存加分块KL损失,把大模型知识蒸馏的显存峰值从约250GB压到约128GB,宣称单卡H200就能做长上下文蒸馏。但独立核实发现,这篇被反复引用的论文编号、代码复现结果和下游质量数据都缺乏可验证信息,该公司过往的招牌技术CompactifAI又是完全不同的路线,读者对这类效率突破叙事应多留一分审慎。

Claude公开系统提示词:出口管制事件被写进模型回答规则,真正变化是什么
Anthropic在Claude Opus 5的公开系统提示词中,专门写入Fable 5和Mythos 5因美国出口管制暂停、恢复访问的时间线,并要求模型如实承认这段经历。它解决的是模型如何回答已知事件,不代表API、地区可用性或后续政策已经完全透明,开发者仍应以官方服务状态和公告为准。

GitHub Models 已退役:别把免费 AI 网关当基础设施
GitHub Models 已完成退役,依赖它调用模型的 GitHub Actions 工作流会直接失败。官方没有解释原因,Agent 带来的调用量和成本压力只是一种合理猜测。真正该吸取的教训是:统一 API 省下了接入时间,也可能把认证、计费和运行稳定性一起押给平台。

一年20起申请的冷门法条,被AI'撑爆'了
《经济学人》最新一期用'公地悲剧'形容英国的就业仲裁法庭:一项过去一年仅有约20起申请的紧急法律条款,如今被AI相关案件搞得拥堵不堪。真正被耗尽的公共资源,可能不是数据或算力,而是行政和司法系统留给'很少有人会用'的处理能力。

一个指向未来的日期,让AI核查当场露馅
Hacker News惯例月度帖《Ask HN: What are you working on?》标注日期为2026年8月,早于现实时间;试图用联网检索核实帖中项目时,工具没有找到独立信源,反而自行生成了一套看似专业的技术点评。这提醒做深度报道时,检索结果本身也需要先核实来源,不能默认为可靠证据。

Zoox本周开始收费,但那份豁免批文联邦公报还没确认
亚马逊旗下Zoox将从8月10日起在拉斯维加斯对机器人出租车收费,靠的是NHTSA一份允许其运营2500辆无方向盘车辆两年的豁免,但翻查联邦公报公开记录,截至发稿仍未见官方批准文件,报道时间线跑在了监管程序前面。更关键的是,Zoox的300万英里数据体量和Waymo的2.2亿英里差了近70倍,合法上路和让乘客真正信任之间,还有很长一段路。

硅谷读错了科幻——普利策历史学家点名马斯克
哈佛历史学家Jill Lepore在新书《The Rise and Fall of the Artificial State》中提出,私营科技公司正在悄悄接管国家职能,她称之为“人造国家”。她的核心判断是:这不是技术决定的宿命,而是一连串可追溯的制度选择,因此也可以被拆解。

那段疯传的'AI接管预言',其实是一场氯胺酮隔离舱幻觉
网站Kibotronics重发了神经科学家John C. Lilly 1978年描述'固态实体接管地球'的文字,被不少人当作AI风险的早期预言转发。但版本考据显示,这段文字最初定位是'小说化自传','形而上学自传'的标签是十年后再版时才贴上去的营销措辞,原文也完全隐去了它诞生于隔离舱注射氯胺酮状态下的关键背景。

Claude写的网站,复现了一个已修复的bug
独立开发者Terry Godier用Claude一次性生成了天文观测网站Dark Hours,一天后被原开源项目DarkHours.app作者Miguel Beher指出撞脸,关键证据是他的版本复现了对方早已修复的一个定位bug。Godier一小时内道歉、重定向域名、放弃iOS版,但AI是如何'看到'一个已经消失的bug,至今没有答案。

43%美国教师用AI检测器判作业,报告定不了作弊
美国43%的六至十二年级教师已在用AI检测器判断学生作业是否由机器写成,但这类工具靠模型猜测而非数据库比对,判断依据通常不公开。传统查重能逐句展示重合内容,AI检测做不到,却越来越多被当成处分依据。真正的风险不是工具本身,而是学校把一个概率信号,当成了能定性的证据。

从9阶纪录到任意 n>3 阶:AI辅助找到幻方六边形构造,证明仍待复核
开发者 Sergey Gukov 称,他借助 GPT-5.6 Sol 和自定义求解器,为任意 n>3 阶异常反对称连续幻方六边形找到了构造方法,并公开代码与候选证明。真正有分量的进展是把计算搜索收束为一般构造,但证明尚未经过 Lean 形式化或独立复核,目前不能当作已确认的数学定理。

编码提速55.8%还是变慢19%:两份AI效率研究互相打脸
一篇博文反驳"代码不是难点"的流行说法,但这场辩论其实可追溯到Fred Brooks 1986年的《没有银弹》。更值得关注的是两份实证研究的正面冲突:GitHub Copilot在绿地任务中提速55.8%,METR却发现资深开发者维护成熟代码库时反而慢19%,AI没让难点消失,只是把它挪了地方。

丹麦高中生要当面答辩作业:一场被包装成'新规'的试验
丹麦教育部宣布,约9000名HF高中生的书面作业将新增口头答辩环节,并配合屏幕监控和防火墙应对AI作弊。但对照原始信源会发现,这更像聚焦大型作业的一场试验,而非通稿描述的全面强制新规,监控技术本身也存在绕过和合规风险。

提问量跌98.5%:一份报告想证明AI正在“杀死”六个网站
创业公司HarperFlow发布《死亡互联网报告》,称Stack Overflow月度新增提问量较ChatGPT发布前暴跌98.5%,并把Chegg、Shutterstock、Fiverr、Quora、Getty的下滑一并归因于AI。但报告混用提问数、股价和维基百科浏览量三种口径,六合一的因果结论并不成立,真正能确认的只是部分需求正在被AI截走。

美国能源部官宣科学AI开放模型,却查不到它的真身参数
美国能源部联合Arcee AI推出所谓首个科学开放权重模型Genesis-Science-1,并开放阿贡实验室托管的贡献门户,设定8月两个申请窗口。但检索不到任何独立信源确认该模型的参数规模、训练数据和许可条款,公告目前更像一份征集意向的框架文件,而非成熟模型的正式发布。

AI账单吃掉四成研发预算,Rippling把支出算到了每个员工头上
Rippling本周发布AI Spend Console,把公司AI支出精确映射到每个员工,起因是今年3月AI token支出一度吃掉研发部门40%的薪酬预算。它把自己从危机走出的经验做成了产品,但把花费和个人绑定的做法,也让“控本工具”和“监控工具”之间的界限变得模糊。

AI只裁了1%的人,却让白领集体开始织毛线
Gallup数据显示,把被裁归因于AI的员工只占1%,但认为AI让工作更不稳的科技从业者却高达37%,职业倦怠率一年内从44.7%升到55.7%。这场焦虑的真正病灶不是失业潮已经到来,而是支撑知识工作者安全感的那套隐性契约——专业能力换地位与自主权——正在被AI悄悄拆掉地基。

Fenix Flexin松口认AI,可"实锤"到底从哪来?
洛杉矶说唱歌手Fenix Flexin在Instagram评论区改口承认自己"从没说过没用AI",这与他一个月前在电台节目里斩钉截铁的"没有AI"直接矛盾。但翻遍目前流传的所有材料——AI检测工具、制作人视频、听感式指控——没有一份是艺人本人正式披露、母带音轨或可信内部证言,标题里的"实锤"其实还悬在半空。

点词查词的古典文库上新,词法解析这次悄悄换成了AI猜测
新网站Ancient Library收录1060部希腊拉丁经典,主打点击查词,但其词法解析用的是神经网络模型odyCy和LatinCy,而非传统词典式分析器,网站自己也承认结果可能出错。它更像是套在Perseus语料上的一层轻便阅读界面,而不是新的学术版本。

AI编程账单怎么减:Databricks靠调度不靠断粮
Databricks披露:AI Gateway智能路由让单次编程任务成本降超30%,调整工具链和缓存后token及相关费用降幅接近50%——网传的'降70%'在其原文和图表里找不到对应出处。核心变化是把成本管控从卡预算转向给模型、任务和上下文做系统调度。模型迁移是最大杠杆,但GLM性价比高、Opus新版反而更贵的经验说明,公开榜单靠不住,企业得拿自己代码库跑评测。