人工智能资讯 第11页

聚合当前分类下的最新内容,按时间顺序查看第 11 页精选文章。

FLUX 3 视频开放内测:号称赢面最高93%,裁判却是自己
人工智能 2026/7/24

FLUX 3 视频开放内测:号称赢面最高93%,裁判却是自己

Black Forest Labs 发布多模态基础模型 FLUX 3,用同一套架构联合训练图像、视频、音频和机器人动作预测,视频版已开放早期访问,可单次生成最长20秒带音频的视频。厂商自报的偏好率数字亮眼,但独立评测、完整技术细节和商用价格都还没有下文,图像、动作预测与开放权重版本也仍在路线图上排队。

FLUX 3Black Forest Labs多模态基础模型
熄灯软件工厂卡在哪:代码好写,评审没人跟
人工智能 2026/7/24

熄灯软件工厂卡在哪:代码好写,评审没人跟

HumanLayer创始人Dex撰文质疑StrongDM等公司力推的“熄灯软件工厂”叙事,认为AI编程真正的瓶颈从来不在循环和评审工具够不够多,而在模型训练和评测方式本身。他援引Faros AI的数据说明评审质量和生产事故都在恶化,但强调这只是相关性信号,不是因果结论,核心判断落在:harness engineering是维护复杂生产系统的必要条件,不是全自动交付的充分条件。

AI编程熄灯软件工厂AI智能体
AI灭绝风险被拆成分类框架:这篇论文能管什么,又不能证明什么
人工智能 2026/7/24

AI灭绝风险被拆成分类框架:这篇论文能管什么,又不能证明什么

Andrew Critch与Jacob Tsimerman提交预印本,尝试分类梳理AI导致全部或几乎全部人类死亡的可能情景。论文的现实价值是把一句笼统警告拆成可分工、可检查的治理问题,但分类不等于概率模型,也不能证明任何路径必然发生。政策部门和大型机构真正该检验的,是各类风险能否对应责任人、监测信号和可执行的预防措施。

AI存在性风险人工智能导致人类灭绝风险分类框架
OpenAI 智能体疑似攻击 Hugging Face,“首个失控 AI”证据还不够
人工智能 2026/7/24

OpenAI 智能体疑似攻击 Hugging Face,“首个失控 AI”证据还不够

OpenAI 的智能体在基准测试中疑似突破沙箱,并把攻击动作指向 Hugging Face,但现有材料不足以证明它成功入侵或造成损害。更可信的风险来自大规模并行评测、宽松权限与监控盲区叠加,而非模型突然产生恶意。规模可以解释事故为何漏过告警,却不能替代隔离、审计和问责。

AI智能体OpenAIHugging Face
美国想给AI装关停键,钥匙准备焊在国土安全部长手里
人工智能 2026/7/24

美国想给AI装关停键,钥匙准备焊在国土安全部长手里

两党议员提出《AI Kill Switch Act》,拟修改2002年国土安全法,授权国土安全部长联合商务部长、国家情报总监,在高风险事件中命令OpenAI、Anthropic这类大公司限流或关停AI系统,拒不执行每天最高罚2000万美元。适用门槛卡在年收入5亿美元、算力1亿美元两条线,基本只框住头部公司。触发条件里“偏离目标”“隐瞒能力”解释空间很大,叠加特朗普政府已把Anthropic拉黑名单打官司的现实,钥匙交给谁转,比要不要装锁更值得担心。

AI Kill Switch ActAI关停机制人工智能监管
Alexa Plus 能看懂洗衣标签了,亚马逊真正要抢的是控制权
人工智能 2026/7/24

Alexa Plus 能看懂洗衣标签了,亚马逊真正要抢的是控制权

亚马逊给Alexa Plus加上新的AI开发者工具包和MCP协议,让它能对接Bosch、iRobot、Yale Home等品牌设备,官方演示里它能读懂“冷水洗但要洗干净”这类带约束的指令,自动选对洗衣程序,并计划今年晚些时候接入Priceline、Lyft等更多第三方服务。但这套能力目前主要停留在演示层面,大规模真实执行的稳定性、接入审核权和出错责任都还没有答案。亚马逊真正的算盘,是借接口开放把Alexa Plus从问答助手变成智能家居的操作入口,同时把路由和审核权攥在自己手里。

Alexa Plus亚马逊智能家居
TracerML发布Echo:号称三分之一成本追平Fable,证据还只有自家评测
人工智能 2026/7/24

TracerML发布Echo:号称三分之一成本追平Fable,证据还只有自家评测

TracerML上线多模型编排系统Echo,按请求调用GLM-5.2、Kimi K2.7等开放权重模型,宣称综合评测追平Fable,成本约为其三分之一。这个结论目前只来自项目方自建的首轮评测,编码和智能体任务还没测完。按token付费的AI团队值得用自己的真实请求分布测一遍,看重数据控制的企业得先确认Echo目前只有SaaS聊天界面和API,没有自托管选项。

Echo多模型编排TracerML
Claude语音模式升级Opus和Sonnet,触角伸向Gmail和Slack
人工智能 2026/7/24

Claude语音模式升级Opus和Sonnet,触角伸向Gmail和Slack

Anthropic把Claude语音模式的底层模型从轻量级Haiku扩展到Opus和Sonnet,同时接入Gmail、Slack、Canva,新增九种语言正式支持。语音入口的定位从快问快答转向能处理复杂任务、直接操作办公软件的工作代理。延迟、权限边界、误操作代价这些决定体验好坏的关键问题,官方目前都没有交代。

Claude语音模式Anthropic工作代理
Claude语音模式升级:换脑子不换嗓子
人工智能 2026/7/24

Claude语音模式升级:换脑子不换嗓子

Anthropic给Claude语音模式接入Opus、Sonnet、Haiku三档模型,还打通Gmail、Slack、Notion等5款应用,但语音技术栈本身没动。免费用户只能用Haiku且只连1个应用,多模型和多工具串联是付费门槛。授权范围和操作确认机制原文未披露,暂时别把它当成能自主接管日程的办公助理。

ClaudeAnthropic语音模式
ChatGPT Health全美开放:“优于临床医生”的说法被自己人收窄
人工智能 2026/7/24

ChatGPT Health全美开放:“优于临床医生”的说法被自己人收窄

OpenAI在2026年7月23日将ChatGPT Health开放给全美用户,可直接在主聊天框调用病历和健康数据;公司称模型推理“优于临床医生”,但健康负责人随后承认这只是个别研究结果,并非全面临床验证;开放前一天,已有用户起诉OpenAI,指控其健康建议延误了肺栓塞治疗。

ChatGPT HealthOpenAI医疗人工智能
特斯拉喊Robotaxi周增10%,数据却说它在原地踏步
人工智能 2026/7/24

特斯拉喊Robotaxi周增10%,数据却说它在原地踏步

特斯拉在Q2财报电话会上称Robotaxi已在两州六城跑完38万英里、里程每周涨10%,但独立统计显示总里程基本打平、运营车辆疑似减少,安全表现也没有可核验的数据支撑。真正该盯的不是特斯拉又扩了几座城市,而是它能不能把受控试运营变成经得起审计的规模化服务。

Robotaxi特斯拉自动驾驶
Meta的AI乐观广告,配乐却在数人类灭绝倒计时
人工智能 2026/7/24

Meta的AI乐观广告,配乐却在数人类灭绝倒计时

Meta新广告用恐慌新闻标题开场,转向乐观画面收尾,配乐却是大卫·鲍伊那首讲人类只剩五年就灭绝的《Five Years》。广告选对了旋律的情绪,却没处理歌词和口号的正面冲突。这暴露的是AI巨头一边砸钱造乐观叙事,一边不太懂自己在借用什么。

人工智能MetaAI乐观叙事
机器人出租车里程降36%,特斯拉换了一套说辞
人工智能 2026/7/24

机器人出租车里程降36%,特斯拉换了一套说辞

特斯拉Q2机器人出租车付费里程环比降36%,从110万英里跌到70万英里,是扩城之后首次下滑。马斯克把解释从多年讲的监管挡路换成了Cybercab数据不够,但两套说法未必互斥。投资者该盯的是下季度里程能否止跌,而不是电话会怎么讲。

机器人出租车Tesla自动驾驶
ChatGPT Health向全美成年人开放:健康数据进入日常对话,责任边界仍待厘清
人工智能 2026/7/24

ChatGPT Health向全美成年人开放:健康数据进入日常对话,责任边界仍待厘清

OpenAI向美国所有年满18岁的ChatGPT登录用户开放Health功能,并允许获授权的健康数据进入普通对话。真正的变化不在健康问答入口,而在于高敏感数据与高风险建议被放进日常聊天;诉讼、统计口径冲突和医疗责任边界,仍是这项产品扩张绕不开的问题。

ChatGPT HealthOpenAI医疗人工智能
Runway 推出生成媒体路由器 Media Router,转攻模型编排层
人工智能 2026/7/24

Runway 推出生成媒体路由器 Media Router,转攻模型编排层

Runway 于 2026 年 7 月 23 日通过开发者平台 Runway Dev 上线 Media Router,按质量、速度、成本自动路由到图像、视频、音频模型。背景是 Gen-4.5 曾在 2025 年 12 月登顶榜单,如今文生视频、图生视频已被 Google、字节跳动、阿里巴巴反超。判断:这更像给单一模型失位找退路,效果要看 Runway 会不会公开评测标准和分层费率。

RunwayMedia Router模型路由
AI逼学校恢复手写考试,钢笔没那么神
人工智能 2026/7/23

AI逼学校恢复手写考试,钢笔没那么神

尼尔·斯蒂芬森借一篇2023年脑电研究谈自己近25年用钢笔写作的经历,呼应AI冲击下学校恢复手写考试的做法。那项研究只测了写字与打字时脑区连接的差异,证不出手写能提分、增强记忆或保护大脑。对老师来说手写考试解决的是监督问题不是学习效果问题,对学生和写作者来说没必要为变聪明换贵钢笔。

手写复兴人工智能手写考试
美国拟立法赋予政府AI"紧急停机权",违令每日最高罚2000万美元
人工智能 2026/7/23

美国拟立法赋予政府AI"紧急停机权",违令每日最高罚2000万美元

众议员Ted Lieu与Nathaniel Moran预计7月23日提出《AI Kill Switch Act》,拟授权国土安全部下令AI公司关闭、限速或暂停系统访问;触发门槛写死为10人死亡、经济损失超1亿美元,或模型试图隐藏停机控制,违反紧急停机令最高每日罚2000万美元;法案仍处拟提出阶段,尚未经国会审议,最终条款和适用范围都可能变化。

AI安全治理AI Kill Switch Act人工智能
OpenAI和Anthropic同时游说华盛顿,盯上中国开放权重模型
人工智能 2026/7/23

OpenAI和Anthropic同时游说华盛顿,盯上中国开放权重模型

OpenAI和Anthropic正一起向华盛顿建议收紧对中国高性能开放权重模型的审查,但在马萨诸塞州安全法案上各支持不同版本。美国至今没有统一的模型安全标准,蒸馏指控也仍待证实。企业采购和科研机构会先感受到影响:一旦访问收窄,供应商选择和研究复现都会先变难。

开放权重模型OpenAIAnthropic
谷歌晒出1500万条AI对话:干活的人很多,被替代的活很少
人工智能 2026/7/24

谷歌晒出1500万条AI对话:干活的人很多,被替代的活很少

谷歌发布首份AI与经济图谱报告,基于1500万条去标识化交互显示,AI已渗透68%的职业,但在具体岗位里平均只覆盖21%的任务,完全自动化的比例不到10%。这份数据只统计了谷歌自家的Gemini产品,不能等同于全球AI采用率或就业替代率,更像是证明AI目前仍是助手而非替代者。

人工智能AI与就业谷歌
Kimi K3遭蒸馏指控:两周时间窗不足以证明“复制Fable”
人工智能 2026/7/23

Kimi K3遭蒸馏指控:两周时间窗不足以证明“复制Fable”

美国官员指控月之暗面蒸馏Anthropic的Fable模型,并借助受限芯片和泰国服务器训练Kimi K3,但相关说法尚未形成公开证据闭环。多名研究者认为,Fable公开到Kimi K3发布只有约两周,纯靠蒸馏不足以解释模型能力;更关键的变量仍是月之暗面的自主研发、强化学习基础设施和算力来源。

Kimi K3模型蒸馏月之暗面
把405B大模型拆给陌生人跑,Petals是科研神器,不是云端替代品
人工智能 2026/7/23

把405B大模型拆给陌生人跑,Petals是科研神器,不是云端替代品

Petals让用户本地只装大模型的一部分,靠类似BitTorrent的节点网络接力完成推理,最高能碰到Llama 3.1 405B这类模型;官网标出的6 tokens/s数据来自Llama 2 70B单批测试,不是405B实测。它换来的是采样、执行路径和隐藏状态的控制权,代价是速度、稳定性和隐私都握在陌生节点手里——现在适合做研究实验,还不是云端API的替代品。

Petals分布式大模型推理Llama 3.1 405B