人工智能资讯 第13页
聚合当前分类下的最新内容,按时间顺序查看第 13 页精选文章。

Kimi K3拿下榜单第二,但每个任务要烧掉10.57美元
Kimi K3在AA-Briefcase智能体知识工作基准拿到1543 Elo,仅次于Fable 5;但单任务平均耗资10.57美元、耗时56.4分钟,分析能力强、呈现能力弱。这意味着它目前更适合高价值低频任务,还谈不上大规模生产替代品。

Anthropic传洽购Physical Intelligence,OpenAI股东身份让交易更复杂
Anthropic今春确曾与机器人基础模型公司Physical Intelligence接触,但周末流传的成交消息尚未获证实,后者CEO已在Slack上否认。真正值得关注的,是Anthropic在上市前加速补齐机器人能力,以及OpenAI作为Physical Intelligence投资方可能带来的交易权利与利益冲突。

Meta 试水 AI 睡前故事应用 StoryKit:家长省事的代价还没算清
Meta 证实旗下 StoryKit 已在 App Store 部分国家小范围试点,家长拍张照片就能生成孩子专属睡前故事。应用仅限18岁以上用户操作、无社交功能,但内容审核标准和照片数据处理方式都还没公开。省下的是编故事的时间,没说清的是隐私和亲子互动这两笔账。

Kimi K3战平Fable,SoTA标签贴的是路由不是模型
Fireworks用约1030个智能体任务对练开源Kimi K3和闭源Fable 5,总分打平但任务分工分明。所谓93%综合准确率和最高50倍成本优势,都建立在事后诸葛的oracle routing之上,是理论上限,不是能直接部署的路由器。真正该看的不是谁赢了跑分,是这套自测数据离真实业务场景还有多远。

布洛姆坎普用 Seedance 2.0 拍了部“全镜头 AI”短片,但电影还没被生成出来
尼尔·布洛姆坎普用 Seedance 2.0 生成了13分钟科幻短片《Nightborne》的全部镜头,并把它称为未来制作 AI 长片的“test start”。这次实验证明模型已经能拼出电影感,却还没有回答长片最难的问题:如何持续控制叙事、表演、角色和创作责任。

英伟达画出物理AI仿真全景图:仿真正从调试工具变成训练基础设施
英伟达7月发文梳理MuJoCo、MuJoCo Warp、Isaac Sim、Isaac Lab与新开源引擎Newton的关系,核心变化是仿真从机器人调试工具转向具身模型训练基础设施。Isaac Lab 3.0已解耦Isaac Sim依赖,可接入Newton等轻量后端,但吞吐量高不等于sim-to-real效果好。机器人研发团队要按任务在训练速度、物理精度和部署成本之间取舍,产品负责人也不能把开源等同于省预算。

15亿美元和解落槌:91%作者领钱,Anthropic真正买到的是什么
美国法官正式批准Anthropic与作者集体诉讼的15亿美元和解,91%的作者和出版商已申领赔偿,仅350人成功退出,律师费和原告个人奖励都被法院削减。这笔创纪录和解真正定的规矩不是AI能不能用书训练,而是书是怎么到手的。

Substack上线AI检测器:测得出AI,测不出用心
Substack接入AI检测公司Pangram,读者可在网页和iOS端扫描全站超过100词的文章、Notes、回复和评论,估算AI写作比例。这把尺子只测“用没用AI”,测不出敷衍还是用心,Substack也没公布误报率或申诉时效。真正决定它有没有用的,是误伤认真作者时平台怎么兜底。

Jack Dorsey 发布 Buzz:AI 智能体进了团队聊天室,但离换掉 Slack还早
Block 发布开源协作应用 Buzz,把员工聊天、AI 智能体和 GitHub 项目管理放进同一窗口,桌面端已免费覆盖 macOS、Windows、Linux。它的看点不是像不像 Slack,而是让 AI 智能体第一次以对话成员身份出现,但产品仍处早期,权限、模型支持、安全机制这些细节都还不透明。新团队可以小范围试用,被 Slack 绑定多年的企业眼下不适合整体迁移。

Dorsey的Buzz:人类和AI代理共用一套身份系统,但去中心化只对了一半
Block开源工作空间Buzz,用统一身份和签名事件把团队聊天、AI代理、Git托管和工作流拼进同一套系统,分支能直接变频道,Apache 2.0协议支持自托管。所谓去中心化,说的是组织能自建服务器、自留数据,但一个工作区仍只有一台权威中继,没有P2P交换或跨中继复制。目前只是早期测试版,移动端和部分审批流程还没做完,工程团队要不要现在下注,得先算清迁移成本和自托管运维这两笔账。

Anthropic 15亿美元版权和解获批:分界线在书从哪来,不在AI能不能训练
联邦法官批准Anthropic与作者集体诉讼的15亿美元和解,每本涉嫌盗版训练书赔约3000美元,超91%适格作者和出版商已申领。这笔钱赔的是盗版取材,不是AI训练本身——法院此前已认定合法购书训练可能受合理使用保护。和解只约束Anthropic这批原告,对其他AI公司没有强制力,却给行业标出一个真实的盗版数据风险价格。

三款 Flash 发布,Gemini 3.5 Pro 仍缺席:Google 先抢 Agent 成本战
Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和受限试点的 3.5 Flash Cyber,重点压在成本、延迟与规模化 Agent。真正牵动竞争叙事的 3.5 Pro 仍未上线,说明 Google 能用工程效率守住生意,却还没交出足以稳定旗舰预期的答案。

Gemini 3.6 Flash降价提速上线,旗舰3.5 Pro却又跳票
Google一口气推出3.6 Flash、3.5 Flash Lite和面向网络安全的3.5 Flash Cyber,主打降价提速而非能力跃升,承诺6月上线的旗舰3.5 Pro仍在测试,Gemini 4已开始预训练。这暴露出Google当下的重心是压低推理成本抢占规模化应用,旗舰模型在编码能力和交付节奏上的压力反而更明显。

OpenAI 向美国小企业推广 ChatGPT,培训只是入口
OpenAI 推出面向美国小企业的专项项目,提供线上实操课、线下 AI 学院、入门指南,以及 Dropbox、Shopify、Intuit 等合作伙伴的应用、技能和优惠。它不是新的免费计划或订阅套餐,而是一项降低采用门槛、扩大商业用户入口的市场推进计划。小企业是否值得接入,最终仍取决于价格、权限、数据安全和自动化结果能否稳定复核。

美国把AI限制推向模型层,真正难题是如何证明“蒸馏”侵权
美国财长贝森特于2026年7月21日表示,将审查中国开放模型是否侵犯美国企业知识产权,并在认定侵权后考虑制裁相关中国AI公司。华盛顿的限制工具正从先进芯片延伸到模型和开发商,但制裁能否落地,取决于版权、服务条款、商业秘密与制裁法律依据能否被分别证明。

谷歌一口气发布三款Flash模型:两款降价提速公开,一款锁进政府高墙
谷歌于2026年7月21日发布Gemini 3.6 Flash和3.5 Flash-Lite并直接开放公开渠道,同时预告3.5 Flash Cyber仅通过CodeMender向政府和可信伙伴限量试点。这轮更新的重心不是堆更强的模型,而是压低单次代理任务的Token账单、抬高吞吐,基准分数则需按具体测试口径谨慎看待。

旧书订单暴涨:ISBNdb称为AI公司囤'洁净'纸质书
ISBNdb称能为AI实验室单笔采购1000到100万册2022年前出版的纸质书,买家身份靠NDA隐去;多地旧书商反映订单暴涨,但无人证实买家就是AI公司;旧书洁净换不来版权免责,冷门外文书和孤本风险最大。

Google 披露三款 Gemini Flash:Agent 开始算总成本了
Google 材料披露 Gemini 3.6 Flash、3.5 Flash-Lite 和受限试点的 3.5 Flash Cyber,主攻 Agent 的成本、吞吐量与网络安全任务。真正影响选型的不是基准分数,而是一次任务要循环几轮、调用多少工具、产生多少误改;这些生产数据,目前仍缺少独立验证。

Deezer日增9万首AI音乐:新增上传过半,版税池才是真正战场
Deezer披露,2026年6月平台每天收到约9万首AI生成曲目,占新增上传量逾50%,但这不代表AI已占据一半曲库、播放量或收入。平台将清理半年无人收听或涉嫌刷量的AI曲目,真正需要守住的是推荐系统和版税池,而不是音乐生产工具的边界。

不用机器人也能采数据:Pollen Robotics开源490欧元装置Grabette
法国机器人公司Pollen Robotics于2026年7月21日发布开源手持采集装置Grabette,物料成本约490欧元,示范经浏览器处理后自动生成LeRobot数据集并上传Hugging Face Hub。它把真实操作数据的采集门槛降到几百欧元级别,但硬件组装、配套执行器Gripette和数据规模验证仍是没解决的问题。官方示例仅用约200条示范训练策略,离规模化数据集还有距离。

一张图塞下9种版式,通义新模型的真考验才刚开始
阿里通义发布Qwen-Image-3.0,官方演示一张图能塞下4.5k token指令、10px小字和12种语言,试卷、报纸、四层嵌套UI都能一次生成。但这些全是官方精选样例,批量出错率、改稿一致性和成本一个都没公开。真正决定它能不能进产线的,不是九宫格多惊艳,而是独立测试会不会撑住这些数字。