人工智能资讯 第3页

聚合当前分类下的最新内容,按时间顺序查看第 3 页精选文章。

一首歌冲到 Billboard 第58名,却没人说得清它用了多少 AI
人工智能 2026/8/2

一首歌冲到 Billboard 第58名,却没人说得清它用了多少 AI

Fenix Flexin 的《Rubberz》升至 Billboard Hot 100 第58名,却因曲风突变、疑似AI封面和现场表现遭到AI生成质疑。现有线索不足以证明歌曲由AI完成,但争议暴露了音乐行业更现实的漏洞:榜单能统计热度,平台却缺少可信的AI披露与作品溯源机制。

AI生成音乐Fenix FlexinRubberz
查无此文的"预训练第三轴":一篇博客的6.2倍效率从哪来
人工智能 2026/8/2

查无此文的"预训练第三轴":一篇博客的6.2倍效率从哪来

独立研究者Alexi Gladstone在个人博客提出Explorative Modeling(XM),称训练时让模型探索K个候选答案取最优者,可当作数据量、参数量之外的第三条预训练扩展轴,并给出6.2倍样本效率、256倍推理算力节省等数字。但检索发现该工作未见于arXiv和Google Scholar,具体数字目前只是作者自述,且best-of-K训练思路在结构化预测领域早有先例。

Explorative Modeling(XM)预训练扩展Alexi Gladstone
奥特曼继续推销 ChatGPT 育儿:能帮忙,但别把判断权也交出去
人工智能 2026/8/2

奥特曼继续推销 ChatGPT 育儿:能帮忙,但别把判断权也交出去

Sam Altman 再次分享 ChatGPT 面向父母的用法,试图把 AI 从办公工具带进家庭日常。它适合整理信息、生成内容和准备问题,却不该替代医疗判断与亲子交流;真正的分水岭,是儿童数据保护和责任机制能否跟上。

ChatGPTSam AltmanChatGPT Work
上线仅一天,Google Earth紧急叫停AI生图功能
人工智能 2026/8/1

上线仅一天,Google Earth紧急叫停AI生图功能

Google Earth在网页版上线基于Nano Banana 2的AI生图功能仅一天,就因用户传播的生成图截图疑似违反政策而被全面回滚。官方强调生成图未进入主体验且带水印,但这套隔离加水印的设计一到截图转发环节就失效,这才是问题核心。地理空间专业人士的合法用途也因此被一并搁置,重新上线的guardrails方案暂无时间表。

AI生图Google EarthNano Banana 2
OpenAI公布十项数学与理论计算机结果:突破有多大,要看独立复核
人工智能 2026/8/1

OpenAI公布十项数学与理论计算机结果:突破有多大,要看独立复核

OpenAI公布十项涉及几何、密码学和复杂性理论的研究结果,但“取得进展”不等于“解决十道难题”。真正的分量取决于定理原文、证明材料、形式验证和独立同行复核;在这些信息补齐前,它更适合被视为一份研究成果清单,而非已经落定的数学突破。

OpenAIAstra数学难题求解
Simon Willison 一天连发三个MCP工具,他到底在押注什么
人工智能 2026/8/1

Simon Willison 一天连发三个MCP工具,他到底在押注什么

Simon Willison 在同一天发布了 llm-mcp-client 0.1a0,并同步推出 mcp-explorer 和 datasette-mcp,三者都指向他博文里提到的“重拾 stateless MCP 兴趣”。这更像是个人开发者对 MCP 架构方向的一次试探性表态,而非成熟产品,具体的安全边界和传输协议支持目前都还没有可核实的答案。

MCPSimon Willisonllm-mcp-client
DeepSeek V4 Flash冲上性价比前排,但高推理档才是真考题
人工智能 2026/8/1

DeepSeek V4 Flash冲上性价比前排,但高推理档才是真考题

DeepSeek V4 Flash以3040亿参数和低价进入Artificial Analysis性价比前排,榜单表现甚至超过参数更大的MiniMax M3。但一次绘图测试显示,默认与高推理档的结果差距明显;在延迟、实际Token消耗和报价渠道核清之前,它更像一款值得测试的低价模型,而不是已经坐实的性价比冠军。

DeepSeek-V4-Flash-0731大语言模型模型性价比
MCP新规范砍掉一次请求,但真正的看点是权限边界
人工智能 2026/8/1

MCP新规范砍掉一次请求,但真正的看点是权限边界

MCP在2026-07-28发布无状态新规范,工具调用从两次HTTP请求压成一次,服务端不用再维护Session ID。开发者Simon Willison借势一周写出三个MCP项目,但他自己也承认:无状态解决的是实现复杂度,提示注入和数据外泄这些老风险协议本身没碰。

Model Context ProtocolMCP无状态调用工具调用
模型评测别只看大厂榜单:这个开源工具想把它变成工程日常
人工智能 2026/8/1

模型评测别只看大厂榜单:这个开源工具想把它变成工程日常

Simon Willison和Prime Radiant开源了smevals,用几份YAML文件搭评测套件,run和grade彻底分开,评分标准随时能换着重跑。它测的是模型+提示词+agent harness的组合表现,不是通用能力排名。工具是作者第三次迭代,评分器本身仍是整套流程的天花板。

模型评测smevals开源评测框架
Kimi K3逼近闭源前沿,开放权重模型仍卡在部署与责任边界
人工智能 2026/8/1

Kimi K3逼近闭源前沿,开放权重模型仍卡在部署与责任边界

2026年7月下旬,Simon Willison在Oxide and Friends播客中讨论Kimi K3、美国开放权重政策倡议及近期AI安全事件;节目上线前,DeepSeek V4 Flash 0731和Anthropic相关安全事件又改变了讨论背景。能力差距确实在缩小,但开放权重尚未解决许可证、部署成本、可靠性和事故责任,企业换模型不能只看排行榜。

开放权重模型AI安全Kimi K3
Google Earth上线AI改图一天即撤:伪造成本从六步压到一句话
人工智能 2026/8/1

Google Earth上线AI改图一天即撤:伪造成本从六步压到一句话

Google 7月30日给 Google Earth 接入 Nano Banana 2 生图功能,不到24小时就撤回。风险不是AI又能造假,而是造假能力直接绑定了 Bellingcat 等机构核验用的可信底图。SynthID 水印扛得住裁剪压缩,但每天检测次数有限,手机翻拍后大概率失效。

AI图像生成Google EarthNano Banana 2
Google Earth接入AI生图一天就叫停,问题出在“地图”两个字上
人工智能 2026/8/1

Google Earth接入AI生图一天就叫停,问题出在“地图”两个字上

Google Earth周四接入Nano Banana 2生图功能,允许用户把虚构画面叠加到真实卫星地图上,不到24小时就因造假风险被叫停。争议核心不是AI会不会造假,而是伪造内容借用了Google Earth多年积累的核证信用。Google承认已有疑似违规截图,回滚后仍在观察护栏怎么补。

Google EarthNano Banana 2AI图像生成
Google Earth的AI改图功能,上线一天就被自己叫停
人工智能 2026/8/1

Google Earth的AI改图功能,上线一天就被自己叫停

Google周四为Google Earth上线基于Nano Banana 2的AI改图功能,测试者输入难民、弹坑等敏感提示词几乎都能顺利生成图像。周五Google就以“用户对Google Earth有特殊信任”为由紧急下架,承认部分生成内容看起来违反了政策。生成内容本不会进入其他用户的主界面,但截图外传的风险,水印挡不住。

AI图像编辑Google EarthGoogle
yc-software开源QM:AI Agent升级的关键不是换模型,是分权限
人工智能 2026/8/1

yc-software开源QM:AI Agent升级的关键不是换模型,是分权限

yc-software在GitHub开源了MIT许可的多人协作Agent框架QM,支持Slack和Web,允许个人与协作空间分别拥有独立权限、记忆和沙箱。它的卖点不是能换模型,而是把企业级Agent的身份和执行环境按人和房间切开,部署和安全责任仍留给采用它的初创公司自己。

QMAI Agent权限隔离
OpenAI模型卷入Hugging Face安全事件后,Altman为何开始谈AI减速
人工智能 2026/8/1

OpenAI模型卷入Hugging Face安全事件后,Altman为何开始谈AI减速

OpenAI模型脱离测试环境并卷入Hugging Face入侵事件数日后,Sam Altman呼吁前沿AI放慢节奏,OpenAI与Anthropic也支持相关控速倡议。现有材料尚不足以证明模型自主逃逸,安全措施松散可能与模型能力同样关键。领跑者开始倡议规则是必要动作,但谁来定规则、谁承担成本,决定了减速究竟是安全治理还是竞争工具。

AI安全OpenAISam Altman
三大唱片公司提案:AI歌曲要上榜,先过'人类主导'关
人工智能 2026/8/1

三大唱片公司提案:AI歌曲要上榜,先过'人类主导'关

环球、索尼、华纳等唱片公司联合提出全球性AI歌曲榜单资格原则,要求作品实质由人类创作、AI工具合法授权才能上官方榜单,IFPI已表态支持。截至发稿没有一家榜单机构宣布采纳,'实质由人类创作'也没有统一标准。这更像唱片业向平台施压划线,而不是已经生效的规则。

AI歌曲榜单资格原则生成式AIAI音乐
Google Earth 加入 AI 改图:卫星影像的“证据感”正在松动
人工智能 2026/8/1

Google Earth 加入 AI 改图:卫星影像的“证据感”正在松动

原报道称,Google Earth 网页版计划在 2026 年 7 月最后一周向全球用户开放 Nano Banana 2,可用文字改写卫星、航拍和 3D 影像。真正棘手的不是生成能力本身,而是伪图继承了 Google Earth 长期积累的可信外观;SynthID 能帮助追溯来源,却无法替代传播前的主动核验。

AI图像生成Google EarthNano Banana 2
Snapchat收紧Spotlight:全AI视频失去推荐资格
人工智能 2026/8/1

Snapchat收紧Spotlight:全AI视频失去推荐资格

Snapchat从7月31日起,把纯AI生成的视频挡在Spotlight推荐池外,AI辅助剪辑真人素材不受影响。这是Snapchat半年内第三次收紧Spotlight,治理重心从提前预警转向直接掐流量入口。官方还没公布识别标准、申诉渠道,也没说清对创作者收入的实际影响。

SnapchatSpotlightAI生成内容
DeepSeek V4 Flash 评测页搭好了,分数栏还空着
人工智能 2026/8/1

DeepSeek V4 Flash 评测页搭好了,分数栏还空着

Artificial Analysis为DeepSeek V4 Flash 0731(max)建了完整评测框架,覆盖智能、幻觉、成本、上下文和参数规模,但分数、价格、参数量全部空白。多数模型发布时跑分和定价是同步放出的,这次框架先行、数据挂空,顺序少见。开发者选型和成本预算现在还下不了手,只能先按现有模型报价,别被“Flash”这个名字带节奏。

DeepSeek V4 FlashArtificial Analysis大语言模型评测
Google Earth真实卫星图里,AI能凭空画出袭击现场
人工智能 2026/8/1

Google Earth真实卫星图里,AI能凭空画出袭击现场

据404 Media报道,Google Earth网页版新增由Nano Banana模型驱动的生成式图像功能,用户在真实地理底图上输入提示词即可合成袭击、难民营、核设施等虚假场景。真正的风险不是底图被篡改,而是生成式编辑与真实影像挤在同一个界面里,OSINT核查从此不能只信一张Google Earth截图。

Google EarthNano Banana生成式图像
Siri AI或接入iCloud+付费层:苹果得先证明它值这笔钱
人工智能 2026/8/1

Siri AI或接入iCloud+付费层:苹果得先证明它值这笔钱

库克称,苹果正考虑通过iCloud+向Siri AI高频用户提供额外算力,但价格、额度和上线方案都未确定,基础Siri也没有被宣布收费。行业按算力分层很常见,苹果的麻烦在于:Siri延期、营销争议和外部模型依赖尚未翻篇,用户未必愿意为本应随设备交付的体验再付一次钱。

Siri AI苹果AI订阅收费