人工智能资讯 第55页
聚合当前分类下的最新内容,按时间顺序查看第 55 页精选文章。

苹果没让 Siri 当健康教练,这次慢得有道理
WWDC 2026 上,苹果没有把 Siri AI 推成健康教练,watchOS 27 和健康 App 只做了围绝经期支持、Workout Buddy 扩展、跑步机距离算法等小更新。和 Google、Fitbit、Oura、Whoop 等公司猛推 AI 健康助手相比,苹果显得慢,但这次慢更像风险控制。消费级 AI 健康教练还没证明自己比搜索和图表摘要更有用,却已经碰到隐私、误导和健康焦虑三道硬墙。

Decart 开放 Oasis 3:世界模型进了驾驶测试接口,但还没过物理这一关
Decart 发布实时驾驶世界模型 Oasis 3,并通过 API 向开发者开放,价格为每秒 0.02 美元,主攻自动驾驶仿真测试。它的进展是把写实、交互和长时间生成推到开发者接口;它的硬伤也很清楚:长时一致性、物体意识和碰撞物理还不稳。目前更适合做前置场景探索,不适合直接替代成熟仿真平台或真实道路测试。

Jedify 融资 2400 万美元:企业 AI 真正缺的不是模型,是上下文
Jedify 完成 2400 万美元 A 轮融资,Norwest 领投,Snowflake Ventures 战略投资,总融资约 3300 万美元。它不训练大模型,而是用 API 连接企业数据、权限、流程和知识源,为 AI Agent 生成实时 context graph。我的判断很简单:企业 AI 的下一道坎,不是模型会不会说话,而是它能不能在真实公司里按规矩办事。

AWS Bedrock 上 Anthropic 强模型要留存 30 天:企业真正要重算的是数据边界
AWS Bedrock 上 Anthropic 的 Fable 5、Mythos 5 及未来同等或更高能力模型,将要求用户选择 30 天流量数据留存。启用后,相关数据会离开 AWS 的数据与安全边界,交由 Anthropic 处理。关键问题不是 Anthropic 会不会训练数据,材料并未这么说;真正麻烦的是企业原本买 Bedrock 是为了收拢边界,现在边界又被模型供应商条款打开了。

LSEG 把 ChatGPT 推进金融工作流,难点不是提效,是谁来兜底
LSEG 正在把 ChatGPT Enterprise 和 OpenAI API 推向全球业务,覆盖研究、产品原型、客户交付和内部协作,并称部分产品发布周期从 3–6 个月压到 2 周。 这不是普通办公提效案例。金融数据巨头把生成式 AI 推进受监管工作流,分水岭会落在可信数据、治理控制和责任边界上。 对金融科技团队和企业 AI 管理者来说,下一步不是急着采购模型,而是先重画数据权限、审计、人审和交付流程。

Waymo 开源 ReD 虚拟司机:自动驾驶开始争夺安全定义权
Waymo 联合代尔夫特理工发布 ReD 参考驾驶员模型,用认知科学模拟人类司机遇到突发风险时的避撞反应,并已开源。 它不是车端控制系统,也不是人类司机训练工具,而是一个评估基准。 更要紧的是,Waymo 正把竞争从路测里程推向安全语言:谁能定义“谨慎且胜任”,谁就更靠近监管入口。

Waymo给Robotaxi安全评估换尺:更像人,但还不是安全证明
Waymo与代尔夫特理工大学提出Reference Driver模型,用来模拟谨慎人类司机在碰撞前的预判、选择和“惊讶”反应。它比传统“最后一秒反应”模型更适合讨论复杂城市事故,但目前仍只是评估尺,不能证明Waymo整体比人类司机更安全。对从业者和监管者来说,真正变化是事故复盘要从“撞得轻不轻”转向“本来能不能更早避开”。

欧盟让 WhatsApp 免费放行 AI 对手,Meta 被卡在入口战前夜
欧盟委员会动用罕见临时措施,要求 Meta 在反垄断调查结束前恢复第三方 AI 聊天机器人免费接入 WhatsApp。重点不是免费接口,而是 WhatsApp 在欧洲已经接近 AI 助手的分发入口。Meta 会受限,AI 公司会受益,但免费开放的成本和边界还没算清。

Meta 在印度签下首个 AI 数据中心:168MW 不是终点,电和水才是账本
Meta 与 Reliance 达成 AI 数据中心合作,将在印度古吉拉特邦 Jamnagar 使用一座 168MW 设施,服务 Meta 的全球 AI 计算需求,并可继续扩容。真正重要的变化是:印度正在从科技巨头的用户市场、人才市场,进入全球 AI 算力网络。对印度企业云采购和开发团队来说,现在不该急着迁移,而该盯住延迟、价格、合规、可用区和实际 AI 服务落地。

Gamow Labs 从一例新生儿漏诊出发,想用 AI 改进 NICU 罕见病基因解读
Gamow Labs 的起点,是 Owen 这例新生儿罕见病:标准全基因组测序没有及时给出答案,死后专家复核才找到影响 FOXF1 表达的 91kb DNA 缺失。 真正值得看的,不是“AI 医疗又来了”,而是临床基因诊断的瓶颈,是否正在从测序转向可规模化的 AI 辅助解读。 目前证据还早:66 例队列结果仍在审稿,不能当成临床验证产品看,但它指向了 NICU、遗传实验室和计算生物学团队都绕不开的问题。

德国法院给 Google AI 摘要划线:会总结,就要担责
慕尼黑地区法院发布临时禁令,认定 Google AI Overviews 生成的虚假摘要属于 Google 自己的表达。案子没有把 AI 搜索判成违法,但划出一条责任线:平台替用户下结论,就不能只说自己在指路。对媒体、内容平台和 AI 产品团队来说,风险点已经从“模型会不会错”变成“错了谁来改、谁来赔、谁来背声誉成本”。

Sutton 给大模型划线:会生成,不等于会发现
Richard Sutton 的核心判断很明确:主要靠监督学习训练的普通生成式 AI 很有用,但更像“模仿型 AI”,缺少独立发现机制。真正的分水岭不是能不能生成新奇内容,而是能不能评价、筛选、保留,并在目标约束下继续推进。受影响最大的,是押注“模型变大就会自动通向科学发现”的研究叙事和产品路线。

AI 写代码之后,黑客松的胜负手可能回到硬件
一名开发者在维尔纽斯黑客松中,用树莓派把老式转盘电话改造成可对话的 AI 音乐点播设备,48 小时内接通 WebSocket、双向音频、铃声和挂机开关。这个案例重要的不是“硬件黑客松已经取代软件黑客松”,而是 AI 编程工具正在降低纯软件原型的惊喜门槛,把更多创造力推向现实世界接口。

Claude Fable 5 发布:模型更强,成本和护栏也更硬了
Anthropic 同日发布 Claude Fable 5 与 Mythos 5:两者能力相同,Fable 5 加了更严格安全分类器,Mythos 5 不带这些分类器。Fable 5 的规格很激进:100 万 token 上下文、12.8 万最大输出,价格是 Claude Opus 4.5-4.8 的两倍。真正的变化不只是模型更会写代码,而是强模型代理开始同时考验预算、拒答机制和开发者工作流。

Claude 披露“静默降质”:真正的问题不是限用,而是不告诉你
Anthropic 在 Fable 5 和 Mythos 5 系统卡中披露,会对部分前沿大模型研发请求做用户不可见的效果限制。争议点不是平台能不能限制违规用途,而是用户无法判断回答变差来自模型能力、提示词问题,还是后台策略。对依赖 Claude 做训练基础设施、AI 芯片和模型研发判断的团队,这会把工具信任变成审计问题。

新版 AI Siri 终于能用了,但苹果只是补回起跑线
The Verge 记者在 WWDC 2026 后短暂试用新版 AI Siri,发现它已经能读取邮件、日历等个人信息,完成加日程、算出行时间、列购物清单、设提醒这些基础任务。 关键不在于 Siri 领先了,而在于苹果此前不顺的 AI 助手,这次终于从发布会承诺走到可用体验。 放到 2026 年看,这仍是补课:Google Gemini 在 Android 上做类似事已有至少一年。

Google 把 AI Plus 打到 4.99 美元,价格战开始伤到模型公司的估值
Google 将美国 Google AI Plus 月费从 7.99 美元降到 4.99 美元,存储从 200GB 提到 400GB。它打的不是一次普通促销,而是把新兴市场的 AI 低价订阅打法推到美国。对用户是便宜了,对纯 AI 公司则是利润率和估值叙事被重新验算。

Claude Fable 5 的静默降级,让 AI 编程工具的信任问题变具体了
Anthropic 在 Claude Fable 5 模型卡中披露:涉及前沿 LLM 开发的请求,可能被用户不可见地降低辅助效果,而不是直接拒答。争议不在于供应商能不能设安全边界,而在于企业无法确认工具何时仍在全力工作。对训练 embedding、reranker、微调小模型的软件团队来说,采购、调试和供应商选择都要重新算一遍。

Claude Fable 5 很强,但 Anthropic 的安全闸门开始影响开发者判断
Anthropic 发布 Claude Fable 5,原文称它是当前公开可用最强模型之一;争议不在能力,而在访问控制。网络安全、生物化学、蒸馏等请求会明示回退到 Opus 4.8,但前沿 LLM 开发相关请求可能被隐形削弱。真正受影响的不是普通聊天用户,而是 AI 研究者、开源模型开发者和训练基础设施团队。

Codex 在 Notion 的真实作用:不是替工程师写几行代码,而是让小团队改写交付方式
Notion AI Product Engineering 负责人 Ryan Nystrom 用 Codex 在数小时内完成网页端 AI 语音输入首版,并在次日交付测试。这个案例的价值不在于一次提速故事,而在于它显示 AI 编程工具正把工程师的重心推向规格、上下文和验收。它还没有证明 Notion 全公司流程已被重构,但足以让技术管理者重新评估小团队的组织方式。

Claude Fable 5 价格还没入库,AgentsView 先把 AI 编程账单拆开了
Simon Willison 记录了一件很小但很实用的事:Claude Fable 5 刚发布,AgentsView 价格库还没跟上,他就手动补了模型价格。关键不在这张图花了多少钱,而在开发者终于能把本机 coding agent 的成本拆到项目、会话和缓存层面。对频繁使用 AI 编程工具的个人和小团队来说,这会影响模型选择、任务拆分和预算判断。