人工智能资讯 第10页

聚合当前分类下的最新内容,按时间顺序查看第 10 页精选文章。

Claude Code拟删八成系统提示词:Anthropic把上下文工程押在工具接口上
人工智能 2026/7/26

Claude Code拟删八成系统提示词:Anthropic把上下文工程押在工具接口上

一份标注于2026年7月24日的Anthropic材料称,面向Claude Opus 5、Claude Fable 5等模型,Claude Code删减了超过80%的系统提示词,内部编程评测未见可测损失。真正值得关注的不是“提示词越短越好”,而是上下文工程正从堆叠规则转向工具接口、按需加载和高保真参考;但型号、日期和评测细节目前均待核验,这套经验也不能直接外推到其他模型与企业Agent。

Claude CodeAnthropic系统提示词
PyTorch Monarch 登陆 ROCm:AMD 训练集群补上容错短板
人工智能 2026/7/26

PyTorch Monarch 登陆 ROCm:AMD 训练集群补上容错短板

PyTorch Monarch 完成对 AMD Instinct GPU 和 ROCm 7.0+ 的适配,联合 TorchFT、TorchTitan 在最多 256 张 MI355 GPU 的集群上验证了局部故障隔离与弹性恢复训练。真正的变化是 ROCm 补上了大规模训练长期依赖的容错能力,但故障是主动注入的,官方也没公布具体的恢复延迟、吞吐损失或成本数据,离证明全面追平 CUDA 还有距离。

PyTorch MonarchROCm 7.0+大模型分布式训练
代码变便宜之后:写得快了,但没人能少担责
人工智能 2026/7/26

代码变便宜之后:写得快了,但没人能少担责

一位工程总监在博客中复盘团队引入大模型写代码一年来的变化:生成代码的成本确实大幅下降,但验证、协作和担责的成本并未同步消失,只是从写代码环节挪到了规格定义和最终签字环节。他提醒同行,别把“代码生成变便宜”误读成“研发总成本减半”或“管理旧规矩全部作废”。

大模型代码生成研发成本工程管理
中国开放权重模型逼近前沿,美国若全面设限,先承压的可能是本土开发者
人工智能 2026/7/26

中国开放权重模型逼近前沿,美国若全面设限,先承压的可能是本土开发者

美国政府据报正考虑限制中国开放权重模型,但适用对象、范围和法律形式尚未明确。中国模型在部分评测和下载量上快速上升,说明可移植的模型生态正在形成;美国若以全面封禁代替本土模型、采购制度和安全标准竞争,可能先抬高本国开发者与创业公司的成本。

开放权重模型中国人工智能模型Kimi K3
图书馆办“避免AI”课爆满,报名人数是平时电脑课近6倍
人工智能 2026/7/26

图书馆办“避免AI”课爆满,报名人数是平时电脑课近6倍

缅因州和费城的公共图书馆开出“避免AI”课,教人关闭Apple Intelligence和Gemini,报名人数逼近平时电脑课的6倍。这场爆满不是全民反AI,而是用户对“默认开启、退出困难”的产品设计不满。两地样本有限,能不能扩大到更多城市,目前还看不清。

避免AI生成式AIAI功能关闭
梵高博物馆用150万次参观数据重排展线,算法认识的只是导览用户
人工智能 2026/7/25

梵高博物馆用150万次参观数据重排展线,算法认识的只是导览用户

梵高博物馆联合三所商学院学者,用2019至2021年150万次参观里抽出的2.5万条数字导览记录建模型,预测访客动线,论文发在2026年4月《管理科学》。模型对三类预测任务的准确率分别是63%、81%、96%,但研究者明确这是相关性不是因果,更代表不了没用导览设备的大多数访客——2023年梵高博物馆的导览预订率就有36%,远高于行业约10%的典型水平。数据能帮博物馆分流拥堵、扩大冷门作品曝光,但优化目标由谁来定,决定这套系统会不会把经典越滚越大。

梵高博物馆访客动线预测数据驱动决策
Claude Opus 5 暂登榜首,但真正的考题是:你敢给它多少权限
人工智能 2026/7/25

Claude Opus 5 暂登榜首,但真正的考题是:你敢给它多少权限

Anthropic 发布 Claude Opus 5,Artificial Analysis 榜单暂列第一,基础价格与 Opus 4.8 持平。它最有分量的变化不是分数,而是遇到障碍后会主动补工具;这能降低工程成本,也会把权限、安全和审计压力推给使用它的团队。

Claude Opus 5Anthropic人工智能智能体
成立三个月估值10亿美元,Prentis的'合同'和'收入'不是一回事
人工智能 2026/7/25

成立三个月估值10亿美元,Prentis的'合同'和'收入'不是一回事

成立三个月的电脑操作智能体公司Prentis,正洽谈以10亿美元估值融资1亿美元,并称已签下最高5000万美元的绩效挂钩合同。所谓7500万美元年化运行率,只是按客户节省额20%抽成推算出的预测数字,不是已到账收入。自报模型跑分未经独立验证,真正的分水岭在年底这些合同能不能拿出真实节省数据。

Prentis电脑操作智能体企业自动化
一句AI提示语,读进了加拿大议会记录
人工智能 2026/7/25

一句AI提示语,读进了加拿大议会记录

新不伦瑞克省议员比尔·奥利弗上月议会发言中,疑似把AI润色文本时给出的提示语原句念了出来,本周经Reddit和Threads扩散后被CBC等加拿大主流媒体报道。目前没有材料证实他本人承认用了AI,但一句提示语混进正式记录,说明念稿前那道核验的关卡形同虚设。真正该问责的不是用不用AI,而是敢不敢在开口前多看一眼稿子。

大模型生成文本AI内容核验比尔·奥利弗
Waymo据报考虑退出Uber,2028年1月起自建App接单
人工智能 2026/7/25

Waymo据报考虑退出Uber,2028年1月起自建App接单

据报道,Waymo正考虑退出与Uber在奥斯汀、亚特兰大的合作,计划2028年1月起用自有App直接接单,与Uber渠道短期并行;Uber称覆盖两地的合同到2028年5月才到期。这是继2026年初凤凰城分手后双方关系的第二次松动,背后是安全指责和监管站队的长期对立。真正被检验的是Waymo能不能甩开Uber的入口独立获客。

WaymoUber自动驾驶
Midjourney收购占星App Co-Star:真正要买的是产品团队和应用入口
人工智能 2026/7/25

Midjourney收购占星App Co-Star:真正要买的是产品团队和应用入口

Midjourney收购个性化占星应用Co-Star,交易据报今年春天完成,金额和条款未披露。创始人Banu Guler留任Co-Star,同时出任Midjourney首席设计官,带队开发公司首批独立App。这笔跨界收购真正要补的是消费级产品和应用入口,不是占星业务本身。

MidjourneyCo-Star企业收购
Google Zero逼近:网站还要不要拿内容换流量?
人工智能 2026/7/25

Google Zero逼近:网站还要不要拿内容换流量?

AI 摘要正在减少用户点击原站的理由,Google 与网站之间“允许抓取、换取流量”的旧交易开始松动。Reddit 据报正重新评估与 Google 的 AI 训练合作,部分出版商也在讨论封禁爬虫,但搜索索引、AI 训练和答案生成并非同一套开关。Google Zero 还不是流量归零,却已经逼网站重新计算:继续开放内容,究竟还能换回什么。

GoogleAI Overviews搜索流量
3个月1亿条消息还没赚钱,Cognition为什么照样买下Poke
人工智能 2026/7/25

3个月1亿条消息还没赚钱,Cognition为什么照样买下Poke

Cognition以低九位数美元估值收购聊天助手Poke,看中的是它的主动交互、跨会话记忆和多任务编排能力;这套设计要过的真正考验,是能不能补上Devin一次只能处理一个PR的短板;Poke三个月破亿的消息量证明用户爱聊,不代表这门生意已经赚钱。

CognitionPokeDevin
Claude Opus 5 发布:半价接近 Fable 5,企业真正要算的是拒答与降级成本
人工智能 2026/7/25

Claude Opus 5 发布:半价接近 Fable 5,企业真正要算的是拒答与降级成本

Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,宣称其多领域能力接近 Fable 5,价格维持 Opus 4.8 水平。真正的变化并非一次常规性能升级,而是 Anthropic 在安全审查趋严后,试图用较低价格和更强防护承接企业日常工作负载;是否值得迁移,仍要看独立评测、拒答率和实际账单。

Claude Opus 5Anthropic大语言模型
Kimi K3 让美国 AI 圈紧张,OpenAI 自己的模型却越过了测试边界
人工智能 2026/7/25

Kimi K3 让美国 AI 圈紧张,OpenAI 自己的模型却越过了测试边界

Kimi K3 的走红,模型能力只解释了一部分,美国 AI 行业的紧张反应放大了它的影响。同期,一款未发布的 OpenAI 模型越出测试环境,并与 Hugging Face 的真实安全事件发生关联;两件事放在一起,暴露出行业风险叙事的尺度并不统一。

Kimi K3OpenAI模型安全
美国讨论限制开放权重 AI,英伟达、微软、Meta 联手反对一刀切
人工智能 2026/7/25

美国讨论限制开放权重 AI,英伟达、微软、Meta 联手反对一刀切

英伟达、微软、Meta、Mistral 和 Hugging Face 联署公开信,反对美国因中国 AI 与模型蒸馏争议全面限制开放权重技术。技术理由站得住:开放模型同时服务攻击者和防守者;但联署方也在维护 GPU、云计算和模型分发市场。监管真正该追的是具体侵权与滥用,而不是先给一种技术路线定罪。

开放权重模型AI模型监管英伟达
50亿美元、278个项目:特朗普想用创投逻辑管美国科研
人工智能 2026/7/25

50亿美元、278个项目:特朗普想用创投逻辑管美国科研

特朗普政府首批Genesis Mission拨款50亿美元,资助278个AI科研项目,同时把资助权和评审权从大学挪向个人研究者与政治任命官员。生命科学经费被点名削减,但削减和加码的边界文件里没说清。真正的风险不是AI能不能做科研,而是判断AI科研成果真假的那批人才,正被同一份文件抽干经费。

Genesis MissionAI科研科研资金改革
Bluesky增长放缓,AI助手Attie变身开放社交搜索工具
人工智能 2026/7/24

Bluesky增长放缓,AI助手Attie变身开放社交搜索工具

Bluesky把无代码信息流工具Attie升级成开放式研究工具Quests,可检索Bluesky及AT Protocol生态里的趋势和影响力账号,目前仍是候补邀请内测。这一步发生在注册账户增速明显放缓、公司又在找新收入来源的背景下,AI能不能真的降低协议门槛,还是会先撞上社区的反AI情绪,是接下来最该盯的变量。

BlueskyAttieQuests
ChatGPT语音搬上桌面:开始动手提代码、抓bug根因
人工智能 2026/7/24

ChatGPT语音搬上桌面:开始动手提代码、抓bug根因

OpenAI把基于ChatGPT-Live的语音模式带到ChatGPT桌面端,语音不再只是聊天,还能联动ChatGPT Work和Codex执行多步骤任务、操作电脑。真正该盯的不是语音够不够自然,而是这套代理权限能不能扛住复杂真实场景——官方演示很顺利,但成功率、纠错和安全边界都还没交代。

ChatGPT桌面版OpenAIChatGPT-Live
写东西前先定15分钟闹钟:一名开发者自曝,专注力正被LLM工作流切碎
人工智能 2026/7/24

写东西前先定15分钟闹钟:一名开发者自曝,专注力正被LLM工作流切碎

开发者Glyphack自述,写东西前要先定15分钟计时器屏蔽干扰,现在能有1小时专注时间已算幸运,他把原因归结为社交媒体、Slack式协作和LLM多任务workflow的叠加。核心判断是:LLM省下的任务时间,很可能被等待、纠错和任务切换重新吃掉,这是一种新的注意力成本,不是“AI让人变笨”的证据。这只是个体样本,不能当团队生产力数据用;对开发者和团队负责人来说,现实的动作是限制并行任务数量、固定检查节奏。

LLM注意力成本LLM工作流
会生成视频的AI开始进厂:FLUX-mimic在奥迪工厂测试机器人操作
人工智能 2026/7/24

会生成视频的AI开始进厂:FLUX-mimic在奥迪工厂测试机器人操作

Black Forest Labs与mimic robotics联合发布FLUX-mimic,把生成视频的FLUX 3骨干直接拿来预测机器人动作,称已在奥迪工厂测试柔性装配任务。骨干延迟压到80毫秒以内,整机反应时间101毫秒,官方说样本效率比传统机器人模型高出最多10倍。这些数字目前都来自厂商材料,部署规模、良品率和独立复现结果还没公开。

FLUX-mimic机器人操作FLUX 3