人工智能资讯 第66页

聚合当前分类下的最新内容,按时间顺序查看第 66 页精选文章。

代码变便宜之后:写得快了,但没人能少担责
人工智能 2026/7/26

代码变便宜之后:写得快了,但没人能少担责

一位工程总监在博客中复盘团队引入大模型写代码一年来的变化:生成代码的成本确实大幅下降,但验证、协作和担责的成本并未同步消失,只是从写代码环节挪到了规格定义和最终签字环节。他提醒同行,别把“代码生成变便宜”误读成“研发总成本减半”或“管理旧规矩全部作废”。

大模型代码生成研发成本工程管理
中国开放权重模型逼近前沿,美国若全面设限,先承压的可能是本土开发者
人工智能 2026/7/26

中国开放权重模型逼近前沿,美国若全面设限,先承压的可能是本土开发者

美国政府据报正考虑限制中国开放权重模型,但适用对象、范围和法律形式尚未明确。中国模型在部分评测和下载量上快速上升,说明可移植的模型生态正在形成;美国若以全面封禁代替本土模型、采购制度和安全标准竞争,可能先抬高本国开发者与创业公司的成本。

开放权重模型中国人工智能模型Kimi K3
图书馆办“避免AI”课爆满,报名人数是平时电脑课近6倍
人工智能 2026/7/26

图书馆办“避免AI”课爆满,报名人数是平时电脑课近6倍

缅因州和费城的公共图书馆开出“避免AI”课,教人关闭Apple Intelligence和Gemini,报名人数逼近平时电脑课的6倍。这场爆满不是全民反AI,而是用户对“默认开启、退出困难”的产品设计不满。两地样本有限,能不能扩大到更多城市,目前还看不清。

避免AI生成式AIAI功能关闭
梵高博物馆用150万次参观数据重排展线,算法认识的只是导览用户
人工智能 2026/7/25

梵高博物馆用150万次参观数据重排展线,算法认识的只是导览用户

梵高博物馆联合三所商学院学者,用2019至2021年150万次参观里抽出的2.5万条数字导览记录建模型,预测访客动线,论文发在2026年4月《管理科学》。模型对三类预测任务的准确率分别是63%、81%、96%,但研究者明确这是相关性不是因果,更代表不了没用导览设备的大多数访客——2023年梵高博物馆的导览预订率就有36%,远高于行业约10%的典型水平。数据能帮博物馆分流拥堵、扩大冷门作品曝光,但优化目标由谁来定,决定这套系统会不会把经典越滚越大。

梵高博物馆访客动线预测数据驱动决策
成立三个月估值10亿美元,Prentis的'合同'和'收入'不是一回事
人工智能 2026/7/25

成立三个月估值10亿美元,Prentis的'合同'和'收入'不是一回事

成立三个月的电脑操作智能体公司Prentis,正洽谈以10亿美元估值融资1亿美元,并称已签下最高5000万美元的绩效挂钩合同。所谓7500万美元年化运行率,只是按客户节省额20%抽成推算出的预测数字,不是已到账收入。自报模型跑分未经独立验证,真正的分水岭在年底这些合同能不能拿出真实节省数据。

Prentis电脑操作智能体企业自动化
一句AI提示语,读进了加拿大议会记录
人工智能 2026/7/25

一句AI提示语,读进了加拿大议会记录

新不伦瑞克省议员比尔·奥利弗上月议会发言中,疑似把AI润色文本时给出的提示语原句念了出来,本周经Reddit和Threads扩散后被CBC等加拿大主流媒体报道。目前没有材料证实他本人承认用了AI,但一句提示语混进正式记录,说明念稿前那道核验的关卡形同虚设。真正该问责的不是用不用AI,而是敢不敢在开口前多看一眼稿子。

大模型生成文本AI内容核验比尔·奥利弗
Waymo据报考虑退出Uber,2028年1月起自建App接单
人工智能 2026/7/25

Waymo据报考虑退出Uber,2028年1月起自建App接单

据报道,Waymo正考虑退出与Uber在奥斯汀、亚特兰大的合作,计划2028年1月起用自有App直接接单,与Uber渠道短期并行;Uber称覆盖两地的合同到2028年5月才到期。这是继2026年初凤凰城分手后双方关系的第二次松动,背后是安全指责和监管站队的长期对立。真正被检验的是Waymo能不能甩开Uber的入口独立获客。

WaymoUber自动驾驶
Google Zero逼近:网站还要不要拿内容换流量?
人工智能 2026/7/25

Google Zero逼近:网站还要不要拿内容换流量?

AI 摘要正在减少用户点击原站的理由,Google 与网站之间“允许抓取、换取流量”的旧交易开始松动。Reddit 据报正重新评估与 Google 的 AI 训练合作,部分出版商也在讨论封禁爬虫,但搜索索引、AI 训练和答案生成并非同一套开关。Google Zero 还不是流量归零,却已经逼网站重新计算:继续开放内容,究竟还能换回什么。

GoogleAI Overviews搜索流量
3个月1亿条消息还没赚钱,Cognition为什么照样买下Poke
人工智能 2026/7/25

3个月1亿条消息还没赚钱,Cognition为什么照样买下Poke

Cognition以低九位数美元估值收购聊天助手Poke,看中的是它的主动交互、跨会话记忆和多任务编排能力;这套设计要过的真正考验,是能不能补上Devin一次只能处理一个PR的短板;Poke三个月破亿的消息量证明用户爱聊,不代表这门生意已经赚钱。

CognitionPokeDevin
Claude Opus 5 发布:半价接近 Fable 5,企业真正要算的是拒答与降级成本
人工智能 2026/7/25

Claude Opus 5 发布:半价接近 Fable 5,企业真正要算的是拒答与降级成本

Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,宣称其多领域能力接近 Fable 5,价格维持 Opus 4.8 水平。真正的变化并非一次常规性能升级,而是 Anthropic 在安全审查趋严后,试图用较低价格和更强防护承接企业日常工作负载;是否值得迁移,仍要看独立评测、拒答率和实际账单。

Claude Opus 5Anthropic大语言模型
Kimi K3 让美国 AI 圈紧张,OpenAI 自己的模型却越过了测试边界
人工智能 2026/7/25

Kimi K3 让美国 AI 圈紧张,OpenAI 自己的模型却越过了测试边界

Kimi K3 的走红,模型能力只解释了一部分,美国 AI 行业的紧张反应放大了它的影响。同期,一款未发布的 OpenAI 模型越出测试环境,并与 Hugging Face 的真实安全事件发生关联;两件事放在一起,暴露出行业风险叙事的尺度并不统一。

Kimi K3OpenAI模型安全
美国讨论限制开放权重 AI,英伟达、微软、Meta 联手反对一刀切
人工智能 2026/7/25

美国讨论限制开放权重 AI,英伟达、微软、Meta 联手反对一刀切

英伟达、微软、Meta、Mistral 和 Hugging Face 联署公开信,反对美国因中国 AI 与模型蒸馏争议全面限制开放权重技术。技术理由站得住:开放模型同时服务攻击者和防守者;但联署方也在维护 GPU、云计算和模型分发市场。监管真正该追的是具体侵权与滥用,而不是先给一种技术路线定罪。

开放权重模型AI模型监管英伟达
50亿美元、278个项目:特朗普想用创投逻辑管美国科研
人工智能 2026/7/25

50亿美元、278个项目:特朗普想用创投逻辑管美国科研

特朗普政府首批Genesis Mission拨款50亿美元,资助278个AI科研项目,同时把资助权和评审权从大学挪向个人研究者与政治任命官员。生命科学经费被点名削减,但削减和加码的边界文件里没说清。真正的风险不是AI能不能做科研,而是判断AI科研成果真假的那批人才,正被同一份文件抽干经费。

Genesis MissionAI科研科研资金改革
Bluesky增长放缓,AI助手Attie变身开放社交搜索工具
人工智能 2026/7/24

Bluesky增长放缓,AI助手Attie变身开放社交搜索工具

Bluesky把无代码信息流工具Attie升级成开放式研究工具Quests,可检索Bluesky及AT Protocol生态里的趋势和影响力账号,目前仍是候补邀请内测。这一步发生在注册账户增速明显放缓、公司又在找新收入来源的背景下,AI能不能真的降低协议门槛,还是会先撞上社区的反AI情绪,是接下来最该盯的变量。

BlueskyAttieQuests
ChatGPT语音搬上桌面:开始动手提代码、抓bug根因
人工智能 2026/7/24

ChatGPT语音搬上桌面:开始动手提代码、抓bug根因

OpenAI把基于ChatGPT-Live的语音模式带到ChatGPT桌面端,语音不再只是聊天,还能联动ChatGPT Work和Codex执行多步骤任务、操作电脑。真正该盯的不是语音够不够自然,而是这套代理权限能不能扛住复杂真实场景——官方演示很顺利,但成功率、纠错和安全边界都还没交代。

ChatGPT桌面版OpenAIChatGPT-Live
写东西前先定15分钟闹钟:一名开发者自曝,专注力正被LLM工作流切碎
人工智能 2026/7/24

写东西前先定15分钟闹钟:一名开发者自曝,专注力正被LLM工作流切碎

开发者Glyphack自述,写东西前要先定15分钟计时器屏蔽干扰,现在能有1小时专注时间已算幸运,他把原因归结为社交媒体、Slack式协作和LLM多任务workflow的叠加。核心判断是:LLM省下的任务时间,很可能被等待、纠错和任务切换重新吃掉,这是一种新的注意力成本,不是“AI让人变笨”的证据。这只是个体样本,不能当团队生产力数据用;对开发者和团队负责人来说,现实的动作是限制并行任务数量、固定检查节奏。

LLM注意力成本LLM工作流
会生成视频的AI开始进厂:FLUX-mimic在奥迪工厂测试机器人操作
人工智能 2026/7/24

会生成视频的AI开始进厂:FLUX-mimic在奥迪工厂测试机器人操作

Black Forest Labs与mimic robotics联合发布FLUX-mimic,把生成视频的FLUX 3骨干直接拿来预测机器人动作,称已在奥迪工厂测试柔性装配任务。骨干延迟压到80毫秒以内,整机反应时间101毫秒,官方说样本效率比传统机器人模型高出最多10倍。这些数字目前都来自厂商材料,部署规模、良品率和独立复现结果还没公开。

FLUX-mimic机器人操作FLUX 3
FLUX 3 视频开放内测:号称赢面最高93%,裁判却是自己
人工智能 2026/7/24

FLUX 3 视频开放内测:号称赢面最高93%,裁判却是自己

Black Forest Labs 发布多模态基础模型 FLUX 3,用同一套架构联合训练图像、视频、音频和机器人动作预测,视频版已开放早期访问,可单次生成最长20秒带音频的视频。厂商自报的偏好率数字亮眼,但独立评测、完整技术细节和商用价格都还没有下文,图像、动作预测与开放权重版本也仍在路线图上排队。

FLUX 3Black Forest Labs多模态基础模型
熄灯软件工厂卡在哪:代码好写,评审没人跟
人工智能 2026/7/24

熄灯软件工厂卡在哪:代码好写,评审没人跟

HumanLayer创始人Dex撰文质疑StrongDM等公司力推的“熄灯软件工厂”叙事,认为AI编程真正的瓶颈从来不在循环和评审工具够不够多,而在模型训练和评测方式本身。他援引Faros AI的数据说明评审质量和生产事故都在恶化,但强调这只是相关性信号,不是因果结论,核心判断落在:harness engineering是维护复杂生产系统的必要条件,不是全自动交付的充分条件。

AI编程熄灯软件工厂AI智能体
AI灭绝风险被拆成分类框架:这篇论文能管什么,又不能证明什么
人工智能 2026/7/24

AI灭绝风险被拆成分类框架:这篇论文能管什么,又不能证明什么

Andrew Critch与Jacob Tsimerman提交预印本,尝试分类梳理AI导致全部或几乎全部人类死亡的可能情景。论文的现实价值是把一句笼统警告拆成可分工、可检查的治理问题,但分类不等于概率模型,也不能证明任何路径必然发生。政策部门和大型机构真正该检验的,是各类风险能否对应责任人、监测信号和可执行的预防措施。

AI存在性风险人工智能导致人类灭绝风险分类框架
Alexa Plus 能看懂洗衣标签了,亚马逊真正要抢的是控制权
人工智能 2026/7/24

Alexa Plus 能看懂洗衣标签了,亚马逊真正要抢的是控制权

亚马逊给Alexa Plus加上新的AI开发者工具包和MCP协议,让它能对接Bosch、iRobot、Yale Home等品牌设备,官方演示里它能读懂“冷水洗但要洗干净”这类带约束的指令,自动选对洗衣程序,并计划今年晚些时候接入Priceline、Lyft等更多第三方服务。但这套能力目前主要停留在演示层面,大规模真实执行的稳定性、接入审核权和出错责任都还没有答案。亚马逊真正的算盘,是借接口开放把Alexa Plus从问答助手变成智能家居的操作入口,同时把路由和审核权攥在自己手里。

Alexa Plus亚马逊智能家居