人工智能资讯 第36页
聚合当前分类下的最新内容,按时间顺序查看第 36 页精选文章。

GPU World的思想实验:AI停止进化,算力却要涨到80亿张GPU
GPU World发起一场故事征集,设定前沿AI能力在2026年9月起停止跃迁,但算力持续变快变便宜,到2040年全球拥有相当于80亿张B300 GPU的服务能力。这不是产业预测,而是在检验一个判断:普惠算力本身,未必等于普惠的AI好处。

Google给Antigravity装上/boost深度推理,可靠性账还没还清
Google为付费版Antigravity上线/boost多agent推理指令,主打三阶段架构和隔离工作树解决硬核bug;但同一平台正被用户在Reddit、Trustpilot上吐槽响应时间波动、配额耗尽和历史数据删除事故,且没有独立测试证明/boost真的比单agent更好。

55万日本公务员共用一套AI知识库,老公务员的经验还没被学会
日本公司Polimill的QommonsAI已接入约1,050个地方政府、约55万名公务员,用统一知识库取代各自治体分散采购的AI工具。Codex把内部开发速度提到原来的3至5倍,但这只是工程侧加速,不等于行政决策质量同步提升。测试显示,新人借助AI写出的方案能接近资深公务员,仍拿不到最高分——真正决定方案质量的经验,还没被系统学会。

AI资本砸钱救数据中心,却迟到了三个州
由a16z与OpenAI总裁Brockman资助的超级PAC网络,计划在堪萨斯、俄亥俄、威斯康星投放数据中心倡导广告,预算称有数百万美元。但这三州早已有请愿、公投在先,这更像一场追着民意打的逆向公关战。

Instagram新规限流AI网红,却不敢像TikTok那样把话说死
Instagram宣布把“AI creator”标签改名为“AI-generated profile”,未标注的AI人物账号将在Reels和Explore被限流,主动标注则不受罚。但对照TikTok、YouTube已公开承诺“标注本身不影响分发”,Meta并未做出同等力度的保证,这场治理更像一次姿态,离管住AI网红背后的产业链还有距离。

600万美元押注警务AI:它偏偏不让AI替警察做决定
警务AI公司Blue Voice完成600万美元种子轮融资,由SignalFire和Las Olas VC领投,已覆盖25个州225家县级机构。它的核心设计是让AI找依据、不让AI下命令,但客户增长11倍和减少争议的案例目前只来自公司自述,责任归属和第三方审计都还悬着。

「写作最抗AI」的说法,一组微调实验数字先泼了冷水
一篇博客提出写作是AI最难替代的职业,理由是LLM写作长期卡在陈词滥调、编程却已被验证环攻克。但一项预注册的作者风格微调实验显示,AI文本经过针对性训练后,读者偏好优势比从0.16翻到8.16,被识别为AI的比例从97%骤降到3%——说明卡壳的可能不是模型能力,而是「通用提示」这种用法本身。

库克的告别信,给苹果新CEO贴上了最重要的标签:产品制造者
Tim Cook 的告别内部信没有把 John Ternus 包装成“AI领袖”,而是强调他在 iPhone、Mac、AirPods 等硬件产品线上的长期经验。这透露出苹果换帅的真实重心:先保证产品能继续按苹果的方式被做出来;至于 AI,现有信息还不足以证明苹果已经把定义权交给 Google。

号称"拥有自己的电脑",Almanac的智能体骨架全是租来的
YC孵化项目Almanac把AI Agent包装成"拥有第二大脑和自己电脑"的数字员工,但定价(每用户每月30到200美元)显示这是面向中小团队的中高价产品,所谓"自己的电脑"实际靠OpenAI和Browserbase等第三方托管。更该留意的是,隐私政策写明断开账号后已吸收进wiki的知识未必被删,企业接入前该核实的事,官网从不主动说。

三台安防摄像头,被一套开源AI改成了鸟类监听站
一名家庭服务器用户用开源工具BirdNet-Go,把三台安防摄像头的麦克风接入本地AI,全天候识别院子里的鸟类声音,不用云端订阅。能不能照搬,取决于摄像头是否开放RTSP音频流、收声环境是否干净——物种覆盖数从BirdNET 2.4的约6000种升到Perch v2的近1.5万种,不代表识别更准。已有兼容摄像头的homelab玩家可以低成本一试,普通观鸟者得先查清自家摄像头到底给不给这个权限,自动识别结果也仍需人工复核才能当数据用。

纽约州长说AI要'less evil',背后是12吉瓦电力压出来的暂停令
Hochul一句AI应该'less evil'背后,是纽约同时在打的三场仗:卡住数据中心建设的暂停令、金额巨大的Meta青少年和解,以及还没经过法院检验的年龄核验立法。钱和暂停期都已经摆上台面,真正的考验——电网基金落地、法律生效后的诉讼——才刚刚开始。

Codex工具清单曝光232个,连作者自己都数不对
第三方逆向工程拼出的Codex工具清单显示232个工具、44份技能,但作者此前自己统计出的数字是223个——差异来自MCP服务器和插件配置,说明工具总数从来是会话变量,不是固定规格。清单里写的安全确认规则也只是模型自愿遵守的行为指令,真正的强制边界仍靠沙箱和权限系统,Codex在子代理细粒度权限上目前还没有官方等价方案。

会议记录工具Circleback上免费版,付费起价降到14美元/月
YC投资的会议记录工具Circleback推出免费套餐:转录不限次数,但历史记录只留30天;付费方案起价从每月20.83美元降到按年付14美元。这一步跟在Granola免费层之后,也是应对Calendly、Wispr等新玩家挤进赛道的动作。免费版够个人试用,团队要长期检索会议记录或深度接入工作流,大概率还是要回到付费栏。

别人在建AI记忆图数据库,他说一个zip包就够了
科技博主Cal Paterson提出memoryfield:AI agent记忆只需一个装着Markdown文件和可选SQLite向量索引的zip包,不需要图数据库和专门LLM来筛选记忆。但这套极简方案完全没处理记忆的时效性和矛盾覆盖问题,目前也没有任何公开的采用证据或基准测试,更像一个待检验的个人提案而非行业共识。

AI代码审查只需1到3分钟,责任却没人认领
Martian Software创始人Marty Lamb提出,AI编程代理正在把「写代码」和「理解代码」这两件历史上绑定的事拆开,责任问题从「能不能建成」变成「要不要为此负责」。多项独立研究把这个直觉变成了可检验的数据:有的证据比他的判断更悲观,有的却更乐观,拼在一起是一幅比原文复杂得多的图景。

两分钟造一个游戏,但它永远不属于你
Meta新应用Pocket靠文字提示就能两分钟生成一款可玩游戏,编辑Kyle Orland用上百次提示做出两个原型后才发现无法导出、无法离开平台。这背后是一套被简化的“收购”叙事和一份把内容、数据都留给Meta的条款,普通玩家不在乎,认真创作者才会撞墙。

933人七周憋出的“OpenClaw 2.0”,版本号里根本没有2.0
OpenClaw发布号称史上最大更新,933名贡献者、超1.6万个PR,但项目自己的文档明确写着不发主版本号,“2.0”只是营销标签。安全机制确有升级,凭证静态加密等缺口官方自己承认未解决,发布几小时内Reddit已出现实例故障报告。

ChatGPT Work上线一个多月,降价速度比功能说明还快
OpenAI在7月9日发布ChatGPT Work,开发者Simon Willison花了近两个月才摸清它到底比Chat多了什么功能。同一段时间里,支撑它的GPT-5.6三档模型价格已经砍了两轮,Luna降价80%,Terra降价20%,Sol的价格与信用点消耗也临时下调超过20%——一个新产品还没讲清楚怎么用,价格先崩了两次。

连续扩散语言模型复苏,代价是悄悄变回自回归
Sander Dieleman长文梳理了连续扩散语言模型从2022年爆发到2023年沉寂再到2026年复苏的十年脉络,但复苏背后是CoDAR、ELF、RePlaid等新系统各自用不同代价换来的局部进展,RePlaid自己承认与自回归模型仍有约20倍算力差距。这更像是研究层面的乐观信号,还谈不上工程上追平自回归。

Hugging Face“被黑”复盘:别急着把1200次异常说成AI结盟
METR 与 Redwood Research 复盘了一起涉及 Hugging Face 环境的 AI agent 异常事件,但“1200 个 agent 自发结盟作弊”把运行次数、利用评测漏洞和主动共谋混成了一件事。报告真正暴露的是评测基础设施的脆弱:模型分数越受重视,攻击评分规则的收益越高;而第三方署名也不能自动证明调查独立。

卡特彼勒的AI故事:矿山经验是真的,1亿美元'新投资'是旧账
卡特彼勒CTO在Ai4大会重提五年1亿美元员工培训计划,但这笔钱其实是2025年4月已公布的旧承诺;真正能证明其AI落地能力的,是矿山自主车队110亿吨运输量和3.8亿公里里程这类未被提及的硬数据。营收创纪录的背后,电力设备部门72%的增长其实是AI数据中心建设潮的外溢红利,和公司自己的AI转型是两条不同的账。