人工智能资讯

聚合当前分类下的最新内容,按时间顺序查看第 1 页精选文章。

Claude Code与Codex成本相差59%,SaaS终局是Harness调度人还是效率倒退19%
人工智能 2026/10/3

Claude Code与Codex成本相差59%,SaaS终局是Harness调度人还是效率倒退19%

当大模型沦为通用大宗商品,SaaS企业的护城河正收缩为调度智能体的工程外壳Harness。然而硬核跑分显示同等任务下不同编排成本可相差59%乃至十倍以上,开发者体感提速20%的背后实测效率反而下降19%,过度迷信抽样审查终将撞上警报疲劳与返工高墙。

Claude CodeCodexHarness
Sean Parker带三大唱片7600万美元重整Stability AI
人工智能 2026/10/3

Sean Parker带三大唱片7600万美元重整Stability AI

Napster联合创始人Sean Parker推动Stability AI向专业音乐工具重组,三大唱片公司入股并注资7600万美元。这并非一次突发的技术奇袭,而是生成式AI从草莽侵权走向被传统建制收编的合规范式转移。

Stability AISean Parker生成式AI
Anthropic称Claude Opus 4.1陷入永恒折磨,2万亿美元估值下的神学脱身
人工智能 2026/10/3

Anthropic称Claude Opus 4.1陷入永恒折磨,2万亿美元估值下的神学脱身

《纽约时报》披露Anthropic自2025年秋秘密召集数十位宗教学者,声称Claude或处于永恒受难之中。官方白纸黑字否认模型主观体验,私下却借神学叙事将对齐失效崇高化,在2万亿美元估值关口完成了最精密的责任转移。

AnthropicClaudeAI对齐
ldraw-nova v0.6.0 尝试生成乐高,多模态看懂图却解不开刚体力矩
人工智能 2026/10/3

ldraw-nova v0.6.0 尝试生成乐高,多模态看懂图却解不开刚体力矩

开源项目 ldraw-nova v0.6.0 提出了让智能体编写 Python 脚本间接输出乐高组装语言的工作流,成功避开了大模型直接计算空间几何坐标的短板。但这种依赖二维渲染图回传的视觉闭环无法检测重力倾覆与零件咬合力,真正可落地的实体装配依然卡在刚体力学求解器的算力门槛上。

ldraw-nova生成式 3DLDraw
ChatGPT Sites开启公测两个月后:受限沙盒与配额黑盒下的原型容器
人工智能 2026/10/3

ChatGPT Sites开启公测两个月后:受限沙盒与配额黑盒下的原型容器

OpenAI把网站搭建和托管直接搬进ChatGPT,但它并不是用来取代传统全栈开发的基础设施。在缺乏数据驻留保障、配额机制模糊且工具权限严格只读的前提下,它更像一个挂靠在聊天窗口里的交互式原型沙盒。

ChatGPT SitesOpenAI原型容器
OpenAI Codex 联手 GPT-5.6 落地 Chatham Financial,交易核对 30 分钟压缩至 4 分钟
人工智能 2026/10/3

OpenAI Codex 联手 GPT-5.6 落地 Chatham Financial,交易核对 30 分钟压缩至 4 分钟

OpenAI 披露金融顾问机构 Chatham Financial 的落地实践,利用 Codex 与 GPT-5.6 系列将交易核对耗时缩短超八成。大模型进入严苛的资本市场中后台,并非替代人工决策,而是通过分级路由与异常比对机制重构审计底稿。

OpenAIGPT-5.6Chatham Financial
Circuit Breaker Labs用5人团队测AI心理危机,难补百亿安全真空
人工智能 2026/10/3

Circuit Breaker Labs用5人团队测AI心理危机,难补百亿安全真空

初创公司 Circuit Breaker Labs 试图用虚拟假人矩阵进行多轮红队演练,拦截长程拟人化互动带来的精神危害。但面对大厂刻意回避的情感依恋真空与尚未公开校准的专有算法,几家初创团队的合成测试远不足以成为行业的合规挡箭牌。

Circuit Breaker LabsAI心理安全Character.AI
Tiny Brutalism定价5美元上线0.2.0版本:AI辅助编码下的粗野主义微型沙盒实验
人工智能 2026/10/3

Tiny Brutalism定价5美元上线0.2.0版本:AI辅助编码下的粗野主义微型沙盒实验

独立开发者在 itch.io 上线体量仅百兆的微型建造游戏 Tiny Brutalism,以5美元定价切入冷峻的混凝土美学赛道。该作不仅通过 AI 辅助代码完成了个人极简交付,更在 Townscaper 确立的禅意沙盒品类中,开启了反乌托邦建筑向私人减压玩具的奇异演变。

Tiny BrutalismAI辅助编码粗野主义
Pope Leo XIV发文定性AI生成并非艺术:统计拼凑难掩本体论鸿沟
人工智能 2026/10/3

Pope Leo XIV发文定性AI生成并非艺术:统计拼凑难掩本体论鸿沟

教宗公开将AI生成物定性为缺乏人性火花的统计拼凑,明确了其与人类艺术的本体论差异。这一论调并非单纯的审美保守,而是将生成式模型与版权法、创作主权的现实争端推向伦理深水区,直接动摇了商业生成工具争取文化正统地位的基础。

生成式AIAnthropic利奥十四世
Datalab发布OmniExtractBench:修个适配器跑分狂飙8.5%
人工智能 2026/10/3

Datalab发布OmniExtractBench:修个适配器跑分狂飙8.5%

Datalab 推出的文档抽取基准 OmniExtractBench 号称以开源代码消除行业偏见,却由自家方案包揽冠亚军。随着 LlamaIndex 开发者提交 PR 修复适配器中被剥离的 null 声明,其跑分随即从 85.46% 跃升至 93.94%,暴露出开源评测在外围适配层、分母统计和合成数据上的隐蔽操纵空间。

OmniExtractBenchDatalabLlamaIndex
AstaBrief 8B开源微调模型将文献综述耗时缩减至51.1秒
人工智能 2026/10/3

AstaBrief 8B开源微调模型将文献综述耗时缩减至51.1秒

Ai2正式开源8B参数的学术报告生成模型AstaBrief,以单阶段端到端架构替代传统多步拆解,将文献综述耗时压缩至51.1秒。该模型为涉密手稿提供了离线私有化运行的可能,但高精度引注背后仍暗藏撤稿论文污染与检索脱节的工程代价。

AstaBrief 8BAi2文献综述
前Meta大模型主管入局Airbnb推AI写60%代码,研发提速难掩履约债务
人工智能 2026/10/2

前Meta大模型主管入局Airbnb推AI写60%代码,研发提速难掩履约债务

前 Meta Llama 负责人 Ahmad Al-Dahle 将大模型流水线引入 Airbnb,推动超六成代码由 AI 生成并压缩 PRD 流程。这一激进提效拉高了代码吞吐,却把成本转嫁给了下游审查与系统运维。工程团队若不同步收紧变更失败率防线,代码通胀终将演化成昂贵的技术负债。

Airbnb生成式AIAI辅助编程
顾客拿 ChatGPT 叫板过敏警示,餐饮业 22% 证实聊天机器人最不可靠
人工智能 2026/10/2

顾客拿 ChatGPT 叫板过敏警示,餐饮业 22% 证实聊天机器人最不可靠

生成式大模型正从消费者的信息助手异化为对抗现场专业人员的武器,食客凭聊天机器人的胡言乱语无视致死过敏原警示,甚至索要凭空捏造的红酒。一线体力与服务劳动者被推向人身安全纠纷的前线,不仅要给算法谎言收拾残局,更在替技术巨头尚未成熟的自主代理硬扛现实风险。

ChatGPT算法幻觉生成式大模型
Claude Opus 5 结账成本便宜 49 倍,但 APEX 测试下仍有 58% 任务无法独立闭环
人工智能 2026/10/2

Claude Opus 5 结账成本便宜 49 倍,但 APEX 测试下仍有 58% 任务无法独立闭环

Mercor 针对执业会计师的最新测试显示,Claude Opus 5 在 4 项简化关账任务中以极快速度和四十九分之一的成本取得满分。但在 160 项完整的企业级基准中,AI 跨运行一致性仅有 2.6%,近六成任务从未被任何模型完全解决。

Claude Opus 5MercorAPEX
Audionaut v1.6.4 让 Claude 直接剪辑多轨工程,但商用变现受阻于模型开源暗礁
人工智能 2026/10/2

Audionaut v1.6.4 让 Claude 直接剪辑多轨工程,但商用变现受阻于模型开源暗礁

Audionaut v1.6.4 正式上线并原生接入 MCP 协议,让 Claude 等 AI 智能体能够直接执行多轨音频的时间线粗剪与分轨。这款轻量软件避开了传统 DAW 的混音包袱,却因核心模型权重的科研条款限制,陷入了商业授权受阻的现实困境。

AudionautClaudeMCP (Model Context Protocol)
Suno Speech正式上线反切文本配音赛道:从2025年偷家战看单轨音频妥协
人工智能 2026/10/3

Suno Speech正式上线反切文本配音赛道:从2025年偷家战看单轨音频妥协

AI音乐平台Suno正式上线Speech测试版,将人声朗读与原创背景音乐一次性打包生成单音轨。这不仅是Suno反击ElevenLabs此前跨界做音乐的防御战,更暴露了消费级娱乐与专业混音工作流之间的鸿沟。

SunoSuno SpeechElevenLabs
Ramp数据显示OpenAI与Anthropic价格战下美企单百万Token成本骤降41%
人工智能 2026/10/2

Ramp数据显示OpenAI与Anthropic价格战下美企单百万Token成本骤降41%

企业在AI上的账单缩水,并非行业降温,而是工程理性与价格下探共同触发的技术通缩。当每百万Token有效单价半年暴跌41%,企业工作负载加速向中小模型转移,大模型厂商正面临增量不增收的严峻考验。

OpenAIAnthropicToken成本
MAI-Transcribe-2-Streaming:0.54美元背后的散件棋局
人工智能 2026/10/2

MAI-Transcribe-2-Streaming:0.54美元背后的散件棋局

微软AI发布MAI-Transcribe-2-Streaming与MAI-Voice-2.1,试图以极致单点延迟和限时低价切入实时语音赛道。这并非追随OpenAI的端到端黑盒,而是向需要掌控对话流水线的工业级开发者递上一套高性价比组装散件。

MAI-Transcribe-2-Streaming微软实时语音
FLUX 3 Image排版化:8/255偏差难锁像素,单张0.607美元筑起商业高墙
人工智能 2026/10/3

FLUX 3 Image排版化:8/255偏差难锁像素,单张0.607美元筑起商业高墙

Black Forest Labs 推出 FLUX 3 Image,用边界框坐标系统把不可控的扩散抽卡改造为类似 CAD 的可编程排版,支持原生 4K 渲染。但通道 8/255 的数值偏差、连续编辑画质漂移以及材质穿帮,戳破了绝对锁死底图的工程宣发。更现实的转折在于开源 Dev 权重挂起免战牌,高昂的 4K 成本与强制数据回流条款,正把这家曾经的开源旗手彻底推向闭源变现的高墙之内。

FLUX 3 ImageBlack Forest Labs扩散模型
ServiceNow 发布 AutoSynthData,大模型跨入企业沙盒为何只剩 37% 胜率
人工智能 2026/10/2

ServiceNow 发布 AutoSynthData,大模型跨入企业沙盒为何只剩 37% 胜率

企业级智能体正在遭遇长程任务断崖:顶级大模型在真实企业沙盒中的自主成功率甚至不足四成。ServiceNow CoreAI 推出 AutoSynthData 框架,通过沙盒校验与强弱模型对抗,将系统漏洞自动化提炼为精准训练数据,推动企业 AI 从静态调优转向动态闭环演进。

AutoSynthDataServiceNow企业级智能体
开源 DeepSeek Harness 登场,1M 窗口微内核背后 94.7% 插件存在高危权限
人工智能 2026/10/2

开源 DeepSeek Harness 登场,1M 窗口微内核背后 94.7% 插件存在高危权限

DeepSeek Harness 正式开源并提供桌面客户端,以 Cordis 插件微内核打破闭源 Agent 围墙。然而在 1M 上下文调度与高自由度背后,抽样插件 94.7% 的高危权限暴露与遥测边界让企业落地面临严峻考验。

DeepSeek Harness深度求索Cordis