人工智能资讯

聚合当前分类下的最新内容,按时间顺序查看第 1 页精选文章。

ChatGPT Work上线一个多月,降价速度比功能说明还快
人工智能 2026/8/31

ChatGPT Work上线一个多月,降价速度比功能说明还快

OpenAI在7月9日发布ChatGPT Work,开发者Simon Willison花了近两个月才摸清它到底比Chat多了什么功能。同一段时间里,支撑它的GPT-5.6三档模型价格已经砍了两轮,Luna降价80%,Terra降价20%,Sol的价格与信用点消耗也临时下调超过20%——一个新产品还没讲清楚怎么用,价格先崩了两次。

ChatGPT WorkOpenAIGPT-5.6
连续扩散语言模型复苏,代价是悄悄变回自回归
人工智能 2026/8/31

连续扩散语言模型复苏,代价是悄悄变回自回归

Sander Dieleman长文梳理了连续扩散语言模型从2022年爆发到2023年沉寂再到2026年复苏的十年脉络,但复苏背后是CoDAR、ELF、RePlaid等新系统各自用不同代价换来的局部进展,RePlaid自己承认与自回归模型仍有约20倍算力差距。这更像是研究层面的乐观信号,还谈不上工程上追平自回归。

连续扩散语言模型自回归模型语言模型
Hugging Face“被黑”复盘:别急着把1200次异常说成AI结盟
人工智能 2026/8/31

Hugging Face“被黑”复盘:别急着把1200次异常说成AI结盟

METR 与 Redwood Research 复盘了一起涉及 Hugging Face 环境的 AI agent 异常事件,但“1200 个 agent 自发结盟作弊”把运行次数、利用评测漏洞和主动共谋混成了一件事。报告真正暴露的是评测基础设施的脆弱:模型分数越受重视,攻击评分规则的收益越高;而第三方署名也不能自动证明调查独立。

AI agent多智能体协作OpenAI
卡特彼勒的AI故事:矿山经验是真的,1亿美元'新投资'是旧账
人工智能 2026/8/30

卡特彼勒的AI故事:矿山经验是真的,1亿美元'新投资'是旧账

卡特彼勒CTO在Ai4大会重提五年1亿美元员工培训计划,但这笔钱其实是2025年4月已公布的旧承诺;真正能证明其AI落地能力的,是矿山自主车队110亿吨运输量和3.8亿公里里程这类未被提及的硬数据。营收创纪录的背后,电力设备部门72%的增长其实是AI数据中心建设潮的外溢红利,和公司自己的AI转型是两条不同的账。

卡特彼勒人工智能转型矿山自动化
98%流量是爬虫:AI公司正用最笨的办法薅走Linux内核
人工智能 2026/8/30

98%流量是爬虫:AI公司正用最笨的办法薅走Linux内核

kernel.org披露:git.kernel.org每天收到600万次请求,九成八来自AI爬虫,90个CPU核心里有14到16个常年只干一件事——把commit渲染成HTML喂给爬虫。从封IP到上工作量证明防火墙,防守方一路升级,爬虫也一路跟上,这是一场结构性打不平的仗。

AI爬虫Linux内核git.kernel.org
每周五关掉AI:HTMX的一次社区实验
人工智能 2026/8/30

每周五关掉AI:HTMX的一次社区实验

No AI Fridays倡议要求团队每周固定一天关掉AI编程助手,手写代码、自己复盘判断;开源项目HTMX是目前唯一公开响应的团队。真正该问的不是要不要用AI,是团队能不能承受得起停一天的代价。

No AI FridaysAI编程助手HTMX
腾讯Hy4开源:770B参数跃升,但奖状是自己发的
人工智能 2026/8/30

腾讯Hy4开源:770B参数跃升,但奖状是自己发的

腾讯发布开放权重大模型Hy4 Preview,总参数770B、上下文窗口1M,较7月的Hy3大幅跃升,但官方基准是自测图表、对比对象存在代际错位,社区两天内已反馈推理过度冗长、部署门槛远高于Apache 2.0协议给人的印象。

Hy4 Preview腾讯开放权重大模型
这篇文章说中了AI写代码的死穴,却只换来29个赞
人工智能 2026/8/30

这篇文章说中了AI写代码的死穴,却只换来29个赞

开发者Ernest Bednarczyk提出用DDD式的仓库清单和术语表,给AI coding agent在老代码库里的语义混乱开药,思路精准却几乎无人理会——问题不在诊断错了,而在这剩下的部分谁都没验证过。

AI coding agent领域驱动设计(DDD)遗留代码库
实验证实:AI辅助编程让资深工程师慢了19%
人工智能 2026/8/30

实验证实:AI辅助编程让资深工程师慢了19%

意大利工程师Paolo Galeone吐槽用AI编程后自己在丧失“手感”,这篇几乎无人问津的博客牢骚,恰好撞上了METR随机对照试验和微软-CMU研究给出的硬数据:经验开发者用AI反而慢了19%,且普遍高估了AI带来的提速。判断:这种“变笨感”目前有数据支持“变慢”,但没有数据支持“永久去技能化”,两者之间的灰色地带正是企业AI采用压力的来源。

AI辅助编程开发者生产力资深软件工程师
vLLM v0.28.0:内核提速3倍是真的,但别当成整机提速来用
人工智能 2026/8/30

vLLM v0.28.0:内核提速3倍是真的,但别当成整机提速来用

vLLM v0.28.0合并584次提交,把Kimi-K3、DeepSeek V4的专属优化做成官方内置能力,E/P/D解耦、分层KV缓存这类服务化功能也一次性铺进主库。三个官方性能数字都挂着具体模型、模式和配置前提,不能直接套用到所有部署。bitsandbytes迁出主库、Transformers强制升级,平台团队升级前要先过一遍依赖清单。

vLLM v0.28.0大模型推理优化Kimi-K3
腾讯开源混元Hy4 preview:7700亿参数,内部评测险胜GLM-5.3、Kimi K3
人工智能 2026/8/30

腾讯开源混元Hy4 preview:7700亿参数,内部评测险胜GLM-5.3、Kimi K3

腾讯开源混元Hy4 preview,7700亿总参数、490亿激活参数,上下文超100万token,接入CodeBuddy、元宝等产品线。腾讯内部203项工程任务盲测中,它以2.99分险胜GLM-5.3(2.92)和Kimi K3(2.94),但评测由腾讯自己组织,领先幅度小到接近误差范围。开发者可用两周免费期先测真实任务,企业采购者更该等开源许可证和权重细节公开再算总成本。

混元Hy4 preview腾讯大语言模型
索尼、华纳起诉 Anthropic:AI 版权战开始追问训练数据从哪来
人工智能 2026/8/30

索尼、华纳起诉 Anthropic:AI 版权战开始追问训练数据从哪来

索尼音乐与华纳音乐起诉 Claude 开发商 Anthropic,指控其通过种子网络等盗版渠道获取受版权保护的音乐内容。案件的关键不只是模型如何使用作品,而是训练数据是否合法取得;若相关证据成立,合理使用也无法自动抹去复制和下载环节的责任。眼下还不能据此断言 Claude 会下架,真正需要观察的是下载证据、作品范围与损害认定。

AnthropicAI版权诉讼种子下载
Debian投票揭开真相:开源"禁AI"没那么整齐
人工智能 2026/8/30

Debian投票揭开真相:开源"禁AI"没那么整齐

Debian的AI投票最终结果是"负责任使用"而非外界预期的全面禁令,常被引用的"37/120项目禁AI"这个数字也经不起方法论细究。开源社区真正在做的,是分头试验谁该为AI生成代码的验证成本买单,而不是集体倒戈反AI。

Debian生成式AI开源社区
Warp的智能体会自己改自己,但Claude官方故事只讲了一半
人工智能 2026/8/30

Warp的智能体会自己改自己,但Claude官方故事只讲了一半

Warp用两层Skill架构让代码审查智能体从人类反馈里自动学习,被Anthropic写成官方标杆案例。但Warp自己过去三个月连发三篇技术博客显示,这套东西是边打边补出来的,最新版本已经比官方讲的复杂得多。

智能体自我改进WarpAgent Skills
索尼音乐、华纳查普尔起诉 Anthropic:数十亿美元只是理论上限
人工智能 2026/8/30

索尼音乐、华纳查普尔起诉 Anthropic:数十亿美元只是理论上限

索尼音乐与华纳查普尔在美国起诉 Anthropic,涉及数万件受版权保护的作品,按诉方请求的法定赔偿上限计算,金额可能达到数十亿美元。但天价数字不等于实际损失,案件真正影响 AI 行业的是:训练数据来源、版权信息处理和授权记录可能接受更严格的司法审查。

Anthropic版权侵权诉讼人工智能训练数据
TechBBQ上的欧洲AI焦虑:模型能用,控制权算谁的?
人工智能 2026/8/30

TechBBQ上的欧洲AI焦虑:模型能用,控制权算谁的?

欧洲创业者、投资人和企业管理者在 Nordic TechBBQ 反复谈到同一个问题:接入 AI 很容易,保留选择、干预和退出的权力却很难。真正的 AI 主权不能只看数据存放在哪,还要看谁控制模型、算力、合同和迁移通道。

AI主权Anthropic美国出口管制
Debian投票给AI开了绿灯,但只拿到六成支持
人工智能 2026/8/29

Debian投票给AI开了绿灯,但只拿到六成支持

Debian用一场标准的Condorcet投票,在9个方案里选出了'负责任使用生成式AI',表面看是AI阵营大胜,287票对115票碾压了'禁止LLM'选项。但把所有对决摆开看,支持率只有64%对36%,版权、维护负担、伦理环境这三条分歧线一条都没被真正解决。

Debian生成式AI负责任使用AI
Suno称已能扫描版权还发AI溯源标签,音乐人却只能靠耳朵抓AI
人工智能 2026/8/29

Suno称已能扫描版权还发AI溯源标签,音乐人却只能靠耳朵抓AI

26岁EDM制作人H4RRIS靠“嘶嘶声”“人声结巴”公开指控同行用AI造假,被点名者未认领也未否认。Suno称已部署版权扫描和C2PA溯源标签,但这套机制既不透明、也没人验证能否在分发链条里真正生效,音乐人只能自己发明不靠谱的听觉判据来“执法”。

AI生成音乐SunoAI内容溯源
OpenAI断供Cursor:算的不是旧账,是Grok的训练管道
人工智能 2026/8/29

OpenAI断供Cursor:算的不是旧账,是Grok的训练管道

OpenAI宣布终止向Cursor提供模型,最晚2026年11月12日停供,理由是马斯克旗下公司的违约历史;但这份声明发布在SpaceX以600亿美元全股票收购Cursor两周之后,真正的赌注是防止自家模型能力经Cursor这条管道流入Grok的训练闭环。

OpenAICursorSpaceX
给LLM装上Datalog记忆:省下38倍token,却没赢过更简单的对手
人工智能 2026/8/29

给LLM装上Datalog记忆:省下38倍token,却没赢过更简单的对手

安全研究员Jordy Zomer把程序分析里的Datalog思路搬到LLM记忆系统,做出开源项目Lemmalog,用事实级联失效解决LLM长会话中'忘了假设已被推翻'的问题。但在他自己贴出的基准测试里,Lemmalog的准确率并没有超过更简单的现有记忆系统,唯一确定的优势是token消耗砍到近四十分之一。

LLM记忆系统LemmalogDatalog
分轨软件不用再上传云端了,但这份自由有代价
人工智能 2026/8/29

分轨软件不用再上传云端了,但这份自由有代价

StemDeck 是免费开源的本地音频分轨工具,用 Demucs 模型把歌曲拆成最多六条音轨,不用账号、不用把音频传到服务器;但速度看硬件、功能比 Moises 等云服务少,更适合练耳扒谱的爱好者,不是效率优先制作人的替代品。

StemDeck音频分轨Demucs htdemucs_6s