人工智能资讯 第3页
聚合当前分类下的最新内容,按时间顺序查看第 3 页精选文章。

77篇论文里出现了不存在的作者,学术出版的漏洞比AI更先暴露
一份调查发现,至少77篇论文出现了疑似并不存在的作者姓名,包括 Elena Vasquez、Marcus Chen 等。真正危险的不是模型会编名字,而是期刊、索引和审稿流程竟然能让这些名字一路进入正式记录。

这只AI狗碗号称能提前测出蜱虫热,但它自己的官网先打起了架
Palo Alto创业公司Hoomanely推出智能喂食站EverBowl,靠AI分析狗的进食饮水行为提前预警疾病,已获180万美元pre-seed融资。但公司官网上关于beta测试规模、订阅定价、准确率的说法互相矛盾,暴露出早期消费医疗AI在证据和营销之间的落差。

luna降价八成,小模型的"够用论"该信几分
OpenAI的小模型gpt-5.6-luna今年被官方降价80%,跑一次复杂研究任务只要几十美分,让"小模型够用"的说法流行起来。但它宣传的百token每秒速度只对企业付费模式生效,而两套权威跑分对小模型和旗舰模型的差距给出了相反答案,说明"够用"高度取决于任务类型,不是一句话能定论的。

72%青少年用过AI陪伴,钥匙却在别人手里
记者Bridget Todd在父母去世后不知不觉从用ChatGPT查医疗资料变成向它倾诉情绪,这一经历促成她的新书《Love at First Prompt》。多项研究显示,这种"滑入陪伴"是规模化的结构性现象,真正问题不是用户是否孤独,而是这段亲密关系由谁拥有、谁能随时改写规则。

40秒视频要花多少钱:Gemini Omni 1.1 Flash的账没写进通稿
Gemini Omni 1.1 Flash主打场景延伸、首尾帧插值和4K升采样,官方称其“生产就绪”,但按官方计费拆解,40秒延伸视频输出成本已近4美元,且开发者发布当天就在GitHub和Reddit上报出架构迁移、身份漂移和安全过滤器黑箱一堆麻烦。控制力升级是真的,账本和bug列表也是真的。

ChatGPT让论文涨0.86分,但批判性思维训练几乎白搭
OpenAI与博科尼大学的随机对照实验显示,拿到ChatGPT的学生评分从2.09分跳到2.95分,统计显著;但专门训练批判性思维的学生评分几乎没变,收益全部体现在评分表测不到的创意多样性上。这说明官方所说的'AI与批判性思维互补',在传统评分体系里更像是AI单独起效,训练的价值被现有评估标准系统性低估。

AI耗水争议:那个被疯传的数字,可能一直找错了嫌疑人
美国数据中心抗议不断,但被反复引用的“2023年660亿升冷却耗水”其实统计的是全部数据中心,不是AI专属;更关键的是,发电环节的间接耗水规模比这高出一个数量级,真正该盯的是电力结构而非机房里的水管。

黄仁勋又喊"实现AGI",转头自己说这词没意义
英伟达CEO黄仁勋在2026年8月的财报电话会上说,公司"对许多任务"已经实现AGI,话音未落又称这类里程碑"没有意义"。这不是一次可验证的技术宣告,而是把AI竞赛的评判标准从模糊的AGI名号,换成了能不能把算力变成利润。

Google AI Mode能订机票酒店了,但它不想当“旅行社”
Google给AI Mode加上了追踪机票、预订酒店、显示积分里程价格三项新功能,看起来像一个全能AI旅行代理。但细看合同条款会发现,Google在交易里刻意不做“交易方”,责任上限只有200美元,这和它对外营销的“旅行助手”形象并不一致。

Waymo暗讽Tesla“摄像头不够”,可它自己也没做过对照实验
Waymo在技术博客里甩出2.206亿英里的安全数据,暗讽Tesla纯视觉路线不够用,但这组数据证明的是整套系统的表现,而非激光雷达单独的功劳。更关键的是,双方目前引用的评价标准根本不在同一套体系里,这场“摄像头够不够”的争论还停留在理念声明阶段。

Cocomelon的AI操作手册:护栏是给律师看的,未必是给画师看的
Moonbug被曝要求Cocomelon等品牌的动画师开始试用AI,内部《Studio AI Bible》详细规定了能做什么、不能做什么。规则表面在保护艺术家的创作主导权,实际逻辑更接近保护公司的版权可辩护性——而政策没提的,是今年5月刚发生在自家片场的罢工。

商家扎堆手写"拒绝AI"标语走红,广告业却读错了一组数字
一批商家、酒吧、图书馆用手写便签宣称拒绝AI宣传,在Instagram收获数万点赞。多份2025-2026年消费者调查显示,这背后不是段子,而是可测量的信任落差——82%的广告高管误以为消费者喜欢AI广告,实际只有45%买账。

DeepMind 要试点“双盲 AI 评测”,但谁被蒙在鼓里还没说清
材料称 Google DeepMind 将于 2026 年 8 月 27 日宣布试点其所谓“全球首次”双盲 AI 评测,但未提供方法、样本、执行机构或结果。双盲有机会削弱品牌偏见,却无法自动解决利益冲突、测试集污染和选择性披露。没有透明协议、独立监督与复现入口,这仍是一项待核验的试点宣称。

Photoshop新标注功能悄悄接入Gemini,Firefly的安全牌还灵吗
The Verge一篇标题党式报道背后,Adobe其实用了半年时间把AI Assistant和AI Markup铺进Photoshop的网页、移动、Firefly Editor和桌面Beta四个平台;真正的新闻不是“又加AI”,而是桌面版最新的Markup功能已经兼容Gemini,这和Adobe一直靠Firefly“商业安全+版权赔偿”卖订阅的说法出现了缝隙。

睡眠打了71分,这个法官自己从没被审过
The Verge编辑写了篇法庭体专栏,吐槽Pixel Watch给露营夜打出71分,要求改判80分。但真正的问题不是分数冤不冤,而是这套从未公开权重、也从未被独立验证过的算法,凭什么给你的睡眠下判决书。

399美元一只,双足机器人这次卖的是训练栈,不是成品
Pollen Robotics 预售399美元的开源双足机器人 Microduck,卖的不是成品,而是一整套仿真训练加强化学习部署的工具链。硬件门槛压得很低,但sim2real效果只有官方演示为证,交付要等到2026年圣诞节前,隐藏成本也没算完。真正该问的是它能不能把长期被大厂演示视频垄断的双足机器人,变成开发者真能上手折腾的东西。

英伟达129亿美元收购Hugging Face,协议未签、算盘先明
英伟达据报道已同意以约129亿美元收购开源AI平台Hugging Face,但协议尚未正式签署,交易仍可能生变。这笔收购真正的目标不是Hugging Face一年1.5亿美元的收入,而是英伟达借它锁住开源AI生态入口,对冲客户自研芯片的风险,同时重新切入云计算业务。

开发者被裁做出AI CEO?这故事很燃,但一个证人都没有
开源项目OpenExecutive用8个Claude智能体拼出一个“虚拟高管”,故事包装成开发者被AI裁员后的反击,但裁员的公司、规模、当事人全部查无实据。项目自己的发布日期也前后矛盾,真正该关注的是审计挖出的记忆检索缺陷和安全短板,而不是这个爽文开头。

6B激活参数背后,Qwen在预告Qwen4的架构底牌
Qwen3.8-Flash-Next表面是又一个开源模型,总参数125B却只激活6B,官方明说这是Qwen4架构的早期预览。把它的注意力混合、门控残差、N-gram记忆和超稀疏MoE路由拆开看,再对照自报跑分里的胜负与限度,能看清这次开源阵营下一步想怎么打。

代码涨220%、功能只涨36%:Meta的AI裁员计划栽在自己的数据里
Meta内部代号Project OT的重组计划,今年1月从夏威夷高管闭门会议提出,设想裁员最高60%、用AI agent接管日常工作,但5月执行首轮裁员后,11月的第二轮被扎克伯格取消。真正让计划急刹车的,不是AI不够炫,而是Meta自己拿来证明AI好用的内部数据——代码改动暴涨220%,事故和返工却跟着涨了40%到70%。

Google新转录AI删掉了嗯啊,却悄悄改写了你的话
Google发布Gemini 3.5 Transcribe,公开预览,错误率降至5.5%、延迟改善70%,价格压到每分钟半美分级别。但它的智能模式会默认删改口误、重组语序,且和时间戳、说话人分离功能互不兼容——转录已经不只是记录声音,也在悄悄改写内容。