人工智能资讯 第14页

聚合当前分类下的最新内容,按时间顺序查看第 14 页精选文章。

GLM-5.3被指跟上前沿:比“是否蒸馏”更重要的是证据链
人工智能 2026/8/15

GLM-5.3被指跟上前沿:比“是否蒸馏”更重要的是证据链

围绕GLM-5.3的新讨论认为,中国实验室追赶前沿模型并非单靠蒸馏,更可能依赖预训练、后训练和快速发布的完整能力。但现有材料缺少模型卡、基准测试、价格与许可证,参数规模和技术路线都不能直接写成定论。对开发者和企业客户而言,真正有用的判断标准是实际任务成功率、部署成本与服务稳定性。

GLM-5.3Z.ai大语言模型
1856个标签喂不进AI,有人干脆让它先胡编
人工智能 2026/8/15

1856个标签喂不进AI,有人干脆让它先胡编

Simon Willison转发了Doug Turnbull的一个分类技巧:标签库太大塞不进prompt时,别喂真实标签,让模型先凭空想象出分类,再用向量检索去匹配语料库里最接近的真实标签。这招和学术界的HyDE方法思路几乎一样,但目前没有任何公开数据能证明它比传统方案更准。

大模型分类向量检索标签匹配
加州放行自动驾驶重卡,方向盘后还得坐个人
人工智能 2026/8/15

加州放行自动驾驶重卡,方向盘后还得坐个人

加州DMV解除万磅以上无人车路测禁令,Aurora和Kodiak拿到许可,Kodiak已率先在湾区试跑。测试仍须配备人类安全员,车辆原则上不能开进限速25英里以下的道路。Teamsters California已起诉DMV程序缺失,真正的悬念是安全员什么时候能撤。

自动驾驶重卡自动驾驶Kodiak AI
Spotify拟标记AI艺人并停止推荐,真正收紧的是流量入口
人工智能 2026/8/15

Spotify拟标记AI艺人并停止推荐,真正收紧的是流量入口

404 Media披露,Spotify正讨论标记AI生成艺人,并停止主动推荐相关内容。标签解决的是告知问题,推荐限制才会影响播放量和商业回报;但规则边界、适用范围与执行时间仍未公开。

AI生成音乐Spotify算法推荐
Google允许关闭Gemini可见水印:画面更干净,溯源转入后台
人工智能 2026/8/15

Google允许关闭Gemini可见水印:画面更干净,溯源转入后台

Google为Gemini和Flow加入“Media watermark”开关,用户可关闭AI生成内容右下角的闪光水印,但SynthID与C2PA信息仍会保留。它降低了创作者直接使用素材的门槛,也把内容识别从肉眼判断转向机器检测。真正的限制在于:隐形标记能否经受裁剪、压缩和平台转发,以及普通用户能否方便地验证。

AI生成内容水印GoogleGemini
Instagram换标看不清字,扎克伯格谈AI普惠:同一周,同一种冲动
人工智能 2026/8/15

Instagram换标看不清字,扎克伯格谈AI普惠:同一周,同一种冲动

Instagram本周换上新字标,不少人反映已经认不出在拼什么;同一周扎克伯格发布几千字AI宣言,核心命题是把技术普及给所有人就会带来更好结果。两件事放在一起看,暴露的是同一种管理冲动——把变化本身当成进步的证明,却回避了辨识度损耗和治理责任这两笔真实成本。

Instagram马克·扎克伯格人工智能
Google给AI水印装了关闭键,看得见的信任先没了
人工智能 2026/8/15

Google给AI水印装了关闭键,看得见的信任先没了

Google宣布用户可关闭Gemini、Flow等工具生成的图片、视频、歌曲上的可见水印,只保留肉眼看不到的SynthID和C2PA元数据。这看似是给创作者松绑,实际上把公众能自行验证的透明度,换成了只有Google自己能验证的技术承诺,而这套承诺此前已经出过纰漏。

AI生成内容水印GoogleSynthID
Qwen3.8-27B-FP8还没公告,聊天模板先剧透了什么
人工智能 2026/8/15

Qwen3.8-27B-FP8还没公告,聊天模板先剧透了什么

Hugging Face上出现的Qwen3.8-27B-FP8仓库还没有发布说明,能确认的只有一份聊天模板,却已经暴露了多模态输入、工具调用、推理强度分档和思考内容管理四套接口设计。比起27B这个参数数字,这套模板更像是通义千问把竞争重心从单一分数挪向可控推理与工程交付的信号。

Qwen3.8-27B-FP8通义千问Hugging Face
Hugging Face 的开源生态报告,自己该先接受体检
人工智能 2026/8/15

Hugging Face 的开源生态报告,自己该先接受体检

Hugging Face最新发布的《State of Open Models》报告称中国模型峰值参数已达2.78万亿、下载量与点赞量25强几乎不重合,但报告里最扎眼的两组数据——中国规模碾压和下载集中度85.6%/99.2%——细查之下都有解释空白。参数规模的胜负,得先分清总参数和真正干活的激活参数;下载集中度的结论,得先说清分母是什么。

Hugging Face开源模型State of Open Models
Meta开放Glimmer,却把更强的Muse Spark留在API里
人工智能 2026/8/15

Meta开放Glimmer,却把更强的Muse Spark留在API里

Meta本周开放了可下载、自行部署的Glimmer,同时把能力更强的Muse Spark留在自家API中。开放权重确实给开发者更多控制权,但许可证、硬件需求和能力差距仍不清楚。扎克伯格说AI应“属于所有人”,目前落地的更像分级开放。

MetaGlimmerMuse Spark
两分钱一次搜索:Toast 1 想替大模型省下的是上下文
人工智能 2026/8/15

两分钱一次搜索:Toast 1 想替大模型省下的是上下文

Mixedbread发布搜索智能体Toast 1,单次检索约两分钱、8秒完成,接进前沿模型能省下上下文和成本。金融基准正确率从33%冲到70%,法律基准同分数下Token砍掉超七成,但两组数据都来自厂商自测,还没经过第三方检验。

Toast 1Mixedbread搜索智能体
一份不谈效率的七本书单,为什么偏偏留下旧版 Roget 词典
人工智能 2026/8/15

一份不谈效率的七本书单,为什么偏偏留下旧版 Roget 词典

一篇私人书单里,作者把更厚的第八版 Roget 词典放回书架,留下熟悉的第七版。这个选择提醒写作者:AI 可以迅速改写句子,却容易跳过“我究竟想表达什么”的辨认过程。真正有价值的工具,不只给答案,还应保留比较、犹豫和选择。

AI写作工具Roget's Thesaurus同义词词典
Meta专利曝光:AI眼镜想靠认脸给你的晚宴剪高光
人工智能 2026/8/15

Meta专利曝光:AI眼镜想靠认脸给你的晚宴剪高光

Meta一份公开专利显示,AI眼镜会用人脸识别认出聚会上每个人,再结合表情和眼动数据自动剪出“高光集锦”推送给用户。这项技术路线与6月被曝光后又匆忙撤除的人脸识别代码同源,专利文本还暗示应用范围可能远不止眼镜本身。

人脸识别MetaAI眼镜
OpenAI、Anthropic中端模型传出大降价:旗舰溢价开始过商业关
人工智能 2026/8/14

OpenAI、Anthropic中端模型传出大降价:旗舰溢价开始过商业关

一份标注为2026年8月的材料称,OpenAI与Anthropic大幅下调中端模型价格,中国可下载、可修改的模型正在进入更多企业选型名单,但美国厂商没有同步削弱旗舰溢价。企业不能只比token报价,真正该算的是成功完成一项任务要花多少钱。价格战最后检验的,是美国AI巨头能否同时守住高端收入、企业客户和利润。

大模型价格战OpenAIAnthropic
Kog的30倍推理加速承诺,卡在一个20亿参数的小模型上
人工智能 2026/8/14

Kog的30倍推理加速承诺,卡在一个20亿参数的小模型上

法国初创公司Kog称在标准GPU上跑出3,000 tokens/s、目标30倍推理加速,但演示用的是自研的20亿参数小模型,测试条件至今未见公开可核实的文档。能不能在真实大模型上复现,将决定它是软件版Cerebras,还是又一份止步于Hacker News的技术预览。

大模型推理加速KogLaneformer 2B
报告:近半AI生成代码未过安全测试,软件正被推向TEMU式供给
人工智能 2026/8/14

报告:近半AI生成代码未过安全测试,软件正被推向TEMU式供给

生成式AI正把代码、图书、音乐和视频推向类似TEMU的低价高供给模式,审核、维护和版权成本被推迟到上线后才暴露。2025年Veracode报告显示,测试样本中约45%的AI生成代码未通过安全检测,但样本有限,不能直接推广为所有AI代码都不安全。真正的新变量是生成规模、速度和平台分发,而不是低质内容第一次出现。

生成式AIAI生成代码软件安全
Opus 5能力更强,却被指更难协作
人工智能 2026/8/14

Opus 5能力更强,却被指更难协作

一名开发者在2026年8月14日撰文称,Opus 5基准表现不输Opus 4.7、4.8和Fable,但协作时更爱自行假设、擅自改写计划。这更像基准测试奖励果断作答带来的副作用,而非能力退步。建议是:开发者在关键节点手动加审查,工程负责人换模型前先小范围试跑,再决定放权尺度。

Opus 5编码代理人机协作体验
DeepSeek API引入峰谷定价:低价换利用率,不等于算力告急
人工智能 2026/8/14

DeepSeek API引入峰谷定价:低价换利用率,不等于算力告急

DeepSeek为V3和R1 API引入分时折扣,北京时间凌晨至早晨的调用价格最低降至常规价四分之一。它更像云计算常见的需求调度,而非算力短缺的直接证据;真正受益的是能迁移批处理任务的开发团队,实时业务省不了多少。

DeepSeek峰谷定价大模型API
苹果在中国的AI,从“借模型”变成了“自己的模型”
人工智能 2026/8/14

苹果在中国的AI,从“借模型”变成了“自己的模型”

苹果与阿里巴巴联合训练了一款中国定制大模型,用于即将上线的Apple Intelligence中国版,苹果借此可能成为首家在华获批自有AI模型的美国公司。但从“用阿里模型”到“拥有自己的模型”,这一措辞升级背后的技术贡献边界和备案主体归属,目前都说不清楚。

苹果阿里巴巴Apple Intelligence
没有GPU也能跑大模型?Lumabri拿CPU和SSD赌一把
人工智能 2026/8/14

没有GPU也能跑大模型?Lumabri拿CPU和SSD赌一把

开源项目Lumabri把MoE模型按专家拆分,一次转发只送几KB激活值,普通CPU和SSD也能接单干活,不用啃下整层的算力。项目自称本地与分布式输出逐字节一致,靠SHA-256、Ed25519和抽检堵说谎节点,但挡不住多数节点合谋。目前只是Linux上的工作原型,性能数字全来自项目自己的测试脚本,谁该现在动手、谁该再等等,答案还没揭晓。

Lumabri大模型分布式推理MoE模型
GLM-5.3跑分跳了6倍,却没人能验证一个数字
人工智能 2026/8/14

GLM-5.3跑分跳了6倍,却没人能验证一个数字

Z.ai发布GLM-5.3,宣称仅靠post-training scaling就让编码与网络安全能力大幅跃升,但对比表里所有数字和竞品跑分都只有厂商一方自证。更值得盯住的是:漏洞利用能力的涨幅远超漏洞发现能力,这种不对称比跑分本身更说明问题。

GLM-5.3Z.ai大模型评测