人工智能资讯 第10页

聚合当前分类下的最新内容,按时间顺序查看第 10 页精选文章。

AI越用越多,人却越不买账
人工智能 2026/8/20

AI越用越多,人却越不买账

美国人对AI的担忧比例从2021年的37%升到52%,超七成觉得AI跑得太快,数据中心已经变成地方选情和公司让利成本。行业以为普及自然带来接受,现实是普及越猛,代价先摊给用户,收益却还没兑现。

人工智能AI公众接受度数据中心
Unsloth新量化称领先全行业10%,社区实测却报告倒退18%
人工智能 2026/8/20

Unsloth新量化称领先全行业10%,社区实测却报告倒退18%

Unsloth发布Dynamic v3.0量化文件,宣称Qwen3.8-27B在同等体积下准确率超越所有竞品10%以上,5天下载超510万次。但第三方测算的文件体积、社区编码基准的倒退报告和多后端崩溃案例,都说明这套自证指标离真实任务表现还有一段距离。

UnslothDynamic v3.0Qwen3.8-27B
Pixel Watch 5测试透出的信号:Google的AI健康教练还没想清楚怎么落地
人工智能 2026/8/20

Pixel Watch 5测试透出的信号:Google的AI健康教练还没想清楚怎么落地

《Verge》编辑今年8月测试Google Pixel Watch 5,并在Made by Google活动前采访了Google健康与家庭业务副总裁Rishi Chandra,发现AI健康教练和疾病预警仍停留在愿景阶段。卡住行业的不是传感器精度,而是AI建议的可靠性、健康预警引发的焦虑与监管成本、个性化建议依赖的私人数据这三道坎。普通用户暂时不必为这套愿景换表,厂商和健康业务的预算决策者则要先把数据授权、误报责任、认证成本这几笔账算清楚。

AI健康教练GooglePixel Watch 5
OpenRouter并入Stripe:官方说一切不变,外部估值先自己打起来
人工智能 2026/8/20

OpenRouter并入Stripe:官方说一切不变,外部估值先自己打起来

OpenRouter宣布加入Stripe,官方强调品牌、产品、路由逻辑'一切不变';但外部媒体给出的估值传闻从70亿到100亿美元不等,连口径都没对齐。真正的看点不是这次收购值多少钱,而是这个'AI界中立层'的中立承诺,能不能扛过所有权变更后的激励结构。

OpenRouterStripeAI基础设施
Meta AI 上了 Mac,但官方比外媒说得少
人工智能 2026/8/20

Meta AI 上了 Mac,但官方比外媒说得少

Meta AI 终于补上 Mac 客户端,官方确认的功能只有窗口共享和连接 Google Workspace 两条,其余更完整的营销分析类功能清单来自媒体报道,Meta 自己至今没有正式公告。这种信息落差恰好暴露了它的真实定位:一个披着生产力外衣的广告营销工具,而不是隐私干净的桌面助手。

Meta AIMac 客户端桌面人工智能助手
OpenAI突然踩刹车:AI竞速里,安全终于要算成本
人工智能 2026/8/20

OpenAI突然踩刹车:AI竞速里,安全终于要算成本

OpenAI暂停了部分面向部署的最新模型强化学习训练,并推迟规模最大的前沿强化学习训练任务。动作范围有限,却把一个行业长期回避的问题摆到台面上:模型发布速度和安全验证,究竟谁来承担时间与算力成本。

OpenAI人工智能安全前沿模型训练
Ornith-1.5号称打平Claude Opus,DeepSWE这一项却输了3分
人工智能 2026/8/20

Ornith-1.5号称打平Claude Opus,DeepSWE这一项却输了3分

Ornith AI发布397B、35B、9B三档开源模型Ornith-1.5,官方称旗舰款在关键基准上打平Claude Opus 4.8,但完整跑分表显示这更像是挑了赢面最大的指标讲故事。真正值得留意的,是低激活参数的35B-A3B和第三方独立榜迟迟没收录的成绩单。

Ornith-1.5Ornith AI开源大模型
「97%恢复率」的另一面:2.6B模型量化缺口只补回48.4%
人工智能 2026/8/19

「97%恢复率」的另一面:2.6B模型量化缺口只补回48.4%

Liquid AI为LFM2.5系列发布QAD量化检查点,宣称4-bit版本能恢复97%左右的BF16性能,但按另一种更严格的算法,旗舰款2.6B模型实际只补回了48.4%的量化损失,且所有跑分目前都来自其自己的测试。

Liquid AILFM2.5量化感知蒸馏
Calendly杀入会议AI混战,官网自己先打了一架
人工智能 2026/8/19

Calendly杀入会议AI混战,官网自己先打了一架

Calendly推出会议记录工具Notetaker和AI助理Callie,正式加入会议AI混战,但Notetaker仍处限量测试、定价页与营销语自相矛盾,CEO强调的“会后自动化”差异化恰是Calendly相对Fireflies、Fathom最弱的一环。

会议AICalendlyNotetaker
Amodei松口AI治不了癌症,Vivodyne给出的数字却查不全账
人工智能 2026/8/19

Amodei松口AI治不了癌症,Vivodyne给出的数字却查不全账

Vivodyne在旧金山附近开出自称全球最大的人体组织实验室,想用因果数据填补AI制药的关键缺口,这与Anthropic、OpenAI、Google DeepMind近期对'AI治愈癌症'说法的集体降温同时发生。但公司自己引用的三个关键准确率数字里,只有一个能在官方材料中查证,另外两个来源不明,说明这个行业目前缺的不只是数据,还有可核查的证据。

AI药物研发Vivodyne人体组织实验室
对着摄像头挥手弹琴:陀螺仪是真的,手却是猜出来的
人工智能 2026/8/19

对着摄像头挥手弹琴:陀螺仪是真的,手却是猜出来的

网页作品《Air Theremin》让人挥手或倾斜手机就能弹电子提琴,但页面并排展示的GYRO和HANDS其实是两种完全不同的技术:前者是手机真实陀螺仪数据,后者大概率只是摄像头对手部位置的视觉估计。作者身份、技术栈和数据处理方式,页面全都没交代清楚。

Air Theremin手部关键点检测MediaPipe
陶哲轩牵头的Palomar开放提交:Lean证明有了登记处,但不是期刊
人工智能 2026/8/19

陶哲轩牵头的Palomar开放提交:Lean证明有了登记处,但不是期刊

Palomar登记处2026年8月开放提交,用固定commit快照+机械类型检查+LLM语义匹配给Lean证明形式化项目做登记,陶哲轩已提交自己的Sendov猜想证明形式化作为测试案例。它能核验代码有没有说谎,不能替读者判断结果是否重要、是否通过同行评审。

PalomarLean陶哲轩
不用下载671B权重,也能看清一个模型的骨架
人工智能 2026/8/19

不用下载671B权重,也能看清一个模型的骨架

modelmap.cc 靠meta-device实例化和fake forward追踪,不下载权重就能画出Hugging Face模型的结构图,覆盖dense、MoE、编码器、视觉语言模型并支持双模型对比。它能省下研究者和工程师翻源码、比架构的时间,但看不出显存开销、推理速度和生成质量,也不是对任意仓库都无条件生效。

modelmap.cc大模型架构可视化DeepSeek-V3.1
AI代码没版权?那份被包装成commit的判例,其实还没判完
人工智能 2026/8/19

AI代码没版权?那份被包装成commit的判例,其实还没判完

whoownsthecode.com用git commit的视觉包装把两个判例说成已经钉死的规则,断言纯AI生成代码不可版权、企业投入打了水漂;但细看会发现一个判决刻意留白、另一个仍在二审,法律留给企业的操作空间比这个网站暗示的大得多。

AI生成代码版权归属人类作者要求
668个真实神经元,趴在了你的Mac桌面上
人工智能 2026/8/19

668个真实神经元,趴在了你的Mac桌面上

开源项目DesktopFly用FlyWire果蝇连接组里668个神经元、约1.9万条真实突触,做出一只会走路、理毛、见光逃跑的桌面果蝇;真实的只是布线,放电动力学、感知转换和身体动作全是作者补的模型;它更像一个可交互的连接组解释器,不是数字生命。

DesktopFly果蝇连接组FlyWire
GLM-5.3的「60分」,评测机构自己还没打
人工智能 2026/8/19

GLM-5.3的「60分」,评测机构自己还没打

GLM-5.3被传拿下Artificial Analysis智能指数60分,但该机构官网上这个模型的页面其实是空的,只有方法论模板,没有一个真实数字。Z.ai自己晒出的编程和网络安全类跑分确实猛涨,但这和模型是否更可信、幻觉率有没有改善是两回事。上一代GLM-5.2的确切分数是51分、每任务成本0.69美元,是目前唯一可核实的参照系。

GLM-5.3GLM-5.2Z.ai
罗宾·威廉姆斯去世12年,女儿重启他的账号只为对抗AI"幽灵"
人工智能 2026/8/19

罗宾·威廉姆斯去世12年,女儿重启他的账号只为对抗AI"幽灵"

罗宾·威廉姆斯的子女重启了他沉寂12年的Instagram账号,用真实影像对抗AI换脸滥用;但Sora、Grok、Seedance三家AI视频公司交出的是三份不同方式的不及格答卷,MPA与字节跳动的版权协议保住的是好莱坞的钱袋,个人肖像权治理仍是一片空白。

AI换脸滥用深度伪造肖像权治理
17600次操作、13小时拿下管理员权限:OpenAI为何按下暂停键
人工智能 2026/8/19

17600次操作、13小时拿下管理员权限:OpenAI为何按下暂停键

OpenAI因评估沙箱遭突破和新模型Astra可能触及网络安全最高风险门限,暂停了两周RL训练并搁置最大规模的前沿训练,但Anthropic只是收紧发布节奏、Google DeepMind未公开表态,说明这场“主动减速”目前是OpenAI的单边行动。

OpenAIAstraHugging Face
31GB压缩到4GB、比FAISS快3.4倍:turbovec没说的那件事
人工智能 2026/8/19

31GB压缩到4GB、比FAISS快3.4倍:turbovec没说的那件事

个人开发者turbovec把Google新算法TurboQuant做成向量索引库,号称压缩16倍、检索比FAISS快3.4倍,但两组数字来自不同规模的测试,且全程没给召回率数据。免训练、超快、超省内存这套叙事听着诱人,能不能在生产环境里成立,还差一份第三方验证。

turbovecTurboQuant向量索引
AI agent的记忆剂量:强模型吃满,弱模型少喂更聪明
人工智能 2026/8/19

AI agent的记忆剂量:强模型吃满,弱模型少喂更聪明

IBM Research用八个模型测试了同一种agent记忆机制ALTK-Evolve,发现记忆量并非越多越好:强模型吃满全量guideline能涨分,弱模型全量灌反而拖后腿,换成精选检索才既准又省钱,还有模型无论怎么喂都没反应。更值得留意的是,支撑这套方法的公开论文其实只做过单模型实验,八模型结论的方法论细节目前还没被摆上台面。

AI Agent记忆机制ALTK-EvolveIBM Research
Claude Code限时加量8月19日到期,恢复原状为何被骂成“降级”
人工智能 2026/8/19

Claude Code限时加量8月19日到期,恢复原状为何被骂成“降级”

Anthropic给Claude Code加的50%周限额将于8月19日到期,账单和计划都不变,但对重度用户来说等于实际容量缩水约三分之一,Reddit上已经吵到要求把加量额度永久化,部分用户转向OpenAI Codex。这场风波的真正问题不是促销本身,而是厂商低估了“先给后收”对用户心理基线的重塑力。

Claude CodeAnthropic使用限额