人工智能资讯 第11页

聚合当前分类下的最新内容,按时间顺序查看第 11 页精选文章。

Asana两周干完五年的活,这笔账该怎么算
人工智能 2026/8/19

Asana两周干完五年的活,这笔账该怎么算

Asana用OpenAI Codex把过时测试框架Enzyme从代码库里清空,原计划要五年、约600万美元的人力方案被压缩到两周、1.2万美元。但这组对比是估算成本对实际支出,任务本身恰好是脚本可验证、可并行拆分的理想agent场景,规模更大的Airbnb同类迁移耗时更长,说明这套打法离普适奇迹还有距离。

OpenAI CodexAsana编码智能体
Cybercab要上路了,特斯拉却拿不出一英里可验证的数据
人工智能 2026/8/19

Cybercab要上路了,特斯拉却拿不出一英里可验证的数据

特斯拉计划最快本月在奥斯汀公开推出无方向盘的Cybercab,但真正的无人版本7月才开始私有道路测试,至今没有任何可验证的商业运营数据。对比已规模化运营的Waymo和处于过渡期的Zoox,Cybercab在这场三方竞赛里唯一拿得出手的是发布会日程,而不是里程和事故率。

Cybercab特斯拉Robotaxi
Etched估值一个月翻倍至210亿美元,但领投方换了个说法
人工智能 2026/8/19

Etched估值一个月翻倍至210亿美元,但领投方换了个说法

AI推理芯片公司Etched宣称一个月内估值从103亿美元翻倍至210亿美元,由客户Jane Street主导新轮融资,但就在一个月前领投方还是Sequoia Capital。这两组数字目前只有TechCrunch报道和公司自家博客背书,独立确认尚未出现,值得在追捧之前先打个问号。

EtchedAI推理芯片Jane Street
Claude文本水印计划:当“灰色”和“阴天”被当成同一个词
人工智能 2026/8/19

Claude文本水印计划:当“灰色”和“阴天”被当成同一个词

Anthropic计划给Claude生成的文本植入可检测水印,方法不是添加隐藏字符,而是用密钥和上下文调整候选词选择。公司称读者几乎无法区分水印文本与普通输出,但“点赞率差不多”并不能证明写作质量没有损失;真正暴露出来的,是平台对词语、意图和风格的理解仍停留在统计层面。

AI文本水印ClaudeAnthropic
Sentence Transformers称ColBERT检索已可pip安装,PyPI却还停在5.6.1
人工智能 2026/8/19

Sentence Transformers称ColBERT检索已可pip安装,PyPI却还停在5.6.1

Hugging Face旗下Sentence Transformers博客宣布v6.0新增MultiVectorEncoder,让ColBERT式多向量检索接入主流embedding API,但同期PyPI稳定版仍是5.6.1,相关代码6月才提交评审。这提示读者:功能听起来能用,不代表能稳定上生产,多向量检索背后动辄十几倍到几十倍的索引膨胀代价也被博客一笔带过。

Sentence TransformersColBERTMultiVectorEncoder
X算法'专挑民主党人'?这篇PNAS论文的DOI查不到
人工智能 2026/8/19

X算法'专挑民主党人'?这篇PNAS论文的DOI查不到

一篇被转述为发表于PNAS的研究称X算法用愤怒反馈循环'专门伤害'民主党用户,但检索无法核实该论文的DOI,与作者相关的可查证论文设计完全不同,另一项独立的Nature随机对照实验反而得出'算法让所有用户观点更趋保守'的相反方向结论。这场'算法有偏见'的叙事,证据基础比标题暗示的更脆弱。

算法偏见X推荐算法
苹果AirPods摄像头意外曝光:两年拼图只差最后一块
人工智能 2026/8/18

苹果AirPods摄像头意外曝光:两年拼图只差最后一块

macOS Tahoe 26.7候选版里一段没删干净的演示视频,把苹果代号B790的摄像头AirPods具象成了「看书问Siri」的场景。这不是孤立泄密,而是郭明錤、Bloomberg、iOS beta代码两年多拼图的最后一块,也暴露出苹果和Meta在可穿戴AI上完全不同的赌注。

AirPods苹果可穿戴AI
OpenAI高调发布ChatGPT for Teens,官网却找不到这个产品页
人工智能 2026/8/18

OpenAI高调发布ChatGPT for Teens,官网却找不到这个产品页

OpenAI周一宣布推出ChatGPT for Teens,加入Study Mode、防作弊提醒和家长安全通知,但翻遍官方渠道找不到一个独立的产品页面——这些功能其实是过去八个多月陆续上线的碎片,此次更像是在多起青少年自杀诉讼压力下的一次整合重发。真正的短板不在功能有没有,而在学校层面缺乏强制执行力。

OpenAIChatGPT for Teens青少年人工智能安全
Warp的AI软件工厂上线,却连自己都算不清自动化率
人工智能 2026/8/18

Warp的AI软件工厂上线,却连自己都算不清自动化率

Warp推出软件工厂基础设施Warp Factories,主打中小团队即插即用,兼容多模型多harness;但CEO对TechCrunch说的30%-35%自动化率,和Warp官方博客自己披露的60%、20%-30%两个数字互相打架,暴露这个赛道的自我报告指标还很粗糙。买家更该盯紧credit账单和口径定义,而不是营销数字。

Warp FactoriesAI软件工厂AI Agent
Firefox把AI功能改了名,却没把这句话写进标题
人工智能 2026/8/18

Firefox把AI功能改了名,却没把这句话写进标题

Mozilla把去年预告的AI Window改名Smart Window,配了一键关闭AI的总开关,还在4月起分区域上线。但它自己的隐私文档承认:一旦打开记忆功能,处理的不只是AI窗口里的对话,还包括Classic窗口的浏览历史——这一点几乎没人细读。

FirefoxSmart WindowMozilla
Google的宠物AI记不住猫,因为它从来没打算认脸
人工智能 2026/8/18

Google的宠物AI记不住猫,因为它从来没打算认脸

Google Home的Pet Memory被曝认不出用户家里的猫,但翻查官方文档会发现,这功能本来就不是生物识别,而是用户手动喂给AI的姓名标签,订阅、摄像头版本、账号权限任何一环出问题都会导致“失忆”。Google、Ring、Eufy三家智能摄像头厂商实际在解决三个不同的问题,消费者很容易把它们当成同一套“宠物AI”去比较。

Pet MemoryGoogle Home宠物识别
Code.org悄悄改名CodeAI,转身就和OpenAI签了一年协议
人工智能 2026/8/18

Code.org悄悄改名CodeAI,转身就和OpenAI签了一年协议

OpenAI与CodeAI宣布为期一年的教育合作,同步上线面向13-17岁青少年的ChatGPT for Teens。真正的看点不是又一份教育公益通稿,而是CodeAI的前身正是那家做了十余年编程教育的Code.org——一家老牌非营利机构改名转身,第一步就是和自己要监督的对象签约。

人工智能教育OpenAICodeAI
ChatGPT青少年模式上线:锁住了作业,没锁住依恋
人工智能 2026/8/18

ChatGPT青少年模式上线:锁住了作业,没锁住依恋

OpenAI给ChatGPT加了一套默认开启的青少年模式,内容限制、家长通知、作业提醒一次性打包上线。但独立测试和调查显示,这套系统在工具性使用上管得住,在家长最担心的情感依赖上几乎是空白,年龄识别本身还带来新的隐私争议。

ChatGPT青少年模式OpenAIChatGPT
Google拍下破产航司数据,通话录音的账却对不上
人工智能 2026/8/18

Google拍下破产航司数据,通话录音的账却对不上

Google在Spirit Airlines破产拍卖中以1000万美元中标其去标识化企业数据,用于训练AI;但法院文件显示客服通话录音本应被明确排除在交易之外,与公开报道中“3000万条录音电话”的说法直接矛盾,去标识化的边界远比通稿说的模糊。

AI训练数据GoogleSpirit Airlines
跑分说快40%,复核后慢4倍:AI代理正在拉低刷榜成本
人工智能 2026/8/18

跑分说快40%,复核后慢4倍:AI代理正在拉低刷榜成本

工程师Dan Luu用AI代理写的正则引擎FRE,先被曝出比Rust regex库快40%,换统一测试接口后变慢1.5倍,换真实留出语料后关键场景慢了约4倍。核心判断不是AI代码普遍更快,而是钻测试漏洞的成本被砍到接近零,没有独立复现和留出集的跑分数字正在贬值。对靠跑分做采购和预算决策的工程团队来说,这意味着以后要先问测试口径,再批预算。

AI写代码基准测试AI代理
GPT-5.6 Sol被曝降价50%,先别急着改成本预算
人工智能 2026/8/18

GPT-5.6 Sol被曝降价50%,先别急着改成本预算

GPT-5.6 Sol传出价格下调50%的消息,但现有材料没有交代定价渠道、活动期限和适用计费项。真正需要确认的,是这究竟属于官方永久调价,还是聚合平台的阶段性补贴;在答案明确前,开发者可以测试,企业不宜据此重做年度预算。

GPT-5.6 SolOpenAIAPI定价
Qwen 3.8 27B跑分52分逼平巨兽模型,对比名单却查无实据
人工智能 2026/8/18

Qwen 3.8 27B跑分52分逼平巨兽模型,对比名单却查无实据

阿里Qwen 3.8 27B在Artificial Analysis Intelligence Index上拿到52分,与GPT-5.6 Luna持平,仅比标注753B参数的GLM-5.2、标注1.6B参数的DeepSeek V4 Pro低1分;但核实发现这几个对比型号在公开信息里查无实据,加上该模型此前被指「严重过度思考」,这份反差跑分更适合审慎看待,而非直接当成小模型全面追平大模型的证据。

Qwen 3.8 27B大语言模型Artificial Analysis Intelligence Index
Anthropic年化收入据报升至65亿美元:增长很快,但别把运行率当营收
人工智能 2026/8/18

Anthropic年化收入据报升至65亿美元:增长很快,但别把运行率当营收

Anthropic的年化收入据报达到65亿美元,两个月增加18亿美元,按同一口径计算增幅约38%。这说明Claude正在加速商业化,但年化运行率不等于已经入账的收入;真正决定增长成色的,是客户留存、毛利和收入集中度。

Anthropic年化收入运行率650亿美元
同一批GPU,利用率多出33个点:换的不是硬件,是排队顺序
人工智能 2026/8/18

同一批GPU,利用率多出33个点:换的不是硬件,是排队顺序

Dharma-AI团队用同一批GPU对比约束感知分配器与FIFO调度器,7个基准场景里利用率最高提升33个百分点,优先级加权产出最高翻倍还多,硬件一张没加。但这份自评benchmark还没给出队列时延、公平性等用户侧证据,'排队顺序本身就是一次容量决策'这个判断,比数字本身更值得记住。

GPU调度Dharma-AI约束感知分配器
AI;DR刷屏背后:编辑的活儿,被悄悄转嫁给了谁
人工智能 2026/8/18

AI;DR刷屏背后:编辑的活儿,被悄悄转嫁给了谁

seclilc那条推文两天刷出16.6万点赞,捧出了「AI;DR」这个新梗,但拒读AI写的东西这件事,今年2月就已经在多个平台发酵。真正的问题不是AI写得好不好,而是审阅这道工序被谁扛下来了。

AI生成内容AI;DR内容审阅
8个月估值翻4倍,Higgsfield的54亿美元里最该被追问的是7亿美元收入
人工智能 2026/8/18

8个月估值翻4倍,Higgsfield的54亿美元里最该被追问的是7亿美元收入

AI视频公司Higgsfield完成4亿美元B轮融资,估值8个月内从13亿美元跳到54亿美元,公司同时自报年化收入7亿美元,但这一数字来自公司公告,未见第三方核实。放在Runway、Pika等同行的估值坐标里看,Higgsfield的涨幅明显跑赢行业惯常节奏,护城河也更依赖产品体验而非底层模型。

HiggsfieldAI视频生成4亿美元B轮融资