人工智能资讯 第4页

聚合当前分类下的最新内容,按时间顺序查看第 4 页精选文章。

谷歌给Gemini拆了三块牌子,拆出来的其实是订阅墙
人工智能 2026/8/27

谷歌给Gemini拆了三块牌子,拆出来的其实是订阅墙

Google给Gemini语音功能又添了品牌名,Chat、Spark、Daily Brief各占一块地盘,用户得先猜该用哪个;但真正值得留意的不是命名混乱,而是Daily Brief背后跨源数据推断、留存不可撤回的隐私协议,以及Spark绑Pro、Daily Brief绑Plus的订阅分层——品牌拆分,更像是给付费墙找了个体面的名字。

GeminiGoogleDaily Brief
Google喊出'最精确'转录模型,自己的跑分表先不买账
人工智能 2026/8/27

Google喊出'最精确'转录模型,自己的跑分表先不买账

Google发布Gemini 3.5 Transcribe并称其为'最精确'语音转文本模型,但引用的同一家跑分机构显示ElevenLabs Scribe v2在流式和非流式上都更准;官方博客与技术文档在说话人识别人数上还自相矛盾,免费层与付费层的隐私政策差异也被原文一笔带过。

Gemini 3.5 TranscribeGoogle DeepMind语音转文本
普通ChatGPT辅导:练习分猛涨48%,独立考试却跌17%
人工智能 2026/8/27

普通ChatGPT辅导:练习分猛涨48%,独立考试却跌17%

OpenAI新报告称每周有数亿条课业相关对话,但这些数字与该公司另一份官方报告口径不一致。更关键的是,学术界的随机对照试验发现,普通ChatGPT能让学生练习时表现暴涨,却让独立考试成绩下滑,只有专门设计引导式提示的版本才能避免这种假进步。

ChatGPTOpenAI人工智能教育
30万教师免费用上ChatGPT,OpenAI瞄准的是学区的采购流程
人工智能 2026/8/27

30万教师免费用上ChatGPT,OpenAI瞄准的是学区的采购流程

OpenAI把ChatGPT for Teachers扩大到55个学区、20个州,新增超10万名教职员工,累计覆盖100多个K-12机构、30个州、30万教师,免费用到2028年6月。16州统一了数据隐私协议,但这不等于自动合规,学生也没有直接使用权限。真正该盯的是免费期满后怎么收费,谁先定义了学校用AI的标准。

OpenAIChatGPT for Teachers教育人工智能
Google转录AI能自动删“嗯啊”,但准确率至今是个谜
人工智能 2026/8/27

Google转录AI能自动删“嗯啊”,但准确率至今是个谜

Google为Gemini 3.5系列新增专用转录模型,Smart模式能自动清理“嗯”“啊”等填充词并重组语序,但官方文档没有公布任何准确率数字,还承认这一模式无法和说话人分离、词级时间戳同时开启。转录稿变好读了,逐字可验证性却打了折扣,这是原文标题完全没提到的代价。

GoogleGemini 3.5AI语音转录
对冲基金买单的播客AI情报,连自己都不敢担保准确率
人工智能 2026/8/27

对冲基金买单的播客AI情报,连自己都不敢担保准确率

Particle推出播客搜索引擎Radar,转录超13万档播客并开放给AI代理调用,对冲基金已是最大付费群体。但公司自身条款承认内容抓取可能未获授权、从未公布转录准确率,却把产品卖给最看重数据精度的金融客户。

ParticleRadar播客搜索引擎
百万小时视频训出机器人大脑,工厂凭什么敢用?
人工智能 2026/8/27

百万小时视频训出机器人大脑,工厂凭什么敢用?

两位前Meta FAIR科学家创办的Perceptron发布开放权重工业视觉模型Isaac 0.5,称能让机器人统一完成感知、推理、行动,训练靠100万小时通用视频加第一视角、UMI和机器人轨迹数据。公司自称定位卡在通用基础模型与单任务模型之间,但没给基准测试、推理成本和硬件门槛。开放权重值得肯定,可离产线验证还差一整套证据。

Isaac 0.5工业机器人具身智能
单卡训14.5小时碾压所有检索模型?这笔账没那么好算
人工智能 2026/8/27

单卡训14.5小时碾压所有检索模型?这笔账没那么好算

Sentence Transformers v6.0 新增 MultiVectorEncoder,作者称单卡 RTX 3090 训练 14.5 小时的医疗检索模型碾压了所有通用检索器。但评测所用 MIRIAD 数据集词汇重叠偏高,且模型训成后仍需额外的索引基础设施才能部署——训练降本不等于检索系统降本。

多向量检索MultiVectorEncoderSentence Transformers v6.0
Z.ai认领Ox Alpha,「吊打Claude」的传言先破了功
人工智能 2026/8/26

Z.ai认领Ox Alpha,「吊打Claude」的传言先破了功

身份揭晓当天,Z.ai承认Ox Alpha就是GLM-5.3-Flash的一次stealth投放,但社交媒体传的「10个任务80%胜率吊打Claude/GPT」被113个任务的独立测试证伪,免费预览通道也同步归零。真正的看点不是猜身份,是这套先炒作再收割的打法有多熟练。

Z.aiGLM-5.3-FlashOx Alpha
比尔·盖茨再提“机器人税”:AI 替人之后,谁来支付账单
人工智能 2026/8/26

比尔·盖茨再提“机器人税”:AI 替人之后,谁来支付账单

比尔·盖茨主张用“机器人税”缓冲自动化冲击,并为部分任务设置“人类保留”边界。方向值得肯定,但税向谁收、岗位如何划、成本由谁承担,才是决定政策成败的硬问题。

机器人税比尔·盖茨AI替代劳动力
GLM-5.3-Flash:标题像模型,正文却在讲太阳系
人工智能 2026/8/26

GLM-5.3-Flash:标题像模型,正文却在讲太阳系

一个页面把“GLM-5.3-Flash”写在标题里,正文却偏离到太阳系,模型是否真实发布、参数和跑分是否可信,目前都不能仅凭页面确认。真正值得警惕的是信息抓取链路失真:开发者、采购团队和 AI 搜索工具都可能把错配内容当成模型资料。

GLM-5.3-Flashz.aiAI模型
一枚AirTag,拆穿了亚马逊的拆书流水线
人工智能 2026/8/26

一枚AirTag,拆穿了亚马逊的拆书流水线

404 Media用一枚AirTag追踪一批近千本书的订单,查到亚马逊在拉斯维加斯的仓库正批量切除书脊、扫描并销毁纸质书用于AI训练。亚马逊官方回应只说'购买书籍改进产品',刻意回避了训练用途、规模和被剔除书籍的下落。仓库员工的说法显示,这条链路管理混乱,书籍来源也远比'稀有书'复杂。

亚马逊AI训练书籍数字化
Arga Labs融资千万美元,但AI代理训练沙盒早已挤满对手
人工智能 2026/8/26

Arga Labs融资千万美元,但AI代理训练沙盒早已挤满对手

Arga Labs为企业软件做数字孪生训练环境,拿到千万美元种子轮,General Catalyst领投。但这个赛道已经有六七家公司在做几乎同样的事,而Arga自己的合规认证、增长数据和产品描述都还留着待验证的口子。

AI代理Arga Labs数字孪生训练环境
QueryStory脱隐首日:卖信任的公司,唯一客户是自己投资人
人工智能 2026/8/26

QueryStory脱隐首日:卖信任的公司,唯一客户是自己投资人

企业AI分析平台QueryStory宣布脱离隐身,主打SQL透明化和置信度指标来解决AI幻觉问题,种子轮估值6000万美元。但公开可查的唯一客户就是自己的投资人,置信度指标也未经统计校准,这家卖'信任'的公司自己的可信证据链条相当单薄。

QueryStory企业AI分析平台AI幻觉
号称训练成本降1/9,Qwen3.8-Flash-Next预演的是Qwen4怎么省钱
人工智能 2026/8/26

号称训练成本降1/9,Qwen3.8-Flash-Next预演的是Qwen4怎么省钱

阿里开源Qwen3.8-Flash-Next,125B参数每token只激活6B,官方称训练成本约为Qwen3.7-Plus的1/9,借此预演Qwen4新架构。GDN管记忆、QSA管检索、51B嵌入管低成本扩容,想把长上下文从参数竞赛变成能落地的推理账。但API价格尚未开放,7.6倍到8.6倍的加速数字都来自厂商材料和特定场景,离真正兑现还差一步。

Qwen3.8-Flash-Next阿里混合专家模型(MoE)
IBM Granite 4.2:不比模型强,比部署稳
人工智能 2026/8/26

IBM Granite 4.2:不比模型强,比部署稳

IBM发布Granite 4.2开放权重模型,3B/8B/30B三档统一支持128K原生上下文;但只有8B、30B接受了专门的智能体强化训练,3B的工具调用能力打了折扣。IBM这次没打算刷榜,赌的是企业要的可控成本和数据自主,只是许可证细节和实测数据仍是空白。

Granite 4.2IBM本地部署
盖茨罕见认怂:这次他不确定创新能兜底
人工智能 2026/8/26

盖茨罕见认怂:这次他不确定创新能兜底

比尔·盖茨发布近六千字长文并密集接受多家媒体采访,首次以本人名义系统警告AI风险,提出机器人税、人类保留岗位等具体政策;但他最耸动的判断——大规模永久失业、坏结果迫在眉睫——目前更接近政策修辞,独立学术评估的证据支撑并没有跟上。

比尔·盖茨人工智能风险AI失业
智谱认领Ox Alpha:登榜之后,开源权重才是真考题
人工智能 2026/8/26

智谱认领Ox Alpha:登榜之后,开源权重才是真考题

彭博社8月26日报道,智谱旗下Z.ai确认匿名登上使用榜单的Ox Alpha是新一代GLM模型,并称当晚放出权重。免费好用不等于开源权重、许可证、部署成本都已经过关。开发者能否复现效果、企业能否拿到商用授权,得等权重和文档真正落地再看。

Ox Alpha智谱GLM
编程终结论重燃:厂商说效率涨50%,独立研究说反而慢19%
人工智能 2026/8/26

编程终结论重燃:厂商说效率涨50%,独立研究说反而慢19%

一条Mastodon吐槽帖怼上Hacker News热帖“编程终结论”,但真正值得看的不是谁嘴硬,而是双方都没拿出的数据:厂商晒出效率暴涨的漂亮数字,METR等独立研究却发现资深开发者用AI反而更慢。两套证据都真实,却指向两个完全不同的现实。

AI编程编程智能体开发者生产力
六级RAG架构清单:多数团队只需要第一级
人工智能 2026/8/26

六级RAG架构清单:多数团队只需要第一级

多数RAG系统一上来就奔向embedding和向量数据库,但Lighthouse Newsletter给出的六级分级框架说明,BM25加查询重写能覆盖大部分场景,真正决定该往哪一级走的是语料变动率和查询量,不是团队想不想显得先进。文章补全了原文没讲完的三级重型架构,也暴露了这套经验之谈缺第三方验证的短板。

RAG六级RAG架构BM25
AI写了100万行代码,却被Rust自己的漏洞打了脸
人工智能 2026/8/26

AI写了100万行代码,却被Rust自己的漏洞打了脸

Paul Dix那句被疯转的'AI写了100万行可靠代码',说的其实是Bun把核心实现从Zig迁移到Rust的一次具体工程,靠的是旧代码做参照、64个AI代理并行、6万+测试和11轮审查兜底。但重写完成后,Rust版本里被曝出一处unsafe导致的悬垂引用漏洞,直接打脸了'换语言=更安全'的核心卖点。

AI代码生成BunRust