人工智能资讯 第51页

聚合当前分类下的最新内容,按时间顺序查看第 51 页精选文章。

42.3%对43.0%:SWE-1.7逼近GPT-5.5,但出题打分的是Cognition自己
人工智能 2026/7/9

42.3%对43.0%:SWE-1.7逼近GPT-5.5,但出题打分的是Cognition自己

Cognition发布新一代编程模型SWE-1.7,在自建的FrontierCode等基准上以更低成本逼近GPT-5.5、Opus 4.8的分数,训练细节里熵坍缩治理、跨三大洲分布式RL、self-compaction这些工程手法是实打实的增量信息。但支撑'打破post-training天花板'这一说法的评测体系由Cognition自建自评,竞品版本号也待核实,结论目前只能算一家之言。

SWE-1.7Cognition编程模型
无人车自己报警:Waymo从「被烧车」变身「举报者」
人工智能 2026/7/9

无人车自己报警:Waymo从「被烧车」变身「举报者」

两名加州青少年在Waymo车内饮酒、用涂黑玩具枪飞车射击,车辆自动停车拨打911,警方到场将两人控制。这起治安小事背后,是robotaxi从过去两年屡遭纵火割胎的“受害者”,悄悄变成主动监控并举报乘客的角色反转,而多数乘客对车内实时视频调取权限几乎一无所知。

Waymo无人驾驶出租车自动报警
Prime Intellect融10亿估值:企业自建AI,换了个依赖对象
人工智能 2026/7/9

Prime Intellect融10亿估值:企业自建AI,换了个依赖对象

Prime Intellect完成1.3亿美元A轮融资,估值10亿美元,年化收入已达1亿美元,靠的是给企业提供训练AI agent的全套基础设施。但仔细看Ramp、Zapier的案例和竞争格局就会发现,企业摆脱OpenAI、Anthropic的代价,是把依赖换成了Prime Intellect这套更复杂的新中间层。

Prime IntellectAI agent强化学习
追平vLLM原生速度,HuggingFace的“免费”有几道门槛
人工智能 2026/7/9

追平vLLM原生速度,HuggingFace的“免费”有几道门槛

Hugging Face宣布vLLM的transformers建模后端在Qwen3三种规模场景下追平甚至反超vLLM原生实现,靠的是运行时层融合技术。但这份“免费提速”只覆盖标准attention和规范代码,linear attention架构和非Qwen系模型的效果尚未被独立验证。

vLLMHugging Facetransformers
单摄像头打败多传感器?Mistral给机器人导航甩出76.6%成绩单
人工智能 2026/7/9

单摄像头打败多传感器?Mistral给机器人导航甩出76.6%成绩单

Mistral AI发布8B参数的Robostral Navigate,单靠一枚RGB摄像头、不用深度传感器和LiDAR就能听懂自然语言指令带机器人导航,在R2R-CE unseen基准上跑出76.6%成功率。官方给出的66.9%单摄像头基线和72.1%多传感器基线,让这次'领先'第一次有了可核验的量化坐标,但目前所有数字都来自Mistral自报,真实世界的碰撞率和第三方复现仍是空白。

Robostral NavigateMistral AI机器人导航
ChatGPT传单席卷全球,都柏林酒吧、奥克兰场馆已经明令禁止
人工智能 2026/7/8

ChatGPT传单席卷全球,都柏林酒吧、奥克兰场馆已经明令禁止

404 Media记者发现,从洛杉矶冲浪课传单到都柏林酒吧海报,ChatGPT生成的宣传物料正以统一视觉模板泛滥线上线下,都柏林Thomas House Bar和奥克兰一家场馆已明文禁止张贴AI传单。这场反弹的实质,是消费者赖以判断商家可信度的“用心程度”信号,正在被廉价复制到失灵。

ChatGPTAI生成传单生成式AI
新泽西这条法案没提LiDAR一个字,特斯拉却喊着被针对
人工智能 2026/7/8

新泽西这条法案没提LiDAR一个字,特斯拉却喊着被针对

新泽西一项自动驾驶法案要求全自动驾驶车配备摄像头加两种独立传感模态,条文里根本没出现LiDAR字样,但特斯拉已在官方游说页面把它定性为让自己“无法合法运营”的针对性立法。真正的悬念不是有没有激光雷达,而是这行模糊条款最终会不会给纯视觉方案留出合规空间。

自动驾驶特斯拉LiDAR
GeoSQL自称提升4倍,实测样本只有3个案例
人工智能 2026/7/8

GeoSQL自称提升4倍,实测样本只有3个案例

开源项目GeoSQL让Claude、Codex等agent学会写空间SQL并靠看地图纠错,官方称因此获得4倍性能提升,但支撑这个数字的评测集只有3个案例、8项断言,尚无第三方复现。放进CRS错配、几何有效性这些已知的空间数据老问题和CARTO等商业竞品的格局里看,它更像一次工程巧思的自证,而非成熟结论。

GeoSQL地理空间分析Agent
110亿估值背后:SambaNova融资曲线为何比英特尔报价快7倍
人工智能 2026/7/8

110亿估值背后:SambaNova融资曲线为何比英特尔报价快7倍

AI芯片公司SambaNova以110亿美元估值完成10亿美元Series F首轮融资,摩根大通同时宣布采用其SN40L和SN50系统做本地推理。这轮估值距英特尔去年12月约16亿美元的收购报价仅过去七个月,涨幅近7倍,而SN50的性能宣传至今没有独立跑分支撑。

SambaNovaAI芯片融资
经济学人用AI给自己打分:准确率不差,但裁判是自己
人工智能 2026/7/8

经济学人用AI给自己打分:准确率不差,但裁判是自己

《经济学人》用GPT-5.5给本世纪7000篇社论打分,从中挑出约1400条可证伪预测,结论是立场适度的预测最准。但这套打分方法从样本到提示词全由自己一手操办,外界至今找不到任何独立复核。

经济学人GPT-5.5AI评分
SQLite小工具「退休」背后:一次由AI主笔、149.25美元完成的核心库重写
人工智能 2026/7/8

SQLite小工具「退休」背后:一次由AI主笔、149.25美元完成的核心库重写

开发者Simon Willison发布sqlite-migrate 0.2,宣布这个库正式“退休”,只留一个对接sqlite-utils 4.0的兼容壳。真正的信息量藏在两周前:sqlite-utils 4.0rc2的大部分代码由AI agent Claude Fable完成,花费约149.25美元,一个独立维护的基础设施库已经在生产环境里让AI主笔核心功能。

AI代码生成Claude Fablesqlite-utils
OpenAI、谷歌、Adobe都亮出了水印文件,Meta的Muse Image没有
人工智能 2026/7/8

OpenAI、谷歌、Adobe都亮出了水印文件,Meta的Muse Image没有

Meta旗下Superintelligence Labs推出免费AI图像生成工具Muse Image,接入Meta AI、Instagram Stories和WhatsApp,主打广告制作和Marketplace商品展示等商用场景。但对比OpenAI、Google、Adobe、Midjourney都已公开的水印与版权条款,Meta目前找不到对应的官方文件,这对它力推的商用场景是个尚未解决的隐患。

MetaMuse ImageAI图像生成
Meta新模型让你被@就能出现在别人的AI照片里
人工智能 2026/7/8

Meta新模型让你被@就能出现在别人的AI照片里

Meta于7月7日发布Muse Image图像模型,用户在提示词里@一个Instagram账号,就能让对方的公开照片被抓取、拼进AI生成的画面。功能已经很顺手,但谁授权、谁能发现自己被用、谁来追责,Meta的公开条款里目前找不到答案。

MetaMuse ImageAI图像生成
微软没有甩开OpenAI,它只是不想再替人分账
人工智能 2026/7/8

微软没有甩开OpenAI,它只是不想再替人分账

微软开始让自研MAI模型接管Excel、Word里部分原本调用OpenAI和Anthropic的请求,但同期它仍在把Anthropic模型塞进新产品线。真正驱动这场降本的,是今年4月微软与OpenAI重签的合同——取消收入分成,换来自己更敢用自研模型的底气。

微软OpenAIMAI模型
开源模型抢下三成token,Anthropic为何还能拿走过半支出
人工智能 2026/7/8

开源模型抢下三成token,Anthropic为何还能拿走过半支出

Vercel和OpenRouter最新数据显示,DeepSeek等开源模型正快速抢占token处理量,但Anthropic仍拿下平台过半支出,份额几乎没跌。官方价目表和第三方平台均价之间存在明显对不上的量级差异,说明'前沿负责发现、开源负责生产'的两阶段共存说法,眼下更像叙事先行,数据还没追上。

开源模型AnthropicDeepSeek
Fireflies曾用真人假装AI记笔记,现在这类工具想记你的病历
人工智能 2026/7/8

Fireflies曾用真人假装AI记笔记,现在这类工具想记你的病历

一位科技博主拒绝了物理治疗师用AI记录病历的请求,理由是「你不介意吧」这种问法本身带着社交胁迫。往深处查一圈会发现,更麻烦的不是礼貌,而是Otter、Fireflies这类工具在医疗合规上的真实缺口,以及Fireflies创始人承认早期产品其实是真人假装AI。

AI笔记工具医疗合规Fireflies
82M参数、千元训练成本:Kokoro把本地语音合成的门槛砸到了地板
人工智能 2026/7/8

82M参数、千元训练成本:Kokoro把本地语音合成的门槛砸到了地板

开源TTS模型Kokoro只有82M参数,却能在12年前的老CPU上几秒内合成出高质量语音,GPU可以完全留给本地大模型。它的秘密不在算力堆叠,而在训练成本和架构选择上的精打细算,但语音覆盖、部署细节和横向定位都比表面印象要复杂。

Kokoro开源TTS模型语音合成
澳大利亚支付枢纽AP+全员上ChatGPT,效率数字却只有一家在说
人工智能 2026/7/8

澳大利亚支付枢纽AP+全员上ChatGPT,效率数字却只有一家在说

OpenAI发布客户案例,称管理eftpos、BPAY、NPP的澳大利亚支付基础设施运营商AP+已全公司部署ChatGPT Enterprise并引入Codex,对账排查、产品原型等场景大幅提速。但案例里的所有效率数字目前只有OpenAI一方陈述,没有独立信源、监管表态或AP+官方文件佐证,安全团队的AI应用也仍停留在探索阶段。

ChatGPT EnterpriseOpenAIAustralian Payments Plus
Figma收购Bud团队,两款产品7月18日关闭
人工智能 2026/7/8

Figma收购Bud团队,两款产品7月18日关闭

Figma收购YC背景的AI编程团队Bud(原Orchids),但Bud和Orchids两款产品将于7月18日关闭,用户须自行迁移项目。这笔交易接续了Figma从Figma Make到接入Codex、Claude Code、自建agent的路线,重点是原型生成和自动化,不是正面进入代码编辑器市场。Orchids此前被曝存在安全漏洞,这笔交易也把这笔旧账一并接了过来。

FigmaBudAI编程
Claude Cowork官宣登陆手机端,真正的证据却在企业客户手里
人工智能 2026/7/8

Claude Cowork官宣登陆手机端,真正的证据却在企业客户手里

Anthropic官宣Claude Cowork登陆手机和网页端,但能证明它已正式可用的官方材料,来自一场面向企业客户PayPal的webinar页面,而非消费者发布通稿。这暴露出Cowork的真实发力点更像企业治理和计费,移动端上线只是补齐门面。

Claude CoworkAnthropicAI Agent
27/30,查无实据:Ilya给Carmack的“书单”是怎么传成真的
人工智能 2026/7/8

27/30,查无实据:Ilya给Carmack的“书单”是怎么传成真的

30papers.com自称收录了Ilya Sutskever给John Carmack的传闻阅读清单,只凑齐27篇,公开向公众征集剩下3篇;检索不到任何一手证据证明这份清单真实存在,它更像开发者社区多年拼凑出的都市传说,而非可信的私藏书单。

Ilya SutskeverJohn Carmack30papers.com