人工智能资讯 第6页

聚合当前分类下的最新内容,按时间顺序查看第 6 页精选文章。

AI 让技术行业心慌,别把怒气浪费在无权拍板的人身上
人工智能 2026/8/25

AI 让技术行业心慌,别把怒气浪费在无权拍板的人身上

一篇博客提醒技术从业者:面对 AI 与智能体,焦虑、好奇和试验比急着寻找替罪羊更有用。但保持好奇不等于接受一切;生产率归谁、数据由谁控制、代价由谁承担,才是决定是否抵抗的关键。

人工智能AI智能体Meta
AI教得越顺手,新手编程能力可能越练不出来
人工智能 2026/8/25

AI教得越顺手,新手编程能力可能越练不出来

独立科技博主Lars Faye在2026年7月22日的文章里,援引JetBrains的编程观察和宾夕法尼亚大学2025年的学习实验,指出新手用AI时容易把顺手误当成学会了。两份研究领域不同——JetBrains盯的是真实编程现场,宾大测的是数学学习——但都指向同一件事:跳过独立试错,专业判断力就长不出来。这对正在用AI写代码的新人和管培训的技术负责人,意味着该换一个更靠谱的验收标准。

AI编程助手编程教育新手开发者
两个月,估值从23亿跳到60亿:General Intuition的钱比证据跑得快
人工智能 2026/8/25

两个月,估值从23亿跳到60亿:General Intuition的钱比证据跑得快

TechCrunch独家报道General Intuition正洽谈60亿美元估值新一轮融资,距上轮23亿美元估值仅隔数周,但这轮融资和投资人名单目前只有单一信源,尚未获官方确认;更关键的是,公司唯一公开的技术成果MIRA,训练数据来自机器人自我对战而非其反复强调的人类游戏录像,叙事和实证之间有明显落差。

General Intuition具身智能MIRA
512GB闪存塞进HBM封装,AI芯片的内存荒真能靠它解吗
人工智能 2026/8/24

512GB闪存塞进HBM封装,AI芯片的内存荒真能靠它解吗

Hot Chips 2026上,Oxmiq Labs给出了HBF用于AI推理的第一份系统方案:单堆栈容量最高见到512GB,是HBM4的八到十一倍,但带宽只有几分之一,延迟差出上百倍。真正的门槛不在硬件,而在软件要重写整套内存管理逻辑。

HBFAI推理HBM4
OpenAI降价"GPT-5.6 Sol"?官方页面里根本没这个名字
人工智能 2026/8/24

OpenAI降价"GPT-5.6 Sol"?官方页面里根本没这个名字

网传OpenAI给GPT-5.6 Sol降价,优惠至少持续到11月21日,但被引用的官方定价页面既没有价格表,也没有Sol这个名字,页面时间戳还显示成了2026年8月。三项关键信息——旧价新价、适用范围、截止时间——目前一样都拿不到,够不上预算决策的证据。

OpenAIGPT-5.6GPT-5.6 Sol
18.9倍加速与看不见的进展:AI能力提升正在明显分化
人工智能 2026/8/24

18.9倍加速与看不见的进展:AI能力提升正在明显分化

METR最新报告显示,AI在网络安全领域已带来漏洞发现的显著加速,数学领域进展模糊难量化,AI研究本身的自我优化则完全没看到可测信号。同期出现的SPADE合成环境框架和Hawkeye硬件感知内核工具证明,真正的杠杆正转向训练环境和硬件适配这类工具层,但两者都离不开人工打底,谈不上模型自主科研。

AI能力提升METR网络安全
31%的代码问题都在问JS:AI正在替你选技术栈
人工智能 2026/8/24

31%的代码问题都在问JS:AI正在替你选技术栈

一篇开发者短文断言软件工程将收缩为“AI开发”一个方向,新语言新框架再难出头;Anthropic和GitHub的公开数据显示,这个直觉判断其实已经在发生。真正的问题不是程序员会不会失业,而是技术选型的决定权正在从工程师判断力滑向AI训练数据的历史快照。

AI编程技术栈选择大语言模型
Claude 99%可用性背后:一场把四个入口全部拖垂的认证故障
人工智能 2026/8/24

Claude 99%可用性背后:一场把四个入口全部拖垂的认证故障

Anthropic状态页显示claude.ai在6-8月可用性均在99%以上,但拆开事故记录能看到十余起故障,其中8月16日的认证系统故障让claude.ai、API、Claude Code和Cowork同时瘫痪。官方几乎不公开根因,7月的官方数字与第三方推算数字也存在明显分歧,提醒依赖Claude构建生产系统的开发者:多入口不等于真冗余。

ClaudeAnthropic服务可用性
Paul Graham劝17岁别急着创业:先学会从零训练LLM,Yann LeCun加了个但书
人工智能 2026/8/24

Paul Graham劝17岁别急着创业:先学会从零训练LLM,Yann LeCun加了个但书

Paul Graham建议17岁的自己别急着创业,先从零学会构建、训练LLM;Yann LeCun补充说,LLM能写文章却不会扫地,方向该往物理世界的学习和行动延伸;两人分歧不在该不该学AI,而在该赌哪层能力边界还有红利。

大语言模型Yann LeCunPaul Graham
Anthropic最强模型遇冷:AI市场开始按账单投票
人工智能 2026/8/24

Anthropic最强模型遇冷:AI市场开始按账单投票

报道称,Anthropic能力最强的模型没有赢得相称的用户采用,价格更低的工具反而增长更快。现有线索没有交代用户、调用量或收入等统计口径,因此不能草率判定旗舰失败;更可信的变化是,企业正从追逐模型上限,转向计算每项任务的真实成本。

Anthropic旗舰模型企业采购
一份 agent.md,把 AI 写代码的地板抬高了,天花板没动
人工智能 2026/8/24

一份 agent.md,把 AI 写代码的地板抬高了,天花板没动

Fabien Sanglard 用一份 agent.md 把反复念叨的编码规矩变成会话自动加载的清单,代码风格问题大减,审查精力转向架构设计。真正提升效率的是省掉重复提醒,不是模型自己学会写好代码,生成代码依旧要逐行核实。规则本身是他在 Rust/C++ 项目里磨出的个人偏好,换语言换团队要重新调,上下文一长还会被模型悄悄忘掉。

AI 编程agent.mdLLM
Fable够强却太贵:AI编程团队开始自己做路由
人工智能 2026/8/24

Fable够强却太贵:AI编程团队开始自己做路由

Anthropic的Fable模型强到没话说,但贵到没法全用;工程师发现Opus、GPT-5.6、GLM这些'够用'的旧模型也能扛住大部分活,于是从'等新模型变便宜'转向自己搭建模型路由体系。这标志着AI编程领域'摩尔定律式免费升级'的假设正在失效。

AI编程模型路由Fable
Anthropic 旗舰卖不动?这组数据还撑不起结论
人工智能 2026/8/24

Anthropic 旗舰卖不动?这组数据还撑不起结论

一则援引匿名信源的报道,把 Anthropic 的收入猛增和新旗舰支出占比偏低放在了一起。但模型只上线约一周,统计口径也有缺口,现在就断言“卖不动”太早。真正值得重视的是:企业采购 AI,已经从追逐最强模型转向计算单位任务成本。

AnthropicFable 5Opus 5
免费送百万token,身份却成谜:Ox Alpha的“指纹”被扒到了Z.ai头上
人工智能 2026/8/24

免费送百万token,身份却成谜:Ox Alpha的“指纹”被扒到了Z.ai头上

神秘模型Ox Alpha在OpenRouter免费上线,标榜编程和长程agent能力,却没人肯署名,Stripe CEO Collison一条“very impressive”的推文点燃全网竞猜。社区靠报错文案和参数指纹把嫌疑锁定在Z.ai未发布的GLM上,但两份第三方跑分打脸了官网自吹的80%,说明这场狂欢里最该被关注的不是身份,而是免费背后的数据留存风险。

Ox AlphaOpenRouterZ.ai
Fable比Opus贵一倍,跑分却没赢:AI编程的免费午餐结束了
人工智能 2026/8/24

Fable比Opus贵一倍,跑分却没赢:AI编程的免费午餐结束了

Anthropic的Fable上线后输出价格是Opus 5的两倍,但在SWE-bench等跑分上并未明显领先,同期发布的GLM-5.2成本只有其九分之一。这场对比逼开发者第一次认真做多模型路由,而所谓'吓退企业国家'的动态降级,拆开看其实是安全分类器路由,不是外界想的那种悄悄变笨。

AI编程FableOpus 5
Khanmigo开放200万学生,真正打开的只有一成五
人工智能 2026/8/24

Khanmigo开放200万学生,真正打开的只有一成五

Sal Khan亲口承认旗舰产品Khanmigo对多数学生是'non-event',但真实数字比这句话更刺眼:获准访问的200万学生中只有15%真正用过。Khan Academy自己披露的产品数据和一项哈佛研究却说明,问题未必出在AI辅导本身,而是Khanmigo从设计上就只让学生'接收',从没让他们'制作'。

KhanmigoAI教育Khan Academy
Claude拒绝、Kimi出手:一台$114平板引出的AI护栏罗生门
人工智能 2026/8/24

Claude拒绝、Kimi出手:一台$114平板引出的AI护栏罗生门

一位自称有安全背景的用户声称,花$266.15雇了四款AI模型接力,root了自己反复关机的Amazon Fire HD平板,用的还是三年前就被曝光的Arm Mali漏洞。故事本身没有第三方信源核实,但它撕开的护栏差异和补丁真空期,比故事真假更值得琢磨。

AI安全护栏大语言模型Claude
Anthropic赔15亿美元,但法官早说AI训练本身不违法
人工智能 2026/8/24

Anthropic赔15亿美元,但法官早说AI训练本身不违法

Anthropic版权案常被简化为“作者赢了、AI训练违法”,但判决书原文其实把训练、格式转换、盗版图书馆建设三件事分开裁定,15亿美元赔的是盗版环节,训练本身被认定合理使用。这笔钱换算下来每部作品约3100美元,案子最终批准还换了法官签字,故事远没有舆论叙事那么干脆。

AnthropicAI模型训练版权争议
Agent=Model+Harness,这套公式漏掉了最要命的三件事
人工智能 2026/8/23

Agent=Model+Harness,这套公式漏掉了最要命的三件事

EARENDIL用攀岩安全带类比讲清楚了agent harness的四大功能,但把这个正在被行业热捧的概念讲得太岁月静好。真正的问题是:harness正在让模型评测失真,也在悄悄变成没人完全看懂的第二操作系统。

Agent HarnessAI Agent模型评测
卫星追踪缝上解密UFO档案,SkyLens 自己的数字先打了架
人工智能 2026/8/23

卫星追踪缝上解密UFO档案,SkyLens 自己的数字先打了架

SkyLens 把 CelesTrak 卫星轨道、NASA/JPL 小行星数据和解密 UAP 档案拼进同一个实时3D网站,但站内对档案数量和发布批次的说法自相矛盾,还写了尚未到来的发布日期。真正该分开看的是两件事:轨道数据几十年攒下的可信度,不该被拿来给未经核实的 UAP 叙事免费背书。

SkyLensYantraAIUAP解密档案
NanoGPT竞速榜的真相:AI科研拼的是整套研究系统
人工智能 2026/8/23

NanoGPT竞速榜的真相:AI科研拼的是整套研究系统

Prime Intellect 在 NanoGPT 优化器竞速中组织了 153 次自主运行,覆盖 18 款前沿模型,Fable 5 配合 claude-code · high 取得榜单标注的最佳验证结果 2726。真正值得看的不是谁的模型“更聪明”,而是哪套模型、代理框架、推理预算和验证机制组合,能更稳定地把想法变成有效改动。

自主编程AI科研代理框架