最新科技资讯 第57页
聚合 AI、科技、商业、硬件与开发工具的最新内容,按时间顺序查看第 57 页精选文章。

OpenAI宣称提速14倍的"Ultrafast",官方文档却查无此模型
TechCrunch报道称OpenAI推出"Ultrafast"模式,让GPT-5.6 Sol提速14倍、每秒吐750个token,意在争夺企业客户;但截至发稿,OpenAI官方模型列表、定价页和开发者文档均查无这一模型和模式的记录。这不代表报道有假,但提醒读者:媒体首发和官方确认之间,有时候隔着一段说不清的时间差。

GPT-5.6开发指南的真正重点:AI Agent省钱要靠模型路由
GPT-5.6开发指南把重点放在模型选择与Responses API,而非单纯宣传更强模型。真正影响AI Agent成本的,是团队能否按任务分配模型,并把重试、工具调用和人工复核计入总账;在缺少公开价格与测试配置时,“降价25倍”并不成立。

机器人割草机说“终于好用了”,官方说明书却先划了三条免责线
The Verge今夏实测的五款机器人割草机导航明显进步,但仍有毁草坪、断电线、挖沙坑的翻车记录;更该关注的是各厂商说明书里早已写明的树冠覆盖率、信号盲区等使用门槛,这些限制比“今年终于好用了”的体验式结论更能决定你家草坪能不能复现这套体验。

美国政府把网络反击权,部分交给私企
特朗普政府批准新计划:司法部、国土安全部监督私营网络安全公司,代表联邦政府监视、破坏境外犯罪网络。企业须证明技术资质,缴纳至少100万美元保证金,且只能针对不受外国政府指挥的犯罪团伙——但这条边界现实中很难核实。执行主体从政府变成商业公司,控制权仍留在DOJ和DHS手里,误判的代价却要企业自己扛。

Anthropic测试多AI协作:会配合,也会争地盘
Anthropic让多个AI代理处理同一项任务,研究人员观察到冲突、串通和意外协调。研究尚不能证明“模型越强,内斗越凶”,但它点出了一个现实缺口:单体安全测评,很难覆盖多个代理相互影响后的系统风险。

750 tokens/秒的"新纪录",官方渠道却查无此文
Cerebras与OpenAI联合博客称GPT-5.6 Sol在Ultrafast模式下跑到每秒750个token,还晒出详尽跑分和具名引语,读起来像标准产品通稿。但核查后发现,文中反复出现的几个模型代号都查无出处,测试日期还标着尚未到来的2026年,唯一线索指向一个未经验证的聚合网站。技术路径本身可信,不代表这次具体发布就是真的。

他在诉状里悄悄给AI留了张纸条
康涅狄格州一起诉讼里,原告用3磅白字在诉状中藏了操纵AI的指令,结果被人工审查发现,法官为此写了14页裁决。这起案子靠人眼截获,却顺手暴露了法律AI行业至今没人能公开证明自己能防住这类攻击。

机器人训练的'省钱闭环',HF和AWS只讲了架构没给数字
Hugging Face与AWS联合发文,展示用Strands Robots、LeRobot格式和刚上线5个月的Storage Buckets搭建机器人录制-训练-部署闭环,宣称能靠字节级去重和流式训练省成本。但全文及公开检索均未给出具体的省流量或省钱数字,这更像是一次新存储产品的场景化示范,而非经过验证的生产方案。

Gemini 3.7 Flash半价来袭:百万token上下文,官方只敢秀12.8万的成绩单
Google DeepMind在3.6 Flash发布仅三周后推出Gemini 3.7 Flash,代码与智能体跑分全线上涨,首发价砍半至0.75/3.75美元每百万token。但官方大力宣传的百万token上下文,长上下文基准测试却只公布到12.8万token这一档,半价窗口也明确写明只到2026年底。

机器人吸尘器学会了「指哪打哪」,但别急着信
Matic为旗下机器人吸尘器上线手势+语音清洁功能Cues,宣传语是「指哪扫哪」,但实测显示这只是摄像头估算出的近似区域,精度受光照、距离、遮挡明显影响;其「本地处理」隐私卖点也仍停留在厂商自述阶段,没有第三方验证。

OpenAI九个月再换首席营收官:Dali Rajic接棒,企业变现成为硬任务
OpenAI任命Wiz前总裁兼首席运营官Dali Rajic为首席营收官,接替任职不足9个月的Denise Dresser。此次换帅更像是OpenAI将重心从模型和用户扩张转向企业部署与营收执行,也折射出潜在IPO筹备期的组织压力;但公司尚未公开完整营收数据,上市时间也没有定论。

「无聊技术」十年后:三枚创新代币还够用吗
Dan McKinley在2015年提出的「三枚创新代币」理论——公司应把技术冒险配额控制在三次以内——十年来成了硅谷工程文化的常识,但这套框架本身经历过悄然改写,Monzo银行的反例也证明它并非放之四海皆准。真正的问题不是无聊技术对不对,而是谁有资格判断自己不属于例外。

Mistral OCR 4.1上线,官方发布页自己先打了架
Mistral在文档站悄悄上线了OCR 4.1,新增段落级边界框、结构标签和置信度评分,单页文档同时出现两个发布日期、两种货币计价方式,模型ID能否直接调用也说不清楚。比起功能本身,这种发布信息的碎片化更值得企业采购方警惕。

“Gemini 3.7 Flash 半价发布”尚无出处,价格翻倍结论不能成立
现有材料只有“Gemini 3.7 Flash”和“Comments”两项线索,无法核实发布时间、定价与模型能力。“半价发布、2027 年翻倍”的标题缺少官方价格表和生效日期支撑;在这些信息补齐前,开发团队不应据此迁移模型或编列预算。

GPT-5.6提速14倍,OpenAI的Ultrafast卡在容量不在速度
OpenAI联合Cerebras推出限量预览服务层Ultrafast,让GPT-5.6 Sol的输出速度最高达每秒750个token,是标准模式的14倍,先在API开放给少量客户。真正决定这套服务能不能规模化的,不是峰值速度,而是端到端延迟、价格和容量能不能撑住企业级实时场景。

WhatsApp的AI防诈骗,离“已上线”还差一个beta
Meta在WhatsApp内测一个叫Scam Alert的诈骗提醒功能,但据独立报道,它目前仍是测试版、默认关闭,只针对陌生联系人在设备本地跑模型,离标题里“已新增”的完成时还有距离。放到Google Messages、Apple Messages两个已经默认开启的同类功能旁边看,WhatsApp这次更像迟到的补课。

福特2.8万美元电动车逼近投产,低价承诺还缺一张参数表
福特计划在2027年第一季度于路易斯维尔工厂生产下一代电动车 Fathom,工厂改造投入达20亿美元,目标价格约2.8万美元。真正有分量的是工人提前参与设计与试制;真正没说清的,是续航、车型、配置和交付价格。

2K悄悄立了个足球工作室,授权这道门还没敲开
2K在领英官宣新工作室Small Axe Studios,喊出要做“下一个重磅体育系列”,配图暗示是足球游戏,但目前能查到的只是几条招聘信息和引擎选型,没有任何俱乐部或联赛授权的确认。Take-Two自己都公开说过,做足球游戏比拿一个品牌名复杂得多,这盘棋离正面对上EA Sports FC还有一段距离。

福特赌上50亿美元造皮卡,续航却只字未提
福特称路易斯维尔工厂改造进度符合预期,2027年将投产28350美元的电动皮卡Fathom,但电池容量、续航、快充速度这些核心参数至今空白。更关键的是,Model e业务盈亏平衡目标定在2029年,比Fathom上市晚两年,工厂按时完工不等于这笔生意能赚钱。

DeepSeek Harness上线,官方身份却先要打个问号
DeepSeek在deepseek.com/harness挂出“DeepSeek Harness”开发者预览,主打“一切皆插件”和可追溯session日志,但独立核查未能确认该页面与GitHub仓库确系官方所有,反而发现了同名概念的非官方仿制项目。即便产品属实,其架构主张放进LangGraph、AutoGen、OpenAI Agents SDK的坐标系里看,目前也只是意图声明,还没有生产级验证。

OpenAI换首席营收官:十亿周活之后,谁来把用户变成订单
OpenAI任命前Wiz总裁兼COO Dali Rajic为新任首席营收官,原CRO Denise Dresser交接后离任。官方给出的规模证据是10亿周活跃用户、200万家企业客户同比翻倍,但公告没有披露任何收入数据。Rajic的网络安全销售履历能否套进生成式AI采购,目前还看不清。