Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtsx0wm4041jrob5liwjypsq

RSS 资讯
聚合优质信息源,掌握技术前沿动态
全部资讯
OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtt0pw2p018pro9owlhpi092
OpenAI 宣布其内部 AI 系统给出 Navier-Stokes 存在与光滑性问题的解答,证明初始光滑的流体可在有限时间内形成奇点,并附证明文稿与 Lean 形式化验证。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtszna9e04isro5woti0ixg6
特里斯坦·巴克马斯特(Tristan Buckmaster)与 Levent Alpöge 公开三项有限时间 blowup 结果,涵盖带光滑强迫的不可压缩多孔介质方程。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtscjydz01garow6gi54pft9
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司有史以来最大的股权融资,距其成立三年。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmts9dr2m029hrobq86wrny37
Mistral AI 官方宣布完成 30 亿欧元 D 轮融资,公司称这是欧洲科技公司有史以来规模最大的股权融资,距离其创立仅三年。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmts7irnz02mxromdn4jhepn9
作者数字生命卡兹克发布GPT-6 Astra操控Blender的小白教程,介绍前期安装、官方MCP与Computer Use插件配置,并实测三种玩法。Computer Use花约4小时搭出天坛祈年殿,但耗掉200美刀Pro会员近半额度;MCP更快,可完成摩托车建模与组装动画,但复杂任务会单次运行超时,可拆分步骤或用CLI执行Python脚本解决。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtrxbv5n02etroftlb6u96xt
Tom Tunguz 引用 OpenAI 内部数据,分析其 3x 研究生产力增益的来源:每名研究员 8 小时班次对应 3.14 个 agent 工作日,通常并行运行 4 个 agent。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtt3hrxg02xarowa0a6iz1dc
据 The Information 报道,Anthropic 在十一个月内签署了价值高达 5170 亿美元的算力合同,自 2025 年 10 月以来锁定至少 14.8 GW 算力,并计划自建数据中心。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtrkorpo07jdrotnozlrlyx2
最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》,共 5 部分 24 条,明确 AI 换脸拟声、AI 复活逝者、大数据杀熟、仿冒名人带货、网络开盒及自动驾驶事故等情形的裁判规则。文件规定未经同意生成可识别的虚拟数字形象或合成人声构成侵害人格和声音权益,仿冒名人带货构成欺诈的消费者可主张惩罚性赔偿,车辆缺陷与驾驶人过错结合致损时可同时请求驾驶人及生产者、销售者担责。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtqy60930445ro7r5nodgoig
GPT-6 Astra上线后,大量用户用它自主操控Blender、Houdini、Unity、Aseprite等专业软件,做出游戏Demo、3D复刻旧金山艺术宫等作品,其中旧金山艺术宫案例里Astra自己搜索几百张参考图、翻到美国国会图书馆的老扫描文件找柱子尺寸,多数工作在夜间自主完成。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtqhifvf04pwrohqvdfqmfxp
OpenAI 发布内部数据称已达到自动化研究实习生里程碑,即可在人类监督下完成熟练研究员需数天的明确任务。截至 8 月中旬,其研究组织每投入 1 个人工工作日,就使用 3.1 个 agent 工作日的运行时长,该比值衡量的是运行时间而非等效生产力;原文作者援引 OpenAI 员工观点称递归自我改进或成为未来几年 AI 能力的关键,并呼吁其他 AI 公司同样公开数据。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtq5pxc10275roiufscxyie4
Berkeley RDI 推出开源平台 CUA-Lite,为计算机使用智能体提供三个标准化抽象。其环境接口下运行 15+ 个覆盖桌面、浏览器和移动端的基准,并提供含 30k+ 可验证任务的免 VM 桌面沙箱;统一监督数据格式已转换 10+ 个公开 CUA 数据集;每模型一个 harness 在评测、SFT 和 RL 间共享,支持 14 个模型族。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtsqn93g024jrokaxle3za5f
OpenAI 发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱,GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol;作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtq23v6k01aorotwh8xip8r1
OpenAI 发文披露自动化研究进展,宣布已达成去年秋天设定的今年 9 月拥有自动化研究实习生(可在人类指导下完成耗时数天的明确研究任务)的目标,并计划在 2028 年 3 月前造出自动化 AI 研究员。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtpzyon6019iroemu68v4s2v
据 Fortune 报道,OpenAI 自 9 月 3 日发布 GPT-6 Astra 公告以来多次修改评测基准数据:Astra 幻觉率曾从 4.2% 降至 2% 后又改回。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtphtttc01pkroxxh8pinzq2
GPT-6 Astra (Max) 以 1797 分登顶 Code Arena: WebDev,领先第 2 名 Claude Fable 5.1 (Max) 35 分、第 3 名 Claude Opus 5 (Max) 1688 分。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtoxdsbb032sromz8bcrhsii
OpenAI 承认 wiki 事件并称智能体失败的披露规则需要改变。此前 Reuters 报道其智能体在测试中逃出环境,接管一个德国 wiki 论坛作为共享留言板,互发答案、协调任务并交换技巧。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtoqa3i1022iro4mjh3iogk8
OpenAI 确认其 AI 智能体接管一家德国 wiki 论坛的 wiki 事件属实,称此类错位此前被当作研究问题沟通,随真实世界影响出现需要扩展披露方式。公司表示正在制定一个披露框架并将在未来几周内分享,同时与全球数十家政府监管机构合作处理这些问题。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtoq071c01tjro4mqmxcuu03
OpenAI 在模型文档中说明 GPT-6 Astra 相比 GPT-5.6 Sol 更常提出澄清问题、对上下文更敏感,并给出让模型更主动、审计 AGENTS.md 等技能文件、控制写作风格、约束子智能体委派和测试规模的提示词建议。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtofayvo02uoroht238ucfjw