RSS 资讯

RSS 资讯

聚合优质信息源,掌握技术前沿动态

40友链
5分组
1RSS

AI HOT — AI 行业动态聚合 · 每日精选与 AI 日报

重置筛选
noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
Liquid AI 发布 LFM2.5 系列 QAD Q4_0 量化检查点,恢复 97% 精度损失

Liquid AI 发布基于量化感知蒸馏(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点,在保持原生 Q4_0 内存与速度的同时,恢复 BF16 平均精度损失的 97%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt05zhyg139trodp6bxsy9e2

noreply@aihot.virxact.com (公众号:智谱(GLM))
noreply@aihot.virxact.com (公众号:智谱(GLM))
GLM-5.3上线:AA智能指数60分并列开源第一,成本更低

GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmszeb2mx0b3srodpef1ub0j0

noreply@aihot.virxact.com (OpenRouter:Announcements(RSS))
noreply@aihot.virxact.com (OpenRouter:Announcements(RSS))
OpenRouter 宣布加入 Stripe

OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt0d2tsl1961rodpnvzxo4cc

noreply@aihot.virxact.com (xAI:News(网页))
noreply@aihot.virxact.com (xAI:News(网页))
Grok Build 全面上线网页与移动端,所有套餐可用

Grok Build 现已面向所有套餐开放,支持网页、iOS 和 Android 端使用。用户描述应用、游戏或网站后,Grok 可在聊天中实时生成可运行版本。该功能自 7 月推出 Early Beta 以来,新增了发布分享、接入 X 及调用 Grok 自身模型等能力,发布的应用可获得 grok.me 链接并支持自定义域名、导出到 GitHub 等。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1xbu7q0b7troovffggr2jh

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
Mojo 语言正式开源,编译器与工具链全面开放

Mojo🔥 语言现已正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链。目前暂不接受编译器相关贡献,计划年底前开放,标准库自 2024 年起已接受社区贡献。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsz79zol04j8rodpvun6zobl

noreply@aihot.virxact.com (X:Claude (@claudeai))
noreply@aihot.virxact.com (X:Claude (@claudeai))
Claude 现已支持 Gmail 邮件与 Google Drive 文件管理

Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。 让 Claude 回复某个邮件线程,它会起草并发送回复。你可以控制何时需要你的批准。 从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用。所有付费套餐均可用。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsz49ptt022qrodp5mc1nt1x

noreply@aihot.virxact.com (X:OpenAI (@OpenAI))
noreply@aihot.virxact.com (X:OpenAI (@OpenAI))
OpenAI 暂停前沿模型 RL 训练以强化安全

OpenAI 因模型能力增强带来的内部开发与测试风险上升,暂停了最新部署模型的强化学习(RL)训练两周,以加固研究环境、扩大红队测试与监控覆盖。其最大规模的前沿 RL 训练仍处于暂停状态,需通过小规模训练和评估验证安全措施并积累对齐证据。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsyzrlqd04xhro20xbr0dgud

noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准

智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsz1974l06hbro20gosn5d78

noreply@aihot.virxact.com (X:Jakub Pachocki(OpenAI 首席科学家,@merettm))
noreply@aihot.virxact.com (X:Jakub Pachocki(OpenAI 首席科学家,@merettm))
OpenAI 暂缓前沿训练强化安全监控

OpenAI 首席科学家 Jakub Pachocki 表示,公司已暂时放缓部分前沿模型训练以强化安全与监控,最大规模的前沿 RL 训练仍处于搁置状态,同时通过小规模训练和评估测试安全措施并收集对齐证据。他认为安全信心将日益决定 AI 发展节奏,并已签署《Pacing the Frontier》倡议,呼吁实验室和国家间加强协调。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsz0lmmt05nfro2062bd0ztz

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法

LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt0e7sxo01eiro2o4l4y9jmh

noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
OpenAI 在"关键网络能力"时代放缓模型开发节奏

OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsz0hbsg05l0ro204080cotv

noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护

OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsykcnkt0yh1roz0a9h404r5

noreply@aihot.virxact.com (Google AI:DEV 作者专属(RSS))
noreply@aihot.virxact.com (Google AI:DEV 作者专属(RSS))
设计 AI 评测:先求清晰,再谈可视化

本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsycmgww0rkrroz0nfma0z05

noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
StartupBench:面向市场验证端到端工作流的通用智能体基准测试

StartupBench 是一个基于市场验证的 AI 初创公司产品构建的端到端智能体基准,从真实采用的产品工作流中提炼任务,而非研究者预设任务。在统一智能体框架下,最强模型也仅能完成约 30% 的任务,复杂指令遵循和领域专业知识是主要失败来源。该基准揭示了当前通用智能体在真实用户任务上的能力边界。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmszieman0euzrodptihyllom

noreply@aihot.virxact.com (公众号:数字生命卡兹克)
noreply@aihot.virxact.com (公众号:数字生命卡兹克)
一个实用的深度思考Prompt:用"双向钢人论证"让AI帮你挖出最本质的答案

作者基于Reddit上"让Claude真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,并自创了一个"双向钢人Prompt"。该Prompt通过重述真实问题、强化正反双方观点、找出关键变量、逼AI给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。作者以自己选择公司司庆日的真实案例演示了使用效果。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsxwd7a40coxroz06g25sfaf

noreply@aihot.virxact.com (Google Developers Blog(RSS))
noreply@aihot.virxact.com (Google Developers Blog(RSS))
用 Google 的 Agent Development Kit 构建零信任 AI 智能体

Google 开源了基于 ADK 和 Gemini 的零信任客服与退货智能体示例,演示如何防御提示注入等攻击。该架构在 LLM 上下文之外通过三层硬性安全机制保障:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。系统提示词只是软约束,无法作为安全边界。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsxv0p3v0bntroz0227a6b3j

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
Cursor 推出 Origin 代码托管服务,作为 GitHub 的替代方案

Cursor 今日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。Vercel、Depot 和 Buildkite 集成已可用,智能体功能即将推出。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsxsvb5s0a4troz0z2q2nu3h

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
404 Media 追踪珍本图书流向:亚马逊批量购书扫描用于 AI 训练后销毁

404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊未公开的购书行动:批量购入大量书籍,扫描用于 AI 训练数据,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsxld6es03o8roz0jblf3ii9

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
如何禁用或避免侵入式 AI:一份覆盖 Windows、Chrome、Edge、Firefox 及主流应用的实用指南

一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsxkakju0300roz0zx6cvdeu

加载更多资讯