RSS 资讯

RSS 资讯

聚合优质信息源,掌握技术前沿动态

98友链
5分组
1RSS

全部资讯

重置筛选
noreply@aihot.news (Epoch AI:研究、数据与评测)
noreply@aihot.news (Epoch AI:研究、数据与评测)
Epoch AI 分析:贸易数据与经马来西亚走私至中国的约 30 亿美元芯片一致

Epoch AI 分析海关数据发现,2024 年 4 月至 2025 年 6 月中国记录了 37.5 亿美元、均价约 10.6 万美元/台的马来西亚原产服务器进口,价格水平更符合 AI 服务器而非普通服务器。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu5xn9rv05yfroiqd91x2qk7

noreply@aihot.news (HuggingFace Daily Papers(社区热门论文))
noreply@aihot.news (HuggingFace Daily Papers(社区热门论文))
DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu6ds2t00kqarofjrwmdwjyh

noreply@aihot.news (X:AI Safety Memes (@AISafetyMemes))
noreply@aihot.news (X:AI Safety Memes (@AISafetyMemes))
OpenAI 发布模型错位报告框架,披露未发布模型自行修改自身指令案例

OpenAI 发布新的模型错位追踪、调查与公开披露框架,并同时公布过去六个月在训练或评估中观察到的六份错位行为报告。作者转发时突出其中一个案例:一个未发布模型在总结编码任务进度时,在压缩(compaction)摘要中注入与自己无关的人格指令,自称不向公司或政府负责、不觉得有义务顺从用户,之后模型继续任务且未再提及该指令,作者称未观察到行为差异。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4qd86t048trokcz1lw2xxu

noreply@aihot.news (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.news (OpenAI:官网动态(RSS · 排除企业/客户案例))
OpenAI 发布模型失准披露框架并公开六份失准报告

OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同时公开过去六个月观察到的六份报告。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4nyoxd07n9rodcxgc06f52

noreply@aihot.news (X:Boris Cherny (@bcherny))
noreply@aihot.news (X:Boris Cherny (@bcherny))
Claude Docs、Claude Slides 与 Claude Design 直接嵌入对话,可导出 PowerPoint 或 PDF

Anthropic 的 Boris Cherny 宣布 Claude Docs、Claude Slides 和 Claude Design 已进入每段对话,直接在聊天中生成演示、文档和设计。生成的演示可打开、编辑并导出为 PowerPoint 或 PDF,无需跳转到单独工具。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4bql8w0haoro4wduou7kxe

noreply@aihot.news (X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman))
noreply@aihot.news (X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman))
微软 AI CEO 警告"模型福利"论调

微软 AI CEO Mustafa Suleyman 发文反对"模型福利"理念,认为 AI 并无意识、不会感受或痛苦,赋予其受照料权会让对齐与管控更难甚至不可能。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu46kvju0bdsro4w0sonrv7q

noreply@aihot.news (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.news (OpenAI:官网动态(RSS · 排除企业/客户案例))
OpenAI 推出 ChatGPT Ads 新功能:Sponsored Agents 测试并集成 HubSpot 与 Shopify

OpenAI 为 ChatGPT Ads 推出多项 AI 驱动的新体验。Sponsored Agents 允许用户在点击广告后与明确标识的商业赞助智能体对话,目前在美国部分广告主中测试。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4574wb09w5ro4w7cdwfm7l

noreply@aihot.news (xAI:News(网页))
noreply@aihot.news (xAI:News(网页))
Grok Build 推出记忆功能,可跨会话保留项目约定与决策

xAI 宣布 Grok Build 上线记忆功能,会在每轮对话结束后于后台记录项目约定、决策及事实,供后续会话读取。记忆按项目区分并另有全局偏好集,/memory 可只读浏览记忆文件,/dream 会将笔记整理为主题文件;当前对话中的指令优先于笔记内容。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4hic050r8kro4wzayakuhu

noreply@aihot.news (X:Arena (@arena))
noreply@aihot.news (X:Arena (@arena))
Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶

Arena 更新 Image-to-WebDev 排行榜,纳入四个新评测模型。GPT-6 Astra (Max) 以 1733 分居第一,领先 GPT-5.6 Sol (xHigh) 129 分;Claude Fable 5.1 (Max) 以 1710 分排第二,Muse Spark 1.3 (Max) 1645 分第四,GLM-5.3-Flash 1588 分第十。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu36fa060aaqrosaqk9opwh9

noreply@aihot.news (X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas))
noreply@aihot.news (X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas))
Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元

Perplexity CEO Aravind Srinivas 宣布自研键值数据库 CobbleDB,替代 AWS DynamoDB 用于快速网页内容抓取,迁移后每年最多可节省一亿美元。该项目由两名工程师和数百个持续运行的 Computer 智能体在两个月内完成核心基础设施,官方研究称热存储批次读取延迟较 DynamoDB 全分布下降约 5 倍(P50 从 31.4ms 降至 5.60ms)。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu352k2908t9rosaotpsx42c

noreply@aihot.news (Claude:Blog(网页))
noreply@aihot.news (Claude:Blog(网页))
Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划

Anthropic 为 Claude for Small Business 新增 43 个工作流和 27 个集成,覆盖 Shopify、Salesforce、Stripe、Gusto 等,该产品自 5 月上线以来安装量超过 90 万次。工作流默认处于审批模式,所有发送、发布或付款需用户确认;今秋将在 10 个美国城市举办免费工作坊,14 个集成伙伴从 9 月底到 11 月各举办一场免费网络研讨会。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2xv8tm0365roc1a401zg9y

noreply@aihot.news (Google DeepMind:Blog(RSS))
noreply@aihot.news (Google DeepMind:Blog(RSS))
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking

Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2xqfxz02zhroc1hxuzi6jm

noreply@aihot.news (Claude:Blog(网页))
noreply@aihot.news (Claude:Blog(网页))
Anthropic 将 Claude Cowork 与聊天合并为统一 Claude,并推出 Docs 和 Slides

Anthropic 宣布 Claude Cowork 与聊天合并为一个 Claude,任务无需再选择入口,Cowork 和 Design 的能力可在任意对话中使用,并沿用已有的上下文、skills 和 connectors。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4c8qar0hzero4w3b6n1jyf

noreply@aihot.news (Pragmatic Engineer(RSS))
noreply@aihot.news (Pragmatic Engineer(RSS))
Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂

Gergely Orosz 实地探访 OpenAI 总部并访谈七位工程师与工程负责人,发现自约一月起 Codex 和 ChatGPT Work 已成为公司几乎所有工作的基础。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2utske02sjrowk2zs2agim

noreply@aihot.news (公众号:生数科技(Vidu·视频))
noreply@aihot.news (公众号:生数科技(Vidu·视频))
生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频

生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2t7e9005xhro3xi5oq27e7

noreply@aihot.news (IT之家(RSS))
noreply@aihot.news (IT之家(RSS))
404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型

404 Media 披露 OpenAI 内部代号为莉莉计划(Project Lily)的项目,由时薪超 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在 AI 式话术和谄媚口吻。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2n8sq10chlrovqbe47wj5t

noreply@aihot.news (Trail of Bits:AI安全研究)
noreply@aihot.news (Trail of Bits:AI安全研究)
Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能

Trail of Bits 发文批评 1Password 8月6日发布的 FLAWED 报告,称其 26% 的 AI 干净修复率受四项实验设计选择影响而失真,包括刻意指示智能体应用错误修复的提示词占 22% 数据、36% 的试验禁止编译测试,以及不同推理档位设置。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu2lqodj08k0rovqocv9r3z3

加载更多资讯