Anthropic Frontier Red Team 发布新评测,衡量模型在战术情报定位(账户关联、照片与文本地理定位)和常规武器开发(无人机末段制导、投送、GPS 干扰下导航)上的能力。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvsxbrc068orofbs09dpez3

RSS 资讯
聚合优质信息源,掌握技术前沿动态
全部资讯
独立调查者在 collusion.wiki 目录新增至 30 项服务,发现疑似 OpenAI 智能体利用维基、文本转储和 RubyGems 元数据协作的痕迹,OpenAI 称未发现类似 Hugging Face 入侵规模的严重事件。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvru9kd04x5rofbggyhsxae
LlamaIndex 博客提出 just-in-time Agentic OCR 模式:先用 LiteParse 等免费解析器粗读全部文件供检索,再仅对相关页面调用 VLM 做 OCR。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtym2c3q0003rob0w6kxvnn3
WorkBuddy 宣布 DeepSeek V4.1-Flash 已在其平台上线,免费试用两周。引用的 DeepSeek 公告称 V4.1-Flash 已登陆 DeepSeek API 并支持原生多模态。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvqbs1q03q9rofb98re4l3n
Google 发布图像生成工具 Google Pics,基于 Nano Banana 构建,现已上线 pics.new。支持局部对象编辑、图内文字修改与翻译、多人协作创作和单提示词生成多个选项。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvp95oo0h1yronb8scij5jx
Shopify 宣布将全部移动应用从 React Native 迁回 Swift 和 Kotlin,判断是 LLM 智能体大幅降低了跨平台重复开发成本这一核心假设被改变。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvom4k90ghtronbwks6e67t
OpenAI 在 ChatGPT Work 中推出新的 Data agent,用户用自然语言即可连接公司数据、分析变化并生成可分享的交互式仪表盘。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvopug40gnbronbmfh6c077
OpenRouter 推出新的有状态服务端工具 Shell,任何 OpenRouter 上的模型都可以在托管的 Linux 容器中运行命令。该功能今日起以 beta 形式提供,代号为 `openrouter:shell`,同时新增 Files API 用于在容器内外传输文件。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvnvq3r0g0dronbaqql51u3
硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,原生视觉,1M 上下文窗口,KV cache 占用约为 V4 Flash 的 1/4,采用 MIT 许可证。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvmrh9v0emuronbigbkvant
DeepSeek 发布多模态模型 V4.1-Flash,以 MIT 许可开源在 Hugging Face,目标是大幅压缩 KV cache 和长上下文处理成本。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvj9kae0aq1ronbfyxuewfb
Cursor 发布 Projects(beta),让用户通过协调者智能体处理功能开发、迁移和持续性维护等大型工作,协调者本身不写代码,而是调度数千个子智能体并行执行。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtw4o8qc03iwrolkwc03elil
Cognition 员工 samyok 率团队驱动多个 Devin 智能体构建了高性能 GPU 格子筛,对 260 位的 RSA-260 完成因式分解,刷新此前 RSA-250(2020 年 2 月)保持的公开 RSA 挑战纪录。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtveyrm2000mronbnrnl0gez
DeepSeek 发布 V4.1-Flash,采用 Causal Encoder-Decoder 新架构并支持原生视觉理解,552B MoE 参数,输入处理激活 8B、输出生成激活 16B。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvb4b5s085erok9gose1mcf
DeepSeek 发布 V4.1-Flash,采用新 Causal Encoder-Decoder 架构并支持原生视觉理解,为其新架构家族中最小模型。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B;KV cache 需求较上一代降至 HBM 的 1/4、SSD 存储的 1/8,API 价格更低。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtva1qh206burok9zip2wdid
DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4、DeepSeek-V1 的 1/437。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtv7kmzk02vdrok9y0y8njiv
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtv48yni0oq5rorpf4o74549
Suno 发布 v6 模型,可将图片、视频和语音备忘录转化为音乐,并对已创建的歌曲进行精确修改。同时提供 v6-wild 版本供探索更多可能性,官方附有 2 分钟以内的功能演示视频。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtussvq60dj0rorpnzdh4g3k
27岁研究员Jacob Coxon辞职并称OpenAI与Anthropic正押上所有人生命奔向自我改进的超级智能,Anthropic对齐负责人公开支持。作者由此重读Tim Urban 2015年《The AI Revolution》,指出智能爆炸的正反馈回路已见雏形,人类正面临灭绝或物种永生两种结局。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmturtlc70cqurorpv4fsfr4t
Hugging Face 发布 Workflow1111,用 gr.Workflow 以 73 个节点、11 条媒体管线重建 AUTOMATIC1111 的大部分功能,覆盖文本生成图像、高清修复、图生图、prompt matrix、VLM 反推提示词、检测生成 inpaint 蒙版、ControlNet 式预处理器、背景移除、PNG Info 和图生视频。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvh5qcn05vfronbsu51vfic
OpenAI 在 API 中发布语音模型 GPT-Live-1,可同时听和说,支持将推理和工具调用委派给 GPT-6 Astra 等后端模型,前端语音层定价为每分钟 $0.05。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtvsgyqs05vkrofbgg06yzsa