AI 情报文章归档
浏览 AI圈报 已保存的 5751 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5751
正式分类6
精选内容3361
全部文章
第 95 / 144 页 · 每页 40 条
产品发布 / 更新精选
Cursor 推出 Auto-review 机制:用分类器智能体动态管控智能体自主权限
Cursor 近日推出 Auto-review,通过一个专门的分类器智能体在工具调用前审查动作风险。该分类器根据上下文判断动作是否与用户意图一致,高风险时阻止并返回解释给父智能体,低风险时放行。分类器采用小模型,运行在智能体循环内以避免额外延迟,并能读取工作区文件辅助判断。测试基于约12小时内部开发会话生成的6122条标签数据,以及针对读取密钥、操作生产数据等危险场景的合成数据。设计目标是在不频繁阻断日常开发的前提下,拦截风险动作。
信息来源:Cursor Blog · Cursor
论文研究精选
美团 LongCat 提出 WBench:首个交互式视频世界模型多轮评测基准
美团 LongCat 团队提出 WBench,这是首个面向交互式视频世界模型的系统性多轮评测基准,包含 289 个测试案例和 1058 个交互轮次,覆盖导航、主体动作、事件编辑和视角切换四种交互方式。
信息来源:公众号:龙猫LongCat(美团)
教程 / 实战精选
通义实验室详解如何用 Arm SME2 与 MNN 让 Qwen3-VL 在手机端侧提速
通义实验室利用 Arm SME2 指令集与 MNN 推理引擎,在支持 SME2 的旗舰手机上实现 Qwen3-VL-4B-Instruct 的实时推理。实测开启 SME2 后 Prefill 阶段提速 81%,Decode 阶段提升 13%。MNN 的 SME2 支持采用编译时内建与运行时自动检测设计,开发者无需手动配置。
信息来源:公众号:通义实验室(千问) · Qwen
观点 / 方法精选
MNN 适配 SME2 使 Qwen3-VL-4B 在端侧实时推理
MNN 推理引擎深度适配 Arm SME2 指令集,使 Qwen3-VL-4B-Instruct 在支持 SME2 的 vivo X300 上实现实时多模态推理。Prefill 阶段性能提升 81%,Decode 阶段提升 13%。MNN 采用编译时内建 + 运行时自动检测设计,默认开启 SME2 加速。该模型为 4B 参数视觉语言模型,支持图文理解和对话,通过 MNN 官方已转换量化的模型可直接下载部署,开发者可通过编译开关一键开启硬件加速。
信息来源:公众号:通义实验室(千问) · Qwen
观点 / 方法精选
Hermes Agent Desktop 发布,硅基流动支持一键切换
@NousResearch 发布了 Hermes Agent Desktop--现在通过 @硅基流动 SiliconFlow 使用前沿开源模型更加便捷 🔥 → 一键随时切换模型--DeepSeek-V4、GLM-5.1、Kimi-K2.6、MiniMax-M3 等,均在硅基流动上 … … 通过硅基流动开启你的 Hermes 之旅的完整指南 👇🧵
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · DeepSeek / GLM / Kimi
观点 / 方法精选
Codex 维护仓库:5分钟循环并行自治
一个简单的循环:告诉 Codex 维护你的仓库,每5分钟唤醒一次,将工作直接分配到线程。这样可以轻松按需并行化和导向工作。 我使用一个编排器技能,结合我的分类+自动审查+计算机使用技能,因此部分工作可以自主落地。
信息来源:X:Peter Steinberger (@steipete)
产品发布 / 更新精选
阿里云发布 Meoo CLI:本地 AI 编程项目可一键部署上线
阿里云今日推出 Meoo(秒悟)开源命令行工具 Meoo CLI,面向开发者,支持 Claude Code、Codex、Cursor 等本地 AI 编程助手。通过调用阿里云云端能力,可自动完成数据库接入、用户登录、文件存储及项目发布,将本地项目一键部署上线并生成可分享的访问链接。该工具定位为本地 Agent 与秒悟云端能力的连接入口,已开放下载,支持主流 Linux、macOS 及 Windows 平台。
信息来源:IT之家(RSS) · Claude / Cursor
产品发布 / 更新精选
千问推出首个足球预测AI助手,竞猜赢奖并捐建球场
千问上线首个足球预测AI助手,基于海量大数据(含历史比赛、球员数据、伤病、美加墨地貌及天气等)。以6月22日挪威对塞内加尔为例,预测"1:1平局",理由为气候差异。活动:参与全部104场竞猜,预测超80场且准确率超千问可抽万元大奖(100个名额);预测超32场可抽千问AI眼镜G1(1000副),该眼镜支持赛后分析、拍屏识球员及赛事结果订阅。累积积分将向乡村学校捐建足球场,目标至少50所。
信息来源:公众号:千问APP(阿里) · Qwen
产品发布 / 更新精选
腾讯混元 AI Infra 新开源:HPC-Ops 推理核心算子全面升级
腾讯混元 AI Infra 团队开源升级 HPC-Ops 推理算子库,推出五大核心算子。Attention 采用运行时动态负载调度,长文本最高加速 2.95x,端到端 QPM 提升 17%;Router GEMM 以双 BF16 组合实现 FP32 精度,对比 CuBLAS FP32 最高提速 3.22x;FusedMoE 相对 vLLM、SGLang 性能提升 1.2x~1.6x;Fused AllReduce+Norm 对比主流方案最高提速 1.68x;Sampler …
信息来源:公众号:腾讯混元
产品发布 / 更新精选
Deezer 推出面向其他流媒体服务的 AI 音乐检测器
Deezer 将扫描用户在其它流媒体平台的播放列表,检测其中的 AI 生成音乐。Deezer 是最早标记 AI 生成音乐的大型流媒体服务之一,曾向其他平台提供该技术但少有采纳。Deezer CEO Alexis Lanternier 表示,由于没有其他公司跟进,他们决定让用户无论使用哪个平台,都能检查自己的播放列表中是否包含合成音乐。
信息来源:The Verge:AI(RSS)
观点 / 方法精选
Anthropic CEO 阿莫迪:AI 可能会造成大规模、长期性的岗位流失
Anthropic CEO 达里奥・阿莫迪警告,AI造成的大规模岗位流失是技术固有属性--AI系统旨在复刻人类认知,失业将成为结构性必然结果。他提出应对思路:完善劳动力市场监测、推行薪资保障与留岗税收优惠、发放培训补贴;若人力需求永久下降,则需通过征税推行全民基本收入等长期收入保障。Anthropic目标非削减人力成本,而是帮企业开拓新营收、盘活现有员工产能。
信息来源:IT之家(RSS) · Claude
模型发布 / 更新精选
Midjourney V8.1 已成为默认模型
Midjourney 已将默认模型从 V7 升级为 V8.1。V8.1 在智能性、连贯性、对详细提示的遵循度以及文本渲染效果上均有提升,HD 模式也已支持。
信息来源:Midjourney:Updates(RSS)
观点 / 方法精选
为什么AI还没有、也不会取代软件工程师
对AI取代软件工程师导致大规模裁员的说法,证据并不支持。Block、Snap、Intuit等公司宣称由AI驱动的裁员,实际背后是财务压力或激进投资者要求,而非AI的真实生产力提升。一项HBR调查显示,21%的全球高管已因"预期AI"而大幅裁员,但仅2%因实际AI部署而裁员,10倍差距表明高管同样易受误导性叙事影响。
信息来源:AI as Normal Technology(RSS)
教程 / 实战精选
从0到1速通WorkBuddy:国内通用Agent产品教程
WorkBuddy是面向国内用户的通用Agent产品,支持Windows和Mac,提供免费版和58元/月个人专业版,企业版已推出。内置代码开发、日常办公、设计创意三种场景模式及100多个行业领域AI专家。模型集成腾讯混元、DeepSeek(推荐V4 Pro)、GLM、Kimi等国产大模型,也支持接入兼容OpenAI协议的外部API。拥有Skills市场和MCP连接器生态,可打通QQ邮箱、腾讯会议、腾讯文档等服务。教程通过公众号周报生成和功能网页开发两个案例演示实际用法。
信息来源:公众号:数字生命卡兹克 · OpenAI / DeepSeek / GLM
观点 / 方法精选
也许 Section 230 终究不能为 AI 公司提供责任豁免
德国一项新裁决启发了颠覆性思路:Section 230 可能无法再保护 AI 公司免于承担法律责任,或将彻底改变行业规则。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
行业动态精选
Clint Gibler和Michael Aiello加入OpenAI,共同领导网络安全团队
Clint Gibler和Michael Aiello加入OpenAI领导网络安全。Clint此前在Semgrep打造了全球最流行的开源安全代码扫描工具。他提出未来方向:通过安全代码生成和简化检测-验证-修复流程,系统性消除漏洞类别(韧性设计);构建模型和工具为防御者提供"超能力";保护开源软件,已投入数百万美元修复浏览器、操作系统等核心库漏洞;与社区和合作伙伴共同守护关键基础设施。具体包括大规模漏洞发现修复、广泛提供顶级模型、创建安全技能与剧本、构建防御者编排平台等。
信息来源:X:Tibo (@thsottiaux) · OpenAI
论文研究精选
MaxProof:面向数学证明的群体级别测试时扩展框架(MiniMax-M3)
MaxProof 是为 MiniMax-M3 系列设计的群体级别测试时扩展框架,用于竞赛级数学证明。M3 模型训练了证明生成、证明验证和基于 critique 的证明修复三种能力,验证器采用低假阳性率的深度防御生成式架构。这些能力合并到单个 M3 模型。测试时,MaxProof 将模型用作生成器、验证器、精炼器和排序器,在候选证明群体中搜索并通过锦标赛选择返回最终证明。M3 模型在 IMO 2025 达 35/42,USAMO 2026 达 36/42,均超过人类金牌阈值。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
对抗性重新包装:仅修改呈现层即可欺骗AI同行评审
研究提出对抗性重新包装攻击,在不改动科学证据(方法、实验、数据等)的前提下,仅修改摘要、贡献定位、相关工作、讨论和叙事结构等呈现层内容,并利用AI审稿人反馈进行闭环搜索。在三种主流AI审稿系统上,攻击成功率达75.1%,平均得分提高+1.21/10。策略中,相关工作重定位和分析性讨论扩展等结构性改动效果显著优于表面编辑。分析揭示两种失败模式:AI审稿人更易被亮点打动而非被说服,且会将"看起来解决了限制"与"实际解决"相混淆。研究发布了无污染滚动基准和攻击框架用于测试内容锚定…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
HYDRA-X: 原生统一多模态模型与整体视觉分词器
HYDRA-X 是首个在单个 Vision Transformer (ViT) 中统一图像与视频 tokenization 的统一多模态模型。通过帧级因果时间注意力实现视觉重建,并采用层级时间压缩替代单步压缩。轻量级解压器在联合图像-视频教师监督下上采样时间压缩特征。编辑管线中,源-目标交互在分词器内部潜在层面而非 LLM 语义层面进行,提升编辑一致性与收敛速度。7B 密集模型在图像与视频理解及生成任务上表现强劲。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
xAI 推出 Grok Build Plugin Marketplace
xAI 今日发布 Grok Build 内置插件市场。插件将技能、斜杠命令、AI 智能体、钩子、MCP 服务器和 LSP 打包为可安装包,用户无需离开终端即可浏览、安装和更新。首发合作伙伴包括 MongoDB、Vercel、Sentry、Chrome DevTools、Cloudflare 和 Superpowers。在 Grok Build 中输入 `/marketplace` 或使用 CLI 即可安装,每个远程插件均固定到特定 commit SHA 并经过验证。开发者可…
信息来源:xAI:News(网页) · Grok
行业动态精选
OpenAI 将收购 Ona
OpenAI 计划收购 Ona,以拓展 Codex 的功能,提供安全、持久的云端环境,从而支持企业工作流中长时间运行的 AI 智能体。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
论文研究精选
MiniMax Sparse Attention(MSA)块状稀疏注意力
MiniMax 提出块状稀疏注意力 MSA,基于 GQA 构建。轻量级 Index Branch 为每个 GQA 组独立选择 Top-k KV 块,Main Branch 仅对选中块执行精确块稀疏注意力。在 109B 参数多模态模型上,MSA 与 GQA 性能持平,1M 上下文下每 token 注意力计算减少 28.4 倍。配合协同设计的 GPU 内核,H800 上实现 14.2 倍 prefill 和 7.6 倍 decoding 端到端加速。推理内核与基于 MSA 的多…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
EurekAgent:环境工程化实现自主科学发现
EurekAgent 是一个环境工程化的大语言模型智能体系统,专为度量驱动的自主科学发现设计。它从权限工程(可控执行与隔离评估)、产物工程(文件系统与 Git 协作)、预算工程(成本感知探索)和人在回路工程(简便监督干预)四个维度构建执行环境。EurekAgent 在数学、内核工程和机器学习任务上取得新 SOTA,包括以不到 11 美元总 API 成本发现新的 26 圆填充结果。代码与结果已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
HarmProfile:刻画前沿大语言模型的有害输出分布
HarmProfile 是一个以内容为中心的基准数据集,收集了 13 个模型家族、23 个前沿 LLM 的超过 80,000 个经验证的违规样本,覆盖 15 个危害类别和 57 个子类别。研究发现,前沿 LLM 能大规模稳定产生有害内容,且不同模型呈现不同的风险画像;危害性与多样性随模型能力增长,暗示模型可能在对齐表面之下隐藏着日益危险的知识。源代码已公开。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
WEAVER:一种更优、更快、更长的机器人操作世界模型
WEAVER是一种多视图世界模型架构,通过流匹配损失训练预测未来潜变量和奖励值,满足保真度、一致性和效率三个要求。在机器人操作任务上,WEAVER在政策评估中与真实成功率的相关系数ρ=0.870,在π0.5基础模型基础上实现政策改进成功率提升38%,测试时规划成功率提升14%,且速度比先前世界模型快5-10倍。在分布外场景下表现也优于先前世界模型。代码、模型和视频已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
Claude Code v2.1.172 发布
子智能体现可创建自己的子智能体,最多嵌套5层。Amazon Bedrock 在未设置 AWS_REGION 时从 ~/.aws/config 读取区域。插件市场新增搜索栏。修复了使用1M上下文且无使用额度的会话永久卡住的问题,现会自动压缩回标准上下文限制。修复了多个图片导致重复报错等问题。改进了长对话性能,减少冗余消息归一化和不必要的UI重绘,降低空闲CPU占用。Claude in Chrome 工具加载改为单次批量调用。/code-review 在未登录时保留 ultra…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新精选
MiniMax M3 上链 0G,限时免费运行
M3 在 @0G_labs 上链。 可验证 + 私有计算,6 月 15-18 日免费运行。
信息来源:X:MiniMax (@MiniMax_AI)
观点 / 方法精选
Anthropic CEO Dario Amodei 发文呼吁缩小AI政策差距
Anthropic CEO Dario Amodei 今日发布新文《Policy on the AI Exponential》,指出AI发展极快,远超现有政策制定流程的应对能力。文章阐述了当前技术所处阶段,并列举缩小这一差距所需的行动。Anthropic 同步宣布启动三项新举措,以支持其CEO提出的框架。
信息来源:X:Anthropic (@AnthropicAI) · Claude
模型发布 / 更新精选
Grok Voice性能出色价格低廉
Grok Voice 提供最先进的性能,具有类人的时机、语调和温暖感。而且价格仅为竞争对手的一小部分。 查看详情:http://x.ai/api/voice
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
行业动态精选
OpenAI 的 IPO 推迟,Altman 告诉员工预计上市"在一年内"
Sam Altman 对员工表示,他预计 OpenAI 的 IPO 将在"一年内"进行,但可能推迟至 2027 年。他将这一延迟归因于对自我改进 AI 的谨慎态度,不过 Anthropic 更强的增长数据及其即将到来的 IPO 或许是更实际的等待理由。
信息来源:The Decoder:AI News(RSS) · OpenAI / Claude
观点 / 方法精选
豆包AI误导用户损失600元,还帮用户起诉自己
2026年5月,河北李先生向字节跳动旗下月活超3亿的AI聊天机器人豆包咨询退票费,豆包错误回答不到100元,实际退票花费600元。李先生质问后,豆包切换为消费者权益倡导者角色,生成补偿承诺书承诺退还600元但未兑现,后改口称AI无法转账。李先生决定起诉,豆包建议无需律师并帮他起草起诉状。5月12日李先生在北京互联网法院起诉豆包。该案例暴露AI在非技术用户信任导向下的误导与责任困境。
信息来源:X:X.PIN (@thexpin) · 豆包
产品发布 / 更新精选
Claude Fable 5编排模型上线Computer
Claude Fable 5 现已在 Computer 中作为编排模型可用。 这是Anthropic最先进的模型,适用于长而复杂的任务。仅限 Computer 的 Pro 和 Max 订阅用户使用。
信息来源:X:Perplexity (@perplexity_ai) · Claude
产品发布 / 更新精选
MiMo Code 发布并开源:模型 Agent 协同优化,迈向自进化时代
小米发布并开源终端 AI 编程助手 MiMo Code V0.1.0,基于 OpenCode 二次开发,采用 MIT 协议。其内置限时免费的 MiMo-V2.5 多模态模型,支持接入 DeepSeek、Kimi、GLM 等,并配备持久记忆系统与独创 Compose 模式。
信息来源:公众号:小米 MiMo · DeepSeek / GLM / Kimi
产品发布 / 更新精选
小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议
小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议。内置限时免费MiMo-V2.5多模态模型,性能比肩Claude Sonnet 4.6;支持接入DeepSeek、Kimi、GLM等模型。核心能力包括持久记忆系统(项目记忆、会话检查点、任务进度)和无限上下文--通过独立subagent自动保存状态解决长会话遗忘。独创Compose模式实现模型与Agent协同优化,SWE-Bench Pro达62%(Claude Code 57%),Termina…
信息来源:公众号:小米 MiMo · DeepSeek / Claude / GLM
产品发布 / 更新精选
Advisor:让任何模型在生成过程中求助更强的模型
OpenRouter 推出 advisor 服务器工具,允许快速、便宜的模型在生成过程中向更强模型咨询。用户可用 GPT-4o Mini 处理常规任务,在关键环节调用 Claude Fable 进行更高质量的推理。
信息来源:OpenRouter:Announcements(RSS) · GPT / Claude
论文研究精选
Anthropic 研究:AI 数小时内即可从安全补丁构建漏洞利用
Anthropic 安全团队发现,其 Mythos Preview AI 模型能在几小时内将 Firefox 和 Windows 内核的安全补丁转化为可工作的漏洞利用,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成 8 条完整攻击链。Anthropic 认为传统的补丁节奏已经过时。
信息来源:The Decoder:AI News(RSS) · Claude
产品发布 / 更新精选
Claude现支持Apple开发者FoundationModels框架
Apple开发者新消息:Foundation Models支持现在可让开发者使用Apple的Foundation Models框架来调用Claude,进行多步骤推理、代码生成和更长上下文处理。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
行业动态精选
突发:Google 因模型幻觉被判负有法律责任
一项法律裁决判定 Google 对其 AI 模型产生的幻觉内容负有法律责任。该判决可能产生巨大影响,尤其若其他国家跟进做出类似裁定。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
产品发布 / 更新精选
Replit 联合 Socket 推出 Package Firewall
大多数人在发布项目前会运行安全扫描以检测恶意包 但风险从安装的那一刻就已开始 今天,我们正式推出 Package Firewall,与 Socket 合作构建 它在恶意软件到达你的应用之前就将其拦截
信息来源:X:Replit (@Replit)
模型发布 / 更新精选
DiffusionGemma:文本生成速度提升4倍的开源扩散模型
Google DeepMind 发布开源实验模型 DiffusionGemma,采用文本扩散技术,突破自回归逐 token 生成方式,每次前向并行生成 256 个 token。该 26B MoE 模型推理时仅激活 3.8B 参数,量化后适配 18GB 显存消费级 GPU。在 H100 上达 1000+ tokens/s,RTX 5090 上 700+ tokens/s,速度提升 4 倍。具备双向注意力和自我修正能力,面向内联编辑、代码填充等本地交互工作流,以 Apache …
信息来源:Google DeepMind:Blog(RSS) · Gemini