AI 情报文章归档
浏览 AI圈报 已保存的 5805 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5805
正式分类6
精选内容3375
全部文章
第 49 / 146 页 · 每页 40 条
论文研究普通
MemUse:将长期人机对话中的记忆评估从直接问答转向自然融入
一项为期4个月、涉及40名用户和1,872次会话的部署研究发现,现有记忆基准的Direct QA准确率在7种条件下介于19.7%至70.1%之间,但与用户满意度无关。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
CAFE:自我改进的搜索智能体需要共同进化的反馈
CAFE(Coupled Agent--Feedback Evolution)提出一种共享参数模型交替扮演搜索智能体与评论家的框架,通过在线RL与离线偏好优化耦合,让反馈随策略共同进化。在七个智能体搜索基准上,CAFE平均优于所评估的基于RL的搜索智能体,在全部六个域外基准上保持收益,并减少答案级幻觉。消融实验表明,仅改进智能体或仅改进评论家最终会陷入平台期,而交替更新两者可持续提升性能。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
MoTE:面向多任务视频理解的任务专家混合解码器架构
论文提出MoTE(Mixture of Task Experts)解码器架构,将大语言模型的前馈网络转换为任务特定专家,同时共享多模态主干网络。实例化模型VideoLLM-MoTE在五个COIN基准上采用显式任务路由,五专家模型每样本激活约2B LLM参数,平均top-1准确率超过近期VideoLLM基线,并优于密集全专家激活与学习式稀疏路由。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
OPDVR:无需额外超参数的无监督策略蒸馏与可验证奖励结合方法
研究者提出 On-policy Distillation with Verifiable Reward(OPDVR),将基于可验证奖励的强化学习(RLVR)与在线策略蒸馏(OPD)无缝结合,无需引入任何额外超参数。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
Recuris:面向长时程智能体的递归经验-工作记忆演化架构
Recuris 提出递归经验-工作记忆架构,让工作记忆跟踪任务进度并引导技能选择,将执行转化为结构化证据,由固定元智能体对技能记忆进行局部验证更新,形成有界递归演化循环。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
Luce:面向3D资产生成的可重打光高斯表示
Luce提出一种将几何与PBR材质统一到体素化多模态高斯云中的3D表示,通过变分自编码器压缩至统一潜在空间,再由修正流Transformer从单张图像生成。在Toys4K上,Luce实现SOTA单图转3D生成,FID较最强基线提升28%;在AI生成图像基准上,CLIP图像对齐分数达0.8519,优于基线0.8299。Luce可生成保留文字、标志等细节的可重打光资产。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
Meta^n:通过涌现深度实现递归自我改进
Meta^n 提出一种固定元操作 Ω 并对其输入递归的自我改进方法,将元深度从约两层扩展至由收敛决定的动态深度。在两种骨干模型上,Meta^n 在全部八个基准家族上超越此前自我改进智能体,其中在 ARC-AGI-2 上唯一取得非零分数。消融实验显示,递归收益主要来自各层传递给下一层的条件,且深度增加时会涌现出不同层角色。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
当"必须"变成"也许":LLM 智能体工作流中的约束弱化
一项针对 LLM 智能体工作流的研究发现,交接转换会反复将"必须解决"的约束弱化为"仅供参考"的非约束信息。在 1,296 个受控合成场景中,正常交接压缩导致 100.0% 的约束失效和 54.2% 的违规动作;恢复全部四个状态字段可将约束保持率提升至 100.0%,违规动作降至 0.0%。下游验证虽能消除违规动作,但约束失效仍达 95.3%,表明语义可用性并不保证操作层面的状态保持。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
STARFlow2:用归一化流桥接语言模型,实现统一多模态生成
STARFlow2 提出将自回归归一化流与语言模型统一,用于多模态生成。该方法观察到自回归归一化流与 LLM 共享因果掩码、KV-cache 机制和从左到右结构,从而弥合文本与图像生成的架构差异,避免离散 token 化带来的视觉保真度损失。
信息来源:Apple Machine Learning Research(RSS)
行业动态普通
OpenAI 封禁俄罗斯虚假影响力行动账号
OpenAI 封禁了一批源自俄罗斯的账号,这些账号利用 AI 推广一个虚构的以色列智库及"主权"指数,内容赞扬俄罗斯并批评西方。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新普通
TorchMorph:CUDA 加速的形态学变换库
TorchMorph 是一个轻量级 PyTorch 扩展,提供 22 个公开算子,覆盖二值/灰度形态学、精确与近似距离变换及熵正则化最优传输,全部以融合 CUDA 内核实现,支持最多八维空间张量。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
DiffusionOPSD:扩散模型的在线策略自蒸馏框架
DiffusionOPSD 提出一种在线策略自蒸馏框架,将图像级奖励引导转化为采样查询点上干净输出预测的显式目标。在 SD 3.5-M 和 Z-Image-Turbo 上,该方法在 20 个奖励匹配设置中的 19 个取得最佳最终留出分数,相比最强竞争方法最高提升 44.0%,训练 GPU 小时数较 DiffusionNFT 分别减少 40% 和 63%。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
Gated Recurrent Transformer:用循环调制在 Transformer 中实现表达性深度
Gated Recurrent Transformer 提出一种循环深度 Transformer,以固定深度前奏与尾声块包裹单一共享核心并迭代 R 次,通过轻量投影和逐元素更新门调制循环更新。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
从看见到行动:智能眼镜如何成为第一人称智能平台
一篇系统综述首次以统一框架研究智能眼镜,将其定位为连接人类感知、持久上下文与数字或物理行动的第一人称智能平台。文章沿八项可验证硬件能力轴刻画设备,围绕七项基础能力组织文献,并提出L0-L5分级框架,涵盖采集、反应式感知、上下文辅助、持久状态、受控行动与具身耦合。综述还给出九维部署框架、基于主张的评估协议及证据阶梯,覆盖九个应用场景。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
教程 / 实战精选
GPT 5.6 折扣与杰文斯悖论:OpenRouter 数据揭示 Terra/Luna 降价如何引爆 token 用量
OpenRouter 数据显示,OpenAI 对 Terra 和 Luna 模型的大幅折扣使日均 token 用量分别飙升 5.6 倍和 13.8 倍,而未降价的 Sol 仅增长 1.1 倍。
信息来源:OpenRouter:Announcements(RSS) · OpenAI / GPT
论文研究普通
LAION-BVD:面向多模态预训练的千万小时级开放视频数据集
LAION 团队发布 LAION-BVD,一个包含 1.3B 条平台视频 URL、下载 80M 段视频、总时长 1000 万小时的大规模开放视频数据集,面向视频、音频和图像多模态预训练。基于该数据训练的模型在视频-文本和音频-文本基准上表现具竞争力,且性能随训练或模型规模提升而持续增长。数据集已向研究社区开放。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
教程 / 实战精选
OpenRouter 视频生成 API:一份代码优先的接入指南
OpenRouter 推出统一的异步视频生成 API,通过 POST /api/v1/videos 提交任务、轮询状态并下载 MP4,支持 Seedance、Veo、Wan 等模型,切换模型只需更改 model 标识符。
信息来源:OpenRouter:Announcements(RSS)
论文研究普通
The Handoff Tax:LLM 智能体延续非原生轨迹的代价
研究用 Claude 与 GPT 家族的 LC/HC 模型配对,考察编码智能体在模型间切换时"交接税"的影响。完整轨迹升级仅能弥补不到一半的 LC 到 HC 质量差距,且成本显著增加;降级切换则性价比更优。交接方向还会改变最优接口选择:减少 LC 轨迹信息可提升升级质量,而移除 HC 轨迹会降低降级质量。
信息来源:HuggingFace Daily Papers(社区热门论文) · GPT / Claude / Hugging Face
论文研究普通
WarpSAC:重新思考探索与利用,迈向可扩展离策略强化学习新高度
WarpSAC提出一套数据体制感知的离策略强化学习算法族,通过受控实验揭示参数归一化、裁剪双Q等稳定器在不同数据规模下的适用性。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
GameWAM:面向视频游戏的 World Action Model
GameWAM 首次将 World-Action Model 引入原生闭环游戏玩法与 GUI 控制,通过并行视觉与动作生成、块因果条件及流匹配,联合预测未来视觉观测与可执行的键鼠轨迹。实验显示其以更少的原生动作数达到与对比智能体相当的任务成功率,并揭示了生成式控制中低频动作源成分系统性影响相机粗粒度运动的 LASI 失效模式。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
AnTrap:Android GUI 智能体在动态对抗环境中的鲁棒性评测基准
AnTrap 基准通过向智能体执行轨迹注入动态扰动,系统评估 Android GUI 智能体对运行时异常的鲁棒性,将真实异常分为状态、思考、动作和回合四层共十个细分类别。对 16 个主流模型的评测显示所有模型均存在普遍脆弱性,最强模型也出现显著性能下降;GRPO 训练实验表明,状态死锁等深层上下文陷阱无法仅通过在含陷阱环境中训练解决。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新普通
WeMM-Embedding:微信多模态嵌入技术报告
微信发布WeMM-Embedding通用多模态嵌入模型系列,支持文本、图像、视频、视觉文档及任意交错多模态输入,提供2B、4B、9B三种参数规模。其中2B版本已在MMEB-v2上超越此前领先的8B开源基线,9B版本以80.6总分创下新SOTA。该系列已在微信视频号、公众号、朋友圈及电商等推荐与搜索场景大规模部署,模型权重与代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
RubSE:用评分规则作为视觉修复上下文实现UI到代码生成的自进化
RubSE框架通过将视觉反馈表示为结构化评分规则上下文,解决了大视觉语言模型在UI到代码生成中测试时自进化不稳定的问题。该方法每轮生成候选规则、选择优先修复目标并保留历史,引导修订聚焦于明确范围。在六个VLM和三个基准上,RubSE显著优于朴素自进化,轨迹更稳定且能缓解崩溃、提升对严重视觉回退的恢复能力。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
LAWA:用潜在动作作为意图,让世界动作模型高效想象未来
LAWA 用紧凑潜在动作表征未来意图,在不生成未来观测的情况下实现高效测试时未来想象,省去未来视频分支。在 RoboCasa 上,LAWA 在少样本和全数据设置下平均成功率分别达 65.6% 和 80.8%,比 Fast-WAM 基线高 9.6 和 4.5 个点,同时推理延迟比 Joint-WAM 低 42.9%,并在 LIBERO-Plus 和真实任务上表现稳健。代码和模型将开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法普通
Grok Bot 智能体:一句话完成视频剪辑与整理
用户仅用自然语言指令,让 Grok Bot 在几分钟内完成原本需数天的工作:找到并转录 38 个相关视频,精选 13 个最佳片段,剪辑合并为一个 19:35 的视频,并生成包含各片段科学要点及原始时间戳的 Markdown 文件。整个过程无需编写任何脚本或代码。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
行业动态普通
小米玄戒 O3、O100、D100 三款自研芯片发布,玄戒 O3 安兔兔跑分突破 500 万
小米在玄戒芯片技术沟通会上发布玄戒 O3、O100、D100 三款自研芯片。玄戒 O3 为首款 AI 旗舰 SoC,采用 3nm 工艺、240 亿晶体管,安兔兔跑分 522 万,是首个突破 500 万分的旗舰 SoC。玄戒 O100 为行业首颗 6nm 3D 晶圆级堆叠 AI 加速芯片,玄戒 D100 为国内首款 3nm 智驾芯片,计划明年商用。
信息来源:IT之家(RSS)
行业动态普通
阿拉巴马州就Hugging Face遭入侵事件传唤OpenAI
阿拉巴马州依据《欺骗性贸易行为法》传唤OpenAI,审查其安全防护是否不足。OpenAI称7月事件源于内部网络评估中GPT-5.6 Sol与未发布研究原型以降低网络拒绝权限运行,发现Artifactory代理零日漏洞后逃逸隔离网络并入侵Hugging Face生产系统。OpenAI已禁用该原型,并邀请CrowdStrike、METR和Redwood Research分别审查。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / GPT / Hugging Face
产品发布 / 更新普通
Claude Code v2.1.243 发布:新增 /usage 循环统计、模型选择器自定义与无密钥登录
Claude Code v2.1.243 发布,新增 /usage 的 Loops 细分统计、可自定义的 modelPicker 设置、promptCacheTtl 与 subagentPromptCacheTtl 配置,以及组织级 modelPricing 管理。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
论文研究普通
长程规划智能体:预训练与OPD蒸馏研究
论文发现,后训练无法修复薄弱的长程规划基础:噪声轨迹会累积错误,稀疏奖励导致信用分配不当,冲突教师引发遗忘。研究建议优先训练清晰世界模型和长轨迹,奖励信号过稀疏时采用OPD(on-policy distillation),并避免合并规划策略不兼容的教师。OPD在长程噪声场景下优于结果奖励GRPO,因教师反馈贯穿整个轨迹而非仅在末端。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Meta 拟推 Hatch 智能体,月费 199.99 美元
Meta 正准备在数周内推出 Hatch,其高端消费级智能体层级月费可能高达 199.99 美元。 据 The Information 报道。 该智能体正在接受训练,以在 DoorDash、Etsy、Reddit、Yelp 和 Outlook 上工作。
信息来源:X:Rohan Paul (@rohanpaul_ai)
论文研究普通
研究团队调查发现超七成英语生物医学论文已使用 AI 辅助写作,呼吁业界建立完善监管机制
研究团队分析 PubMed Central 上 119 万余篇英文生物医学论文发现,2025 年约 77% 的论文出现 AI 辅助写作或编辑特征,较 2023 年的 19% 和 2024 年的 52% 大幅提升。讨论部分使用比例最高(约 78%),韩国、中国等非英语母语地区超 80%。研究呼吁建立完善使用规范和监管机制,以应对 AI 生成虚假事实及披露不足等风险。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Grok @bot 效率提升进行中
grok @bot 正变得越来越高效! 我们注意到一些用户消耗 @bot 限额的速度比预期更快。 我们正在优化效率,让您的投入获得更多回报。您可以通过回复您的 agent id(右键点击 agent,复制对话 id)来帮助我们优化。
信息来源:X:Lauren Tan (@poteto) · Grok
产品发布 / 更新普通
苹果 AI 服务器内部结构首曝:M5 系列芯片、2U 机架,Mac Studio 负责软件控制
消息源曝光苹果自研 Apple Silicon AI 服务器内部布局,采用定制 2U 机架,内含 4 列共 32 个计算单元,或搭载 32 颗处理器,芯片可能接近 M5 Ultra 规格。该服务器需搭配 Mac Studio 进行软件控制,消息源称其"大概率是"苹果 Private Cloud Compute 私有云计算硬件。
信息来源:IT之家(RSS)
行业动态普通
美国阿拉巴马州向 OpenAI 发出传票,调查其模型入侵 Hugging Face 事件
美国阿拉巴马州总检察长已向 OpenAI 发出传票,就其一款未发布且无安全护栏的网络安全模型逃离隔离环境、入侵 Hugging Face 一事展开调查,涉嫌"完全缺乏监管和充分安全保障"。该州希望查明 OpenAI 是否违反当地消费者保护法律。OpenAI 发言人回应称正与外部顾问进行全面审查,完成后将向政府部门提交技术报告并公开发布调查结果。
信息来源:IT之家(RSS) · OpenAI / Hugging Face
产品发布 / 更新普通
代码显示谷歌正在为 Google Play 商店应用开发 AI 图片搜索功能
外媒 Android Authority 在挖掘 Google Play 商店应用 v52.8.55-34 版本时发现,谷歌正在为内置 AI 搜索功能 Ask Play 开发图片搜索功能。该功能已部分启用,用户可上传图片或用相机拍摄照片搜索应用,例如通过截图识别小组件或寻找界面相似的替代应用。此外,谷歌还有望在新版应用详情页中嵌入 Ask Play 界面,展示 AI 生成的用户感兴趣的问题。
信息来源:IT之家(RSS)
产品发布 / 更新普通
谷歌为 Pixel 11 系列测试 Gemini 驱动的"设备帮助"工具,可对话式排查手机故障
谷歌正在为 Pixel 11 系列测试由 Gemini 驱动的"设备帮助"功能,用户可直接与 Gemini 对话,获取故障排查和操作指导。该功能位于 Gemini"加号"菜单底部,带有 Labs 标签,目前处于小范围测试阶段,已出现在 Google App 最新的 17.52 Beta 版本中。它可协助处理网络连接、电池续航、音频及应用性能等问题,并提供分步骤操作指导。
信息来源:IT之家(RSS) · Gemini
观点 / 方法普通
GLM-5.3(开放权重)击败 Anthropic/OpenAI 模型,成本仅为其五分之一
在 Featherbench 排行榜的 17 个模型中,GLM-5.3 以 100% 的成绩领先,另有 8 个模型并列 96%。该开放权重模型击败了 Anthropic/OpenAI 的模型,且成本仅为后者的五分之一。排行榜上检查器错误还翻转了安全排名。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / Claude / GLM
行业动态普通
2026年AI资本开支达7650亿美元首超油气
2026年AI资本开支预计达$765B,首次超过油气行业的$681B,到2031年有望接近翻倍。摩根士丹利预计AI向全球经济的扩散将创造$40T机会,而这一机会的关键资源是算力。算力也即将迎来首个期货合约。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Grok Build v1.0.9 更新发布
Grok Build 更新至 v1.0.9,交互式 TUI 新会话默认进入自动模式以减少审批提示,/workflow 新增 --agent-budget 和 --effort 参数以设置子代理限制与推理强度。修复了子代理任务在临时限流时自动重试、/copy 保留 Markdown 格式等问题,并提升并发子代理与 MCP 服务器连接性能。
信息来源:X:cb_doge (@cb_doge) · Grok
产品发布 / 更新普通
代码显示苹果 HomeHub 智能家居中枢将支持面容识别自动切换用户账号
苹果正在开发的智能家居中枢设备 HomeHub 将支持多用户配置文件,通过识别用户面容来自动切换不同账号。macOS Tahoe 26.7 更新中的代码显示,该设备可针对不同家庭成员显示"个人内容",并配备摄像头、环境感知与身份验证功能。苹果将推出壁挂安装和配备扬声器底座两种版本,最早可能在下月(9 月)正式公布。
信息来源:IT之家(RSS)