AI 情报文章归档
浏览 AI圈报 已保存的 5665 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5665
正式分类6
精选内容3361
全部文章
第 115 / 142 页 · 每页 40 条
模型发布 / 更新精选
Ring-2.6-1T 正式开源:蚂蚁百灵发布万亿级思考模型
蚂蚁百灵开源万亿级思考模型 Ring-2.6-1T,重点强化 Agent 执行能力,在 PinchBench 和 ClawEval 上达到开源 SOTA。模型支持 high 与 xhigh 两档推理强度,并采用异步 Async RL 架构结合升级版棒冰算法提升训练效率。权重已开源至 Hugging Face 和 ModelScope,Chat 体验现已开放。
信息来源:公众号:蚂蚁百灵(Ling) · Hugging Face
产品发布 / 更新精选
ChatGPT 推出全新个人理财体验
OpenAI 为美国地区的 ChatGPT Pro 用户推出个人理财功能预览版。用户可安全连接个人金融账户,获取基于自身财务状况、目标和优先级生成的 AI 洞察与指导。该体验通过账户关联实现个性化分析,标志着 ChatGPT 正式向个人金融助手领域拓展。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
将Grok接入Hermes智能体
xAI宣布,用户现可将Grok订阅账户接入Nous Research的开源自改进智能体Hermes Agent。该集成对所有订阅层级开放,允许用户在Hermes环境中直接使用Grok 4.3进行文本对话与高级推理、调用其文本转语音功能生成语音回复,并利用Grok Imagine创建图像与视频。Hermes Agent可持久运行于电脑、沙盒或VPS,具备跨会话长期记忆能力,并能连接WhatsApp、Discord等通讯平台。用户通过安装Hermes Agent并选择Grok提…
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
推理的一阶导数:AI浪潮下的增长逻辑
AI推理是当今规模最大、增长最快的技术市场,预计七年内将达到2500亿美元。直接销售或转售推理服务的公司增长迅猛,如Anthropic和谷歌云。在AI时代前的软件公司中,Datadog和Twilio作为"推理的一阶导数"脱颖而出:Datadog的LLM可观测产品数据量近一季增长近两倍,其约20%的AI客户贡献了约80%的年度经常性收入;Twilio则通过AI重构的语音服务吸引客户。当前周期呈现高度集中特点,少数客户能驱动巨大收益。对于非AI原生公司,核心战略在于如何转售推理…
信息来源:Tomer Tunguz 博客(VC 分析) · Claude
论文研究精选
PAGER:弥合点精确几何图形界面控制中的语义-执行鸿沟
研究针对需要点级精度的几何图形界面控制任务,揭示了现有视觉-语言模型存在的语义-执行鸿沟:通用模型动作类型准确率高但任务成功率极低。为此,我们构建了包含4,906个问题、超过22.4万次像素级动作的PAGE Bench基准,并提出了拓扑感知智能体PAGER。该智能体通过依赖结构规划与像素级执行分解任务,结合像素接地监督调优与精度对齐强化学习,将任务成功率提升至最强通用基线的4.1倍,步骤成功率从GUI专用智能体的不足9%提高到62%以上,实现了点精确GUI控制的新突破。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
教程 / 实战精选
业务运营团队如何使用 Codex
业务运营团队可利用 Codex,将实际工作输入转化为多种关键文档。该工具能够基于真实工作内容,自动生成项目简报、战略更新报告、领导决策包以及进度更新等材料。这一应用展示了 Codex 如何将日常运营数据与沟通需求直接连接,提升文档创建效率与一致性,帮助团队更专注于核心业务决策。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
教程 / 实战精选
数据科学团队如何使用 Codex
Codex 能够帮助数据科学团队根据实际工作输入,自动化生成根本原因简报、影响报告、关键绩效指标备忘录、范围分析以及仪表板规格文档。该工具将自然语言描述转化为结构化分析框架,提升了从数据查询到报告生成的工作流效率,使团队能更快速地将业务问题转化为可执行的数据分析方案。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
论文研究精选
突破舒适区:面向RLVR的高效策略引导探索框架NudgeRL
强化学习与可验证奖励范式面临探索效率瓶颈。为此,研究团队提出NudgeRL框架,其核心是"策略助推"技术,通过为每次策略采样注入轻量级策略级上下文,引导模型产生多样化推理轨迹,无需依赖昂贵的外部监督。该框架进一步提出一个统一目标,将奖励分解为上下文间与上下文内组件,并通过蒸馏目标将有效行为迁移回基础策略。在五个高难度数学基准测试中,NudgeRL的表现优于标准GRPO方法,其效果相当于后者使用高达8倍采样预算的结果,且平均表现超过了依赖特权信息的Oracle引导基线,证明了…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
在 Windows 上构建安全有效的沙箱以启用 Codex
OpenAI 为 Windows 平台上的 Codex 构建了一个安全沙箱环境。该沙箱通过严格控制文件访问权限和实施网络限制,确保了代码生成与执行过程的安全性。这一举措使得基于 Codex 的编码助手能够以高效且受控的方式运行,在提供强大编程辅助功能的同时,有效隔离了潜在风险,保障了用户系统的安全。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
教程 / 实战精选
销售团队如何使用 Codex
销售团队可利用 Codex 基于实际工作输入,自动生成一系列关键销售文档。具体功能包括创建管道简报、会议准备材料、预测审核、客户计划以及停滞交易诊断。这一应用将日常沟通与数据转化为结构化、可操作的销售支持内容,帮助团队提升效率与决策质量。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
API提示预缓存加速首令牌生成
减少API长提示首令牌生成时间的实用技巧:预热提示缓存。 在用户提示前发送系统提示。Claude会将其写入缓存,但跳过生成任何输出。 当真实用户请求到达时,将直接命中预热缓存。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
OpenCode与Qwen 3.6 Plus再度免费开放
OpenCode x Qwen 3.6 Plus - 再次免费 上次各位把我们的容量当成了自助餐。 我们找到了更多GPU。第二轮。
信息来源:X:opencode (@opencode) · Qwen
产品发布 / 更新精选
Claude 代理工具 v2.1.142 版本更新
Claude 代理工具发布 v2.1.142 版本。本次更新新增了 `--add-dir`、`--settings`、`--model` 等 8 个用于配置后台会话的命令行标志,并将 Fast 模式的默认模型升级为 Opus 4.7。插件功能得到增强,拥有根目录 `SKILL.md` 的插件现可被识别为技能,插件详情面板会显示其提供的 LSP 服务器。此外,版本修复了超过 15 项问题,包括 MCP 工具超时设置失效、后台会话在系统休眠后异常断开、守护进程升级后无法正常退出…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新精选
Luma Agents高效生成电商素材全流程
更多产品。更多市场。更多格式。再无瓶颈。 定义需求。设定风格。Luma Agents 从此处理所有电商活动素材。 立即扩展 → http://lumalabs.ai/app
信息来源:X:Luma AI (@LumaLabsAI)
产品发布 / 更新精选
ChatGPT移动端新增Codex功能
ChatGPT手机应用中推出Codex功能!
信息来源:X:Sam Altman (@sama) · ChatGPT
产品发布 / 更新精选
Codex推出自动化钩子与程序化令牌
Codex正变得更易于围绕用户代码实现自动化与定制。其核心更新包括"钩子"功能,允许在任务关键节点运行脚本,以进行工作验证、扫描密钥、记录对话或按仓库定制行为。同时,面向商业和企业团队推出"程序化访问令牌",提供范围化凭证,可从ChatGPT工作区设置创建,用于CI/CD、发布流程和内部自动化,支持设置过期或撤销,并将使用情况关联回工作区。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
产品发布 / 更新精选
ChatGPT移动端预览Codex编程助手
你们一直期待的功能来了… 现已在预览版推出:ChatGPT移动应用中的Codex。 从ChatGPT移动应用启动新工作、查看输出、引导执行并批准后续步骤。Codex将持续在你的笔记本电脑、Mac mini或开发机上运行。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT
模型发布 / 更新精选
IBM 发布 Granite Embedding Multilingual R2 开源多语言嵌入模型
IBM 发布两个 Apache 2.0 开源多语言嵌入模型:97M 参数的紧凑型(granite-embedding-97m-multilingual-r2)在 MTEB Multilingual Retrieval 上得 60.3 分,超越所有开放子 1 亿参数模型;311M 全尺寸模型(granite-embedding-311m-multilingual-r2)得 65.2 分,在 500M 以下开放模型中排第二,并支持 Matryoshka 维度。两者均基于 Mod…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
行业动态精选
OpenEvidence覆盖65%美国医生,shadow AI模式引关注
OpenEvidence已覆盖65%的美国医生,4月单月临床场景使用达2700万次,平均每位医生每月使用41次。平台由医生个人通过执业编号在手机上注册,医院最初不知情,Mount Sinai的AI负责人称此为shadow AI,表示其早在基层普及。医院后来才追签企业合作,OpenEvidence强调这是美国医疗史上首次让大多数医生自愿采用单一技术平台的突破。合作伙伴包括NEJM、JAMA、NCCN和Wiley,为此提供了支持。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新精选
Kimi发布支持多款AI编程助手的浏览器扩展
Kimi发布了Kimi Web Bridge,这是一款可与多种代理协同工作的新浏览器扩展,包括Claude Code、Hermes、Codex、Kimi Code CLI等。 一浏览器通用于所有 👀 试用地址:http://kimi.com/features/webbridge 及Chrome网上应用店。
信息来源:X:Testing Catalog (@testingcatalog) · Claude / Kimi
产品发布 / 更新精选
Recraft AI V4.1上线OpenRouter平台
现已在 OpenRouter 上线:@recraftai V4.1! 包含六款新图像生成模型:追求高美学的 V4.1 和 V4.1 Pro,用于 SVG 插画的 V4.1 Vector 和 V4.1 Pro Vector,以及优先考虑克制风格的产品图像的 V4.1 Utility 和 V4.1 Utility Pro。 照片级真实感更自然,渐变更平滑,简短提示词能更准确地命中目标,无需过多手动调整。
信息来源:X:OpenRouter (@OpenRouter)
教程 / 实战精选
在法律行业全面部署Claude:产品指南与实施路线图
2026年报告显示,法律团队生成式AI使用率已从44%跃升至87%。为应对日益复杂的工作,法律行业正将Claude应用于合同审阅、并购尽调及诉讼准备等核心流程,并通过多款产品组合提升效率:Chat用于即时研究,Claude Cowork处理跨文件协作,Microsoft 365插件集成办公套件,Platform支持定制应用开发。Anthropic同步发布法律行业部署指南,涵盖产品矩阵、12个预设业务领域插件及三阶段实施路线图,并解答数据托管与权限保护等关键问题。
信息来源:Claude:Blog(网页) · Claude
行业动态精选
Anthropic与盖茨基金会达成2亿美元合作,聚焦全球健康与教育
Anthropic与盖茨基金会建立为期四年、总额2亿美元的合作,通过资金、Claude使用额度及技术支持,共同推进全球健康、生命科学、教育及经济流动项目。合作重点包括改善中低收入国家约46亿人口的基本医疗,利用AI加速疫苗与疗法研发,并开发公共卫生数据集等公共产品。在教育领域,双方将为美国、撒哈拉以南非洲和印度的K-12学生开发AI教学工具。经济流动方面则关注提升小农户生产力及美国职业技能认证。首批成果预计今年晚些时候发布。
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
计算机直连Snowflake实现实时数据洞察
计算机现已连接至Snowflake。 可基于实时仓库数据开展端到端工作,通过SQL、源表、筛选器和指标获取答案。 这就像一支随时待命的个人数据科学团队,从公司实时数据中提供精准答案。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新精选
Kimi推出网页桥接扩展 支持多平台交互
认识Kimi网页桥接--Kimi的浏览器扩展。 现在智能体可以像人类一样与网站互动:搜索、滚动、点击、输入并完成任务。 支持Kimi Code CLI、Claude Code、Cursor、Codex、Hermes等平台。 现已在http://kimi.com/features/webbridge和Chrome应用商店上线。
信息来源:X:Kimi.ai (@Kimi_Moonshot) · Claude / Kimi / Cursor
观点 / 方法精选
克劳德代码与《代码书》技能:有针对性的技能培养
开发者发布了一款名为"克劳德代码与《代码书》技能"的GitHub工具,旨在通过刻意练习提升编程技能。该工具利用AI模型生成特定主题的代码示例与解释,帮助用户进行针对性学习。项目在Hacker News上获得104点热度,关注度较高。其核心变化在于将传统的广泛学习转化为聚焦、可重复的技能训练模式,通过结构化练习提升学习效率。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
随时随地使用 Codex
用户现可通过 ChatGPT 移动应用随时随地使用 Codex。该功能支持跨设备和远程环境实时监控、引导及批准编码任务,实现了对编程工作的无缝移动端管理。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
行业动态精选
AI 热潮引发民怨:七成美国民众反对家门口建数据中心
盖洛普调查显示,高达七成美国民众反对在住宅附近建设数据中心,反对率较去年大幅上升,抵触情绪甚至超过对核电站的接受度。全美已有69个辖区出台暂停令,多地项目因抗议和监管纠纷延期。数据中心建设推高批发电价,导致用电成本激增,并引发空气污染、水资源消耗等担忧。尽管白宫要求AI企业承担配套成本,但仅为无约束力承诺,未来审批将更严苛。
信息来源:IT之家(RSS)
模型发布 / 更新精选
SenseNova U1技术报告发布,基于MoE架构开放模型权重
由联合创始人兼首席科学家李沐博士领导的团队发布了SenseNova U1技术报告,详细阐述了其架构、训练方案与创新突破。此次开源同步发布了基于混合专家模型(MoE)的新权重,旨在推动AI领域的透明度、可复现性与进一步创新。团队希望通过开放共享促进整个社区的技术发展。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
行业动态精选
OpenAI遭集体诉讼,被指通过追踪代码向Meta等泄露用户查询隐私
南加州联邦法院已受理针对OpenAI的集体诉讼,指控其在ChatGPT网站中嵌入Facebook Pixel等代码,侵犯用户隐私。当用户提交查询时,查询主题会作为浏览器标题与含Facebook唯一ID的cookies一并实时发送给Meta。OpenAI虽称仅分享"有限标识符"用于广告,但原告认为查询主题本身即高度敏感的个人信息。此案揭示免费AI服务的潜在代价:用户每一次查询及数字身份可能成为被交易的产品,与许多用户为逃避追踪而选择ChatGPT的初衷形成讽刺对比。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI / ChatGPT
模型发布 / 更新精选
蚂蚁 inclusionAI 推出万亿参数推理模型 Ring-2.6-1T
蚂蚁 inclusionAI 发布旗舰推理模型 Ring-2.6-1T,参数规模达万亿,面向智能体工作流、工程开发、科研分析等复杂场景。模型从"能回答"升级至"能执行",在多步任务与工具协作中表现更优;支持 high/xhigh 两档推理强度,可灵活平衡效果与成本;采用异步强化学习结合 IcePop 算法提升训练效率。基准测试中,high 模式 PinchBench 得 87.60、ClawEval 63.82、Tau2-Bench 电信场景 95.32;xhigh 模式 …
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
观点 / 方法精选
"让 Token 消耗降低 61%":腾讯开源 Agent Memory
腾讯云开源了TencentDB Agent Memory,旨在解决Agent长任务中上下文窗口易满、Token成本高的问题。该方案采用"上下文卸载"与"Mermaid任务画布"两项核心技术,将完整信息卸载至外部存储,同时用结构化任务图保留关键状态与执行路径。实验显示,该方案在多任务连续会话中最高可降低61%的Token消耗,并提升任务成功率。项目已适配OpenClaw等主流框架,支持一键集成与本地SQLite存储。
信息来源:IT之家(RSS)
行业动态精选
MiMo V2.5 Pro 获设计竞技场季军
MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!
信息来源:X:小米 MiMo (@XiaomiMiMo) · Claude
论文研究精选
教视觉-语言模型说"电影语言"
研究团队与百余名专业创作者历时一年,构建了一个视频描述生成流程,其核心在于扩展精细化的人类-AI协同监督,而非单纯扩大模型规模。该研究(入选CVPR 2026亮点论文)指出,当前主流视频生成模型在理解和生成具有电影感的专业运镜(如希区柯克式滑动变焦、精确的焦点转移或荷兰角镜头)时存在明显不足,常产出通用或焦点错误的画面。这项工作揭示了一条通过提升监督质量来增强模型"电影语言"表达能力的新路径。
信息来源:CMU:Machine Learning Blog
论文研究精选
Darwin Family:基于MRI-Trust加权的进化合并实现语言模型推理能力的免训练扩展
Darwin Family框架通过免训练的梯度无关权重重组,探索重组现有模型隐式能力以提升推理性能。其核心包括14维自适应合并基因组实现细粒度组件重组;MRI-Trust融合机制通过可学习参数平衡层重要性信号与进化搜索;架构映射器支持异构模型家族间的跨架构融合。旗舰模型Darwin-27B-Opus在GPQA Diamond基准上达到86.9%准确率,在1252个模型中排名第六,无需训练即超越其基础模型。该框架在4B至35B参数规模上均能持续提升性能,支持递归多代进化,并能…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
xAI 推出 Grok Build 早期测试版
xAI 面向 SuperGrok Heavy 订阅用户推出 Grok Build 早期测试版。这是一个直接在终端运行的新型编程智能体与命令行工具,专为专业软件工程和复杂任务设计。其核心功能包括:支持"计划模式",允许用户在代码执行前审阅和修改详细步骤;能无缝集成现有开发工具链;可将大型任务分解,交由并行运行的专用子智能体处理。此外,该工具提供无头模式,便于脚本和自动化流程集成。用户可通过单行命令安装并立即在项目中使用。
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
AI电子邮件的成本分析
使用顶尖AI模型处理邮件的月度成本约为22至130美元,中位数26美元。若软件公司以75%毛利率定价,年费可能高达350美元,加上托管服务后标价或达500美元,约为Google企业邮箱费用的两倍。采用小型模型可降低成本10至20倍,而通过本地运行利用用户GPU,更能将成本削减至接近零。结合基础启发式方法和技术优化,总成本有望降低100倍。这种针对不同工作负载匹配模型并进行成本分层的推理市场细分,将是未来一两年AI软件发展的关键。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法精选
解锁连续批处理中的异步性
在连续批处理中,同步方式导致CPU与GPU交替工作,造成闲置浪费。测试显示,使用8B模型生成8K令牌时,GPU有24%的时间处于空闲状态。异步批处理通过分离工作负载,让CPU准备下一批次(N+1)的同时,GPU计算当前批次(N),从而消除闲置间隙。这可通过CUDA流实现操作并发,无需更改内核或模型,仅需协调硬件执行顺序。理论上,该方法可将总生成时间从300.6秒减少至228秒,实现24%的免费加速。相关技术已集成到transformers库的连续批处理中,显著提升推理性能。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究精选
Orchard:一个开源智能体建模框架
针对智能体建模领域因依赖闭源资源而受限的问题,研究团队推出了开源框架Orchard。其核心是轻量级环境服务Orchard Env,提供跨任务和流程的可复用沙箱管理基元。基于此构建了三个高效智能体方案:编码智能体Orchard-SWE在SWE-bench Verified上达到67.5%的准确率;视觉语言计算机使用智能体Orchard-GUI仅用少量数据便在多项基准测试中取得64.0%-74.1%的成功率;个人助理智能体Orchard-Claw仅用0.2K合成任务便在Claw…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
迈向自我进化的智能文献检索系统
针对传统检索无法理解复杂意图、而前沿大语言模型成本高且存在幻觉的问题,研究团队提出了自我进化的智能文献检索系统PaSaMaster。该系统通过迭代式意图分析、检索与排序,将文献检索转变为动态演进的过程,并采用三项关键设计:利用排序证据揭示信息缺口以优化搜索;将检索定义为意图-论文相关性排序任务,从根本上杜绝虚假文献;通过分离规划与检索来提升效率,仅用大模型理解意图,而将大规模检索与评分交由轻量模型处理。在涵盖38个学科的基准测试中,该系统将传统关键词检索的F1分数提升15.…
信息来源:HuggingFace Daily Papers(社区热门论文) · GPT / Hugging Face