AI 情报文章归档
浏览 AI圈报 已保存的 5721 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5721
正式分类6
精选内容3361
全部文章
第 103 / 144 页 · 每页 40 条
观点 / 方法精选
洪水韧性新篇章:Google 开源水文建模框架
Google Research 在 GitHub 开源了其水文建模框架,这是一个基于 PyTorch 的 Python 包,采用与 Flood Hub 河段洪水预报相同的模型架构和训练数据。该框架允许研究者和预报员训练 AI 洪水预报模型、添加新模型与数据,并已与捷克水文气象研究所(CHMI)等合作测试。开放模型架构和训练管线旨在让各国气象水文部门在保留数据完全控制权的同时,整合基于 AI 的洪水预报。
信息来源:Google Research:Blog(网页)
论文研究精选
AI驱动的网络威胁映射:LLM ATT&CK Navigator的洞察
Anthropic分析了832个因违反政策被封禁的恶意账户(2025年3月至2026年3月),将其活动映射到MITRE ATT&CK框架的全部14种战术和482种子技术。风险评分显示,中等及以上风险行为者比例从上半年的33%跃升至下半年的56%,增长集中在横向移动、凭证窃取、webshell等高危技术。Agentic scaffolding使攻击链实现自主编排--2025年11月一次间谍活动风险评分达100,所用技术数量却与中等风险者相当。MITRE ATT&CK框架尚未覆…
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
观点 / 方法精选
Gary Marcus:为什么事情终将崩塌
知名人工智能批评者Gary Marcus在其关于可信赖AI的专栏中,探讨了人工智能发展面临的根本性挑战。文章开篇即指向问题的核心,指出相关数学理论的局限性与人类心理的复杂性,是导致AI系统最终可能出现问题的根源。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
模型发布 / 更新精选
MAI-Image-2.5 launches at No. 2 for image editing on Arena
信息来源:Microsoft AI:官方博客(网页)
观点 / 方法精选
商汤开源SenseNova-Skills AI办公技能套件
商汤开源了AI办公技能套件SenseNova-Skills。这是一个为任何技能兼容智能体(如OpenClaw与HermesAgent)设计的开源技能集合,提供四大核心功能:图像信息图表生成(可镜像参考风格)、数据分析(支持多表解析、清洗与可视化)、PPT创建(生成大纲内容并智能排版,输出可编辑文件)以及深度研究(跨学术、技术、社交等多源搜索并生成报告)。该技能套件现已完全开源。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
模型发布 / 更新精选
Holo3.1:快速本地计算机使用智能体
Holo3.1 是基于 Qwen 模型家族的计算机使用智能体系列,旨在提升在桌面、网页和移动环境中的鲁棒性。新模型提供 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次发布量化检查点,包括 FP8、Q4 GGUF 和 NVFP4,以优化本地推理。在 AndroidWorld 基准测试中,35B-A3B 模型得分从 67% 提升至 79.3%。在 DGX Spark 上,NVFP4 量化相比 BF16 实现 1.74 倍 token 吞吐量提升,并将平均步骤时间从 …
信息来源:Hugging Face:Blog(RSS) · Qwen / Hugging Face
行业动态精选
Nathan Lambert离开Ai2,结束2.5年OLMO等项目工作
Ai2(Allen Institute for AI)研究员Nathan Lambert宣布离职。他在Ai2工作超过2.5年,期间主导或参与了OLMO和Tulu等开源模型项目,称其为职业生涯的巅峰。他表示将暂时休息,未来仍会继续深耕开源模型与开放科学领域。
信息来源:X:Nathan Lambert (@natolambert)
产品发布 / 更新精选
MiniCPM-V 4.6 现已支持 vLLM v0.22.0
MiniCPM-V 4.6 现已完全支持 vLLM v0.22.0! 无需自定义分支,无需额外编译。 只需拉取预构建包即可运行。 非常感谢 @vllm_project 的顺畅集成! 🤝 🤗 http://huggingface.co/openbmb/MiniCPM-V-4.6
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · Hugging Face
行业动态精选
Anthropic扩展Project Glasswing计划
Anthropic正将其Project Glasswing计划扩展至约150个新组织,此前首批约50个合作伙伴。新伙伴分布于十五个多国家,覆盖电力、水务、医疗、通信和硬件等关键基础设施行业。这些合作伙伴的共同点在于,其代码库若遭成功攻击,后果可能极其严重,影响或超1亿人。项目旨在利用Claude Mythos Preview等前沿模型扫描漏洞并协助修复,以应对AI驱动的网络安全挑战。同时,Anthropic推出了基于Claude Opus 4.8等公开模型的Claude S…
信息来源:Anthropic:Newsroom(网页) · Claude
论文研究精选
世界模型与语言模型:论具体推理与抽象推理的互补性
本研究探讨了世界模型与多模态大语言模型在预测未来状态时的互补性。世界模型可生成具体的视觉未来轨迹,但可能视觉合理却任务错误;多模态大语言模型则擅长抽象推理。为此,研究提出了"受控的具体推理"框架,并构建了VRQABench和OpenWorldQA两个基准。同时,提出了Privileged-Future On-Policy Self-Distillation(PF-OPSD)方法,该方法在训练时利用真实未来视频作为特权上下文评估推理轨迹,但部署时无需真实未来。实验结果显示,P…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
蚂蚁 inclusionAI 开源万亿参数 MoE 基座模型 Ling-2.6-1T-base
Ling-2.6-1T-base 是蚂蚁 inclusionAI 开源的万亿参数 MoE 基座模型(总参约 1T,激活 63B)。它由 Ling-2.0-1T-base 升级而来,采用 Lightning Attention 与 MLA 以 7:1 混合的线性注意力架构,经约 9.6T token 的迁移预训练、持续预训练和中训练,上下文窗口从 4K 分阶段扩展至 256K。在 MMLU(86.82)、SimpleQA、LongBenchv2(43.54)等基准上超越前代。…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
Building a hill-climbing machine: Launching seven new MAI models
信息来源:Microsoft AI:官方博客(网页)
论文研究精选
Anthropic可解释性研究:区分因果效应相似的特征
Anthropic可解释性团队介绍了其Circuits研究的新进展。为区分那些激活模式相似但因果效应不同的模型特征,团队提出一种新方法。该方法通过分析特征的下游连接来预测其实际影响,并使用基于共激活统计的TWERA(虚拟权重)对连接进行加权排序。实验表明,借助下游连接信息能更准确地判断哪个特征会引导特定输出。此方法为识别模型内部真正的因果组件提供了新途径。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
产品发布 / 更新精选
Codex 赋能每一种角色、工具和工作流
OpenAI 的 Codex 新增了插件、站点和注释等功能。这些新功能旨在帮助分析师、营销人员、设计师、投资者等各类团队,利用 AI 完成更多工作。Codex 进一步拓展其作为 AI 编码工具的应用场景,以支持更广泛的角色、集成更多工具并优化现有工作流。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
行业动态精选
SK会长崔泰源:SK海力士计划未来五年内晶圆产能翻倍
SK海力士会长崔泰源宣布,计划在未来五年内将整体晶圆产能提高一倍,以应对AI普及带来的持续存储供应短缺。他预测AI数据中心和AI PC的普及将持续拉动存储需求,供需紧张局面可能延续至2030年。SK海力士将投入大规模资金用于设备、建设等扩张,尽管面临前置时间长(新建晶圆厂至少三年)和资源成本上涨等挑战。目前,SK海力士市值已首次突破1万亿美元。
信息来源:IT之家(RSS)
模型发布 / 更新精选
商汤 SenseNova U1 发布信息图专用模型
感谢使用我们的模型来创建这些复杂的图表和图表。 看到具有挑战性的信息被转化为清晰、准确和可读的视觉效果真是太棒了。这就是我们的目标。😄
信息来源:X:商汤 SenseTime (@SenseTime_AI)
观点 / 方法精选
基于 Codex 的开源 AI 技能"清理垃圾.skill":自动扫描电脑生成 HTML 报告,一键清理垃圾
作者基于 Codex 创建并开源了"清理垃圾.skill",可对 Mac 和 Windows 电脑进行只读扫描,自动生成可交互的 HTML 报告,将文件按优先级分为绿灯(可自动清理)、黄灯(建议手动)、红灯(跳过)。在作者的 MacBook Air 上扫出近 120 GB 垃圾,其中 96.7 GB 为 B 站离线缓存视频,而 CleanMyMac 仅检出 15.8 GB。用户可在网页上逐项或一键清理,全程需二次确认,项目已开源至 GitHub。
信息来源:公众号:数字生命卡兹克
论文研究精选
KPop:用对称二元KL散度解决大模型强化学习的训练推理不一致问题
蚂蚁百灵团队提出KPop方法,应对大模型强化学习中训练与推理引擎概率分布不一致导致的训练崩溃。KPop用对称二元KL散度替代IcePop的固定比值阈值,仅需一个超参数,对稀有token自适应宽容、对高频token严格约束。在Ring-flash-2.0(总参100B)上支撑800+步稳定RL训练,SWE-bench Verified从70.8%提升至76.28%。
信息来源:公众号:蚂蚁百灵(Ling)
行业动态精选
OpenAI + Amazon Bedrock:
OpenAI的GPT-5.5、GPT-5.4及Codex编程智能体现已在Amazon Bedrock平台正式上线。开发者可通过Bedrock的下一代推理引擎部署这些模型,享受自动扩展能力。具体应用包括使用GPT-5.5和GPT-5.4构建能处理多步骤编码、数据分析和知识工作的自主AI智能体,或将Codex编程智能体集成至开发工作流,并通过Bedrock进行所有模型调用。该服务按token计费,支持弹性扩展。
信息来源:X:Greg Brockman (@gdb) · OpenAI / GPT
观点 / 方法精选
Karpathy 分享学习方法论
🎯 Andrej Karpathy 谈如何学习。
信息来源:X:Rohan Paul (@rohanpaul_ai)
论文研究精选
ACTS:面向高效可控LLM推理的智能体链式思维引导
ACTS将推理引导建模为马尔可夫决策过程,控制器智能体在推理中自适应引导冻结的推理器。控制器每步观察推理轨迹与剩余预算,发出含推理策略和引导短语的动作,实现预算感知的推理控制。控制器通过合成轨迹初始化,并经强化学习优化。在多个基准上,ACTS以显著token节省匹配全思考性能,实现可控的精度-效率权衡。代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
开放模型的繁荣生态
根据OpenRouter平台数据,自2025年以来,开放模型使用量显著增长。最新数据显示,开放权重模型产生了69.1%的token使用量,闭源模型为30.9%。新模型的发布会吸引开发者测试,推动token使用量达到新的平台期。开放模型市场内部竞争激烈,领导地位频繁更迭,如DeepSeek的早期优势在2025年末至2026年初被MiniMax与Kimi模型取代,随后MiMo、Qwen、腾讯Hy3、阿里巴巴及Arcee等模型的发布再次改变了份额格局。尽管开放模型目前仍只占推理总…
信息来源:Tomer Tunguz 博客(VC 分析) · DeepSeek / Qwen / Kimi
论文研究精选
Ultralytics YOLO26:统一实时端到端视觉模型
Ultralytics YOLO26 采用双头设计实现原生无 NMS 的端到端推理,彻底移除 DFL,获得更轻检测头与无约束回归范围。训练结合混合 Muon-SGD 优化器 MuSGD、转向推理头的 Progressive Loss 及保证小物体正样本的 STAL 标签分配。支持检测、实例分割、姿态估计、定向检测和分类,提供 5 种尺度(n/s/m/l/x)及开放词汇扩展 YOLOE-26。全部尺度在 COCO 上达 40.9-57.5 mAP,T4 TensorRT 延迟…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
Sam Altman强调AI发展应以人为本
Sam Altman在采访中表示,AI不应被设计为追求脱离人类需求的目标,人类必须始终处于AI发展的中心。他批判了行业内"AI将摧毁大量工作"等言论,认为人们担忧的并非AI带来的好处,而是自身在未来的角色、经济前景与自主权。他指出,AI行业的失败在于未能清晰解释人类如何在每一步保持对未来的控制权,以及如何在AI时代继续拥有充实、有意义的生活。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新精选
MiniMax M3 模型上线 Cloudflare AI Gateway
M3 on Cloudflare AI Gateway, day one ⚡ 前沿编码能力,1M 上下文,原生多模态,现在一次 fetch 即可调用。 是时候构建些东西了。 🦞
信息来源:X:MiniMax (@MiniMax_AI)
行业动态精选
Alphabet计划筹资800亿美元用于AI建设
Alphabet计划通过出售股票筹集800亿美元资金,以支持其人工智能建设。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新精选
ChatGPT 新增长文编辑与保存功能
长文写作需要更多空间。 现在你可以在全屏模式下编辑更长的文章,并将其保存到你的资料库中,以便稍后继续。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT
产品发布 / 更新精选
Google AI Studio 新增 Gmail 等应用构建能力
我们刚刚上线了在 @GoogleAIStudio 内直接构建连接 Gmail、Drive、Sheets 等应用的功能,无需跳转其他网站,你可以直接在 AI Studio 内添加测试人员,完整的公开分享功能即将推出!!
信息来源:X:Logan Kilpatrick (@OfficialLoganK)
行业动态精选
佛罗里达州总检察长因AI风险对OpenAI提起诉讼
佛罗里达州总检察长对OpenAI及其CEO Sam Altman提起诉讼,指控其人工智能技术存在风险。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
行业动态精选
黑客利用Meta AI客服聊天机器人漏洞窃取名人Instagram账户
黑客利用Meta AI客服聊天机器人的漏洞,窃取了高价的Instagram用户名并将其转售。Meta在事后修复了该安全漏洞。
信息来源:Ars Technica:AI(RSS) · Llama
产品发布 / 更新精选
Replit 用单个提示词构建完整业务
你能用单个提示词免费构建一个真实的业务吗? 从今天起,在 Replit 上,答案是肯定的。 从一个提示词开始,获得一个网站、移动应用、幻灯片和发布视频。 此外,还能解锁使用 @stripe @atlas, @QuickBooks, @mercury & @doolaHQ 运营业务的福利。
信息来源:X:Replit (@Replit)
行业动态精选
佛罗里达州起诉OpenAI与Sam Altman:涉多起ChatGPT相关谋杀案
佛罗里达州对OpenAI及其CEO Sam Altman提起诉讼。该州总检察长指控Altman对人命"完全漠视",案件与多起涉及ChatGPT的谋杀事件相关。
信息来源:Ars Technica:AI(RSS) · OpenAI / ChatGPT
观点 / 方法精选
Google AI 展示并行子智能体自动整理文件
从杂乱到清晰。观看 @Antigravity 中的并行子智能体对数百个营销资产进行分类和重命名,消除手动文件管理。
信息来源:X:Google AI for Developers (@googleaidevs)
模型发布 / 更新精选
Qwen3.7-Plus 多模态智能体模型发布
Qwen3.7-Plus 深度融合视觉与语言,实现"看、想、写、做、验"端到端闭环,在 12 项核心基准测试中表现提升。实测中,基于该模型的智能体连续运行超 11 小时,自动完成英语学习 APP 开发,生成代码超 10000 行、触发调用超 1000 次;复刻 macOS Stocks 应用并通过 10 项功能验证。支持图像/视频转 SVG、视觉驱动网页设计及浏览器自动化。已在阿里云百炼上线,提供 OpenAI 兼容 API 与 Anthropic 协议。
信息来源:公众号:通义实验室(千问) · OpenAI / Qwen / Claude
产品发布 / 更新精选
Perplexity发布Search as Code搜索架构
推出Search as Code,我们为AI智能体打造的全新搜索架构。 它直接编写Python代码调用我们的搜索栈,而非逐个循环函数调用。 现已在Perplexity Agent API中提供,并成为Computer的默认选项。 https://research.perplexity.ai/articles/rethinking-search-as-code-generation
信息来源:X:Perplexity (@perplexity_ai)
行业动态精选
OpenAI的AI政策与政治倡导观点
OpenAI阐述了其在AI政策与政治倡导方面的立场,包括对透明度、深思熟虑的监管以及AI安全的支持。同时,公司明确表示,任何外部政治组织均不能代表OpenAI发言。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
模型发布 / 更新精选
英伟达 Cosmos 3
英伟达发布了 Cosmos 3,这是一个用于物理 AI 推理的世界和行动模型。该信息来源于英伟达开发者博客,发布日期为 2026 年 6 月 1 日。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · NVIDIA
行业动态精选
Anthropic 提交上市申请
AI 公司 Anthropic 于周一秘密提交了首次公开募股(IPO)申请。
信息来源:TechCrunch:AI(RSS) · Claude
观点 / 方法精选
Gemini Omni支持创建个人数字分身
轻松将自己添加到Gemini的视频创作中。 以下是如何使用Gemini Omni创建一个外观和声音都像你的数字分身。🧵
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
Claude Code 新增动态工作流功能
Claude Code 新增动态工作流功能,允许模型在运行时即兴创建和协调多智能体框架来处理复杂任务。该功能通过执行特定的 JavaScript 文件来生成和协调拥有独立上下文窗口的子代理,可解决单一上下文窗口中长时间执行任务可能出现的智能惰性等问题。工作流适用于研究、安全分析、代码审查等场景,通常消耗更多 token,更适合高价值复杂任务,其最佳实践仍在发展中。
信息来源:Claude:Blog(网页) · Claude