AI 情报文章归档
浏览 AI圈报 已保存的 5721 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5721
正式分类6
精选内容3361
全部文章
第 104 / 144 页 · 每页 40 条
产品发布 / 更新精选
Auto Router 新增成本质量权衡参数
Auto Router 现在允许你调整其在成本与质量之间的权衡。 新增 `cost_quality_tradeoff` 参数,范围 0 到 10: 设为 0 时,它总是选择最强大的模型,无论价格如何。设为 10 时,最便宜的模型胜出。
信息来源:X:OpenRouter (@OpenRouter)
行业动态精选
智谱:建议 A 股发行并在科创板上市
智谱计划向中国监管机构申请发行A股并在科创板上市。发行股份数量占发行完成后总股本的2%至8%,预计全部为新股,原股东不发售。本次发行募集资金净额将投资于人工智能通用基座大模型、大模型MaaS一站式服务平台及补充流动资金。此外,公司拟将英文名称由"Knowledge Atlas Technology Joint Stock Company Limited"变更为"Z.AI Co., Ltd."。
信息来源:IT之家(RSS) · GLM
模型发布 / 更新精选
JetBrains 发布 Mellum2:12B 参数混合专家模型
Mellum2 是 JetBrains 从头训练的 12B 参数混合专家(MoE)模型,专注于自然语言与代码。每个 token 仅激活 2.5B 参数,推理速度可达同类模型的 2 倍以上,适合高吞吐、低延迟场景。该模型支持路由、RAG、摘要、子智能体及私有部署,以 Apache 2.0 许可证开源。在代码生成、推理、科学和数学基准测试中,Mellum2 与同等规模的开放模型竞争力相当。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
SenseNova新模型解决AI图表生成难题
大多数AI模型在生成图表时存在数值错误(如负值显示为正)、柱状图位置偏移、元素关系混乱等问题。SenseNova-U1-8B-MoT-Infographic(SenseNova-U1)专为解决此类图表生成问题而设计,能够生成准确的图表,并支持实时调整设计和布局。项目在Hugging Face提供了模型,并在GitHub展示了效果案例。
信息来源:X:商汤 SenseTime (@SenseTime_AI) · Hugging Face
教程 / 实战精选
构建每周千美元预算上限的智能体教程
视频教程:如何构建一个每周预算上限为1000美元的智能体,包含模型拒绝列表与自定义数据保留 使用了新的、可堆叠的护栏架构: 【引用 @OpenRouter】:OpenRouter 上的护栏是市场上最强大的:为您的 AI 流量提供集中式安全与治理 预算限制、ZDR、模型与提供商限制、提示词注入防御以及 DLP / 敏感信息检测,分层为您控制的规则!🧵
信息来源:X:OpenRouter (@OpenRouter)
观点 / 方法精选
超越LLM:为何可扩展的企业AI采用取决于智能体逻辑
可扩展的企业AI采用需超越大语言模型,依靠智能体逻辑来引导模型执行动态、长周期且受约束的企业工作流,从而提升质量、降低成本并建立信任。文中以IBM watsonx Code Assistant for Z为例,展示了智能体逻辑如何通过程序分析等技术,在理解大型遗留代码库时,相比纯LLM基线方法,能以约30倍更低的token消耗达到更优性能。在加速测试生成任务中,该方法亦能使代码覆盖度提升20%-45%,同时token消耗降低最高达15倍。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
观点 / 方法精选
开源与闭源模型在不同的增长曲线上
当模型智能的微小提升能直接转化为实际价值时,开源与闭源模型正沿着不同的增长路径发展。闭源模型通过在特定场景下提供更高的边际智能来创造价值,而开源模型则在其他维度寻找增长点,两者形成了差异化的竞争格局。
信息来源:Nathan Lambert:Interconnects(RSS)
产品发布 / 更新精选
OpenBMB发布UltraData两大开源数据集,登顶HuggingFace趋势榜
OpenBMB联合清华NLP与Modelbest发布两个开源数据集:Ultra-FineWeb-L3(预训练合成数据)包含600B+ tokens(超400B英文、200B+中文),是迄今最大开源中文预训练合成数据集;UltraData-SFT-2605(后训练SFT数据)包含15M+样本,是中国首个开源且包含思考与非思考标注的大规模SFT数据集,覆盖数学、代码、知识和指令遵循。两者均基于UltraData L0-L4框架构建,并在MiniCPM5-1B训练中完成验证。数据…
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · Hugging Face
行业动态精选
王兴:美团 AI Agent"小美"与腾讯元宝即将深度合作,用户订单无缝连接
美团2026年第一季度财报显示营收910.39亿元,净利润亏损68.27亿元。财报电话会上,CEO王兴透露其AI Agent"小美"将与腾讯元宝深度合作。用户在腾讯元宝中提交本地服务需求,将被无缝连接至美团的外卖点餐、配送等生态。王兴强调,面向智能体的服务(To A)正变得日益重要,美团已将AI助手"小团"置于App核心位置,并拓展AI服务外延。
信息来源:IT之家(RSS)
教程 / 实战精选
使用Claude Opus 4.8将书籍转化为AI技能的教程
本文以《非暴力沟通》为例,提供了一个将书籍转化为可调用AI技能(Skill)的六步教程。作者使用Claude Opus 4.8模型,因其具备100万token上下文窗口、结构化输出及多步智能体(Agent)能力,能一次性处理全书逻辑。流程包含文本准备、全局结构分析、五类提炼(框架/原则/技法/反模式/作者声音)、技能生成及关键的自检步骤。生成的技能保留了书中原始框架命名(如OFNR四要素、长颈鹿语言),并将触发词优化为"怎么提意见不像在指责"等日常表达。整个流程耗时约45分…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
行业动态精选
OpenAI在密歇根州启动Stargate 1GW数据中心建设
OpenAI在密歇根州启动了名为Stargate的1GW数据中心项目。作为AI基础设施建设的一部分,该项目旨在扩大人工智能技术的可及性、为当地创造就业机会并支持社区发展。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
行业动态精选
Runway 在伦敦设立欧洲总部及世界模型研究中心
Runway 宣布在伦敦建立新的欧洲总部和专注于通用世界模型的研究中心。公司计划在未来18个月向英国AI生态投资$100M,到2028年投资额将翻倍以上。过去12个月,其在欧洲的订阅销量增长了50%,企业客户占比超20%。新总部将扩大其在欧洲的研究与商业布局,公司正招聘欧洲负责人以组建跨研究、产品、工程和销售的团队,并深化与BBC、Fremantle、WPP等企业的合作。世界模型是其研究的核心,旨在将生成式AI的应用扩展至机器人、科学研究与工业模拟等领域。
信息来源:Runway:News(网页)
产品发布 / 更新精选
OpenAI前沿模型与Codex现可在AWS上使用
OpenAI的前沿模型与Codex现已在AWS上全面可用。企业客户可通过其现有的AWS环境、控制与采购流程来使用OpenAI的AI技术,从而加速从评估到生产部署的过程。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
腾讯混元发布智能体长期记忆插件Hy-Memory
腾讯混元正式发布专为OpenClaw等长期协作智能体(Agent)设计的记忆插件 Hy-Memory。它基于6层记忆框架、System1/System2双系统与三层进化链构建,旨在成为智能体的"第二大脑"。该插件解决了记忆碎片化问题,实现了显著性能提升:记忆数量减少70%以上,单条记忆信息密度提升45%以上,在超长上下文场景中token消耗降低35%,记忆更新速度提升20%。
信息来源:X:腾讯混元 (@TencentHunyuan)
产品发布 / 更新精选
Cursor Teams计划定价方案更新
Cursor Teams计划推出三项更新:增加Composer特定使用池,将第一方模型(Composer和Auto)与第三方API的使用额度分开计费;推出Premium席位,提供5倍于标准席位($40/月)的使用量,价格为$96/月(年付);仪表盘现可实时显示用户额度使用情况,管理员可通过Slack或邮件配置智能提醒。
信息来源:Cursor Blog · Cursor
行业动态精选
英伟达和台积电将 AI 引入晶圆厂,推动半导体设计与制造发展
信息来源:IT之家(RSS) · NVIDIA
论文研究精选
联合NVIDIA开源ClawHub技能安全扫描数据集
与 @nvidia 合作,我们开源了一个包含 67,453 个 @huggingface 上 ClawHub 技能安全扫描的数据集: - NVIDIA SkillSpector 标记出 1/2 的智能体风险 - 仅 0.31% 为恶意 - 没有两个扫描器在超过 8.5% 的风险上达成一致 https://openclaw.ai/blog/openclaw-nvidia-skill-security
信息来源:X:OpenClaw (@openclaw) · NVIDIA / Hugging Face
行业动态精选
介绍Cosmos Coalition
Runway宣布作为创始成员加入Cosmos Coalition,该联盟与NVIDIA及多家领先AI实验室合作,旨在构建并开源面向物理AI的前沿世界模型。首个项目将由Runway与NVIDIA共同开发一个基础模型,以推动下一代开放世界模型的研究与发展。
信息来源:Runway:News(网页) · NVIDIA
产品发布 / 更新精选
微软携手NVIDIA发布RTX Spark加速Windows智能
我们的目标是通过Windows,为每个家庭和每张办公桌提供无限制的智能。 NVIDIA RTX Spark 标志着朝着这一愿景迈出的真正突破。 期待在本周的Build大会上,与从台湾现场连线的黄仁勋分享更多内容!
信息来源:X:Satya Nadella (@satyanadella) · NVIDIA
模型发布 / 更新精选
黄仁勋:英伟达下一代 AI 超级芯片平台 Vera Rubin 全面投产
英伟达 CEO 黄仁勋在 2026 台北电脑展宣布,下一代 AI 超级芯片平台 Vera Rubin 全面投产。该平台是 POD 级基础架构,与上一代 Grace Blackwell 平台相比,其大规模智能体吞吐量提高了 10 倍。凭借开源 MGX 设计,其供应链规模是 Grace Blackwell 的两倍,产品预计于今年秋季开始发货。
信息来源:IT之家(RSS) · NVIDIA
模型发布 / 更新精选
MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型
MiniMax M3 是一个开源前沿模型,具备先进的编码与AI智能体能力。它支持100万token的超长上下文窗口,并采用名为MSA(MiniMax Sparse Attention)的新型稀疏注意力架构。该架构使模型在100万token上下文下的每token计算成本降至前代的1/20,预填充速度提升9倍以上,解码速度提升15倍以上。在SWE-Bench Pro编码基准上,MiniMax M3得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,性能接近Opus…
信息来源:MiniMax:Blog(网页) · GPT / Gemini
行业动态精选
上海:支持多模态智能体开发与应用,有序推进智能驾驶在共享出行、物流运输等多场景应用
上海市人民政府办公厅印发《上海市服务业发展"十五五"规划》,提出发展AI软件技术及服务产业集群。规划支持多模态智能体开发与应用,推动智能客服等工具规模化;有序推进智能驾驶在共享出行、物流运输等多场景应用;做强算运存协同布局的智算云网络,推广模型即服务(MaaS);并支持开发面向家庭、养老、文旅等场景的具身智能整机产品,加速机器人向通用智能与精细化服务跃升。
信息来源:IT之家(RSS)
模型发布 / 更新精选
Qwen3.7-Plus:多模态智能体模型发布
阿里云通义千问推出 Qwen3.7-Plus,基于 Qwen3.7 文本骨干,增强视觉语言能力,保留编码、工具使用和生产工作流的智能体能力。它支持感知现实场景、读取并操作 GUI、从视觉参考编写代码、端到端导航手机应用、基于网络知识回答视觉问题,融合 GUI 与 CLI 交互,跨 Claude Code、OpenClaw、Qwen Code 等框架泛化。在 Terminal Bench 2.0-Terminus 得分 70.3,SWE-Verified 77.7,QwenW…
信息来源:Qwen:Blog Retrieval(API) · Qwen / Claude
模型发布 / 更新精选
MiniMax M3 发布:前沿 Coding、1M 上下文与原生多模态集于一身
MiniMax 发布 M3 模型,采用全新稀疏注意力架构 MSA,支持 1M 上下文窗口,并原生支持图片、视频输入及电脑桌面操作,是国内首个齐备这些要素的开源模型。
信息来源:公众号:MiniMax(稀宇科技)
行业动态精选
全球首次:MWC26 上海将举办"人形机器人点球大战",宇树科技等 8 支队伍参赛、参演
全球首次"人形机器人点球大战"将于2026年6月在MWC上海举行。8支中国顶尖具身智能战队将进行自主对抗,无需人工操控或预设脚本。赛事旨在集中展示人形机器人在动态平衡、精准控制与自主决策等方面的技术突破。
信息来源:IT之家(RSS)
论文研究精选
NLP领域2018-2025年人类标注报告实践的大规模审计
本研究对NLP领域2018至2025年间的人类标注报告实践进行了首次大规模审计。研究构建并验证了一个LLM辅助提取管线,其在Annotated-gold数据集(41篇论文,72个标注任务)上与人工裁决的一致性(Krippendorff's alpha)达到0.606。基于此,研究构建了Annotated-llm数据集,涵盖ACL会议论文,从1603篇论文中提取了2667个标注任务。分析发现,论文常报告招募策略、标注者专长等操作细节,但经常遗漏评估标注效度所需的关键信息,如培…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
OpenRouter 5月发布亮点:语音与转录API、模型融合及20款新模型
OpenRouter 发布5月更新,推出语音与转录API、模型融合功能、私有模型支持和企业工作区控制,并新增20款模型,包括Gemini 3.5 Flash和Claude Opus 4.8。
信息来源:OpenRouter:Announcements(RSS) · Claude / Gemini
论文研究精选
AFUN: 迈向功能理解的可供性基础模型
AFUN是一个用于功能理解的可供性基础模型。它从单个RGB-D观察和语言任务描述出发,能同时预测任务条件的功能掩码(where)和3D接触后运动曲线(how)。为实现开放世界泛化,该研究构建了一个大规模标准化数据管道,整合了机器人、人类、仿真与真实扫描数据。评估结果显示,AFUN在可供性分割任务上,于4个基准的8个测试集中平均gIoU/cIoU指标分别大幅领先基线模型+23.9/+26.3;在接触点预测上,命中率比最佳基线高出12.7%-61.3%;在3D运动预测上也取得最…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
AI看跌情绪地图
金融市场对AI的看跌情绪正从整体上升转向板块分化。上季度,软件、半导体、云及超大规模公司的空头比例中位数上升约24%。GPU数据中心业务空头股份在过去一年激增60%。AI云与新型云公司的当前空头比例中位数最高,达16.8%,SaaS与开发工具领域随后,分别为9.5%和8.9%。相比之下,超大规模公司和NVIDIA的空头比例极低,仅为1.1%和1.2%。市场怀疑主要针对那些AI业务仍依赖未来资本、需求或运营杠杆的中小型公司。
信息来源:Tomer Tunguz 博客(VC 分析) · NVIDIA
产品发布 / 更新精选
OpenRouter 5月发布亮点
OpenRouter 发布5月更新,推出语音与转录API、模型融合(Model Fusion)功能,并为平台添加了私有模型和企业工作区管控能力。此次更新共上线20个新模型,其中包括 Gemini 3.5 Flash 和 Claude Opus 4.8。
信息来源:OpenRouter:Announcements(RSS) · Claude / Gemini
产品发布 / 更新精选
OpenRouter 五月发布亮点:语音API、模型融合、企业控制及20个新模型上架
OpenRouter 推出语音与转录 API、模型融合(Model Fusion)、私有模型部署和企业级工作空间控制功能。平台同时新增 20 个模型,其中包括 Gemini 3.5 Flash 和 Claude Opus 4.8。语音 API 支持实时语音识别与合成,模型融合允许用户组合多个模型的输出结果。企业工作空间提供更细粒度的权限管理与审计日志。
信息来源:OpenRouter:Announcements(RSS) · Claude / Gemini
论文研究精选
OpenWebRL:面向视觉网页智能体的在线多轮强化学习开源框架
OpenWebRL是一个用于在真实网站上通过在线多轮强化学习训练视觉网页智能体的开源框架,覆盖了完整的训练流程。基于该框架训练的OpenWebRL-4B模型,在仅使用0.4K条监督初始化轨迹和2.2K个开放式RL训练任务的情况下,在Online-Mind2Web基准上达到67.0%成功率,在DeepShop基准上达到64.0%,超越了同规模或更大规模的先前开源智能体,性能可与OpenAI CUA和Gemini CUA等闭源系统竞争。该工作为构建更强、可复现且高性价比的开源网…
信息来源:HuggingFace Daily Papers(社区热门论文) · OpenAI / Gemini / Hugging Face
模型发布 / 更新精选
xAI发布Composer 2.5
xAI的最新编程模型Composer 2.5现已在Grok Build中可用,用户可通过`/models`菜单选择使用。这是一款快速、先进的模型,擅长处理长时间运行的任务和复杂指令。该模型面向SuperGrok和X Premium+用户开放。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
本地设备 AI 图像生成模型 1-Bit Bonsai Image 4B 发布
1-Bit Bonsai Image 4B 是一款新的 AI 图像生成模型,其主要特点是面向本地设备进行优化,可以在用户的本地硬件上运行。这是一款专注于端侧部署的图像生成解决方案。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
OpenAI正式进军机器人领域并启动招聘
OpenAI宣布成立OpenAI Robotics团队,并开始招聘全栈硬件、系统及ML工程师,以编程和制造能服务社会的机器人。该项目由Aditya Ramesh领导,其世界模拟研究计划已演变为机器人研究,强调硬件与ML研究的协同设计。短期目标是支持技术工人构建未来基础设施,长期愿景是为每个人提供个人机器人。
信息来源:X:Sam Altman (@sama) · OpenAI
行业动态精选
Anthropic 保密向 SEC 提交 S-1 草案
Anthropic, PBC 今日保密向美国证券交易委员会提交了 S-1 表格草案,计划进行普通股的首次公开发行。这使其在 SEC 完成审核后拥有上市的选择权。IPO 的具体发行股数和价格尚未确定,将取决于市场条件等因素。公司近期刚完成由 Altimeter Capital 等领投的 650 亿美元 H 轮融资,估值达 9650 亿美元,并发布了 Claude Opus 4.8 模型。
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
Anthropic CEO Dario Amodei:AI指数级发展呼唤政策紧急应对
Anthropic CEO Dario Amodei 发表博客指出,AI 以指数级速度发展--四年内模型从勉强写出一行连贯代码到编写主流 AI 公司的大部分代码,而政策制定周期却极其缓慢。Claude Mythos Preview 证明了前沿模型对网络安全构成真实威胁,可能冲击金融、关键基础设施和国家安全。Amodei 认为生物风险与 AI 自主风险即将接踵而至,呼吁全球重新审视监管、宏观经济、科学创新、国家权力和地缘政治五大领域。Anthropic 同日发布了前沿模型测试…
信息来源:Dario Amodei:Blog(网页) · Claude
观点 / 方法精选
我花200英镑把一台数据中心级GPU装进了我的游戏电脑
一名用户以200英镑的价格购入了一块数据中心级GPU,并将其成功安装到自己的游戏电脑中。文章记述了这一非标准硬件改装过程、遇到的技术挑战以及最终实现本地运行大语言模型的体验。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Codex用量限制已重置,可尽情使用
所有付费ChatGPT订阅用户的Codex使用限制已重置。您现在应恢复至每周100%和每小时100%的限额。 让token今天创造不可思议的事,玩得开心。
信息来源:X:Tibo (@thsottiaux) · ChatGPT
产品发布 / 更新精选
OpenAI发布生物防御AI工具Rosalind
我们希望帮助世界在生物防御领域抢占先机:
信息来源:X:Sam Altman (@sama) · OpenAI