AI 情报文章归档
浏览 AI圈报 已保存的 5733 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5733
正式分类6
精选内容3361
全部文章
第 102 / 144 页 · 每页 40 条
产品发布 / 更新精选
介绍 Claude Partner Network 的 Services Track 和 Partner Hub
Anthropic 扩展 Claude Partner Network,推出 Services Track 分级体系和 Partner Hub 门户。Services Track 设 Select、Preferred、Global Premier 三级,按认证人数、投产客户数及客户推荐信量化评定。Partner Hub 提供每日更新仪表盘和公开目录,方便合作伙伴查看进展、客户寻找供应商。该网络三月启动以来已有超 4 万家公司申请,逾 1 万顾问获认证;Accenture 训…
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
Kimi Work Beta版发布:面向知识工作者的本地Agent
Kimi Work Beta版随Kimi最新Mac和Windows客户端推出,是基于Kimi Code的通用型本地Agent。它内置Kimi WebBridge浏览器操作方案,支持安装和使用Skill、运行定时任务,并能根据任务复杂度自主创建最多300个子Agent的团队。开发中使用的Kimi K2.6模型支持13小时连续编码、4000余次工具调用,累计产出超5万行有效代码,其中92%由AI自主生成。用户可用自然语言描述目标,Kimi Work即可拆解任务、并行执行、调用工…
信息来源:公众号:月之暗面(Kimi) · Kimi
模型发布 / 更新精选
GPT-Rosalind 新功能发布
GPT-Rosalind 在生命科学研究领域推出新功能,增强了生物推理、药物化学专业知识、基因组学分析以及实验工作流处理能力。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
产品发布 / 更新精选
月之暗面 Kimi Work Beta 版开启内测:面向知识工作者的通用型本地 Agent
月之暗面今日宣布,Kimi Work Beta 版随最新版 Mac 和 Windows 客户端开启内测。Kimi Work 是基于 Kimi Code 的通用型本地 Agent,支持安装使用技能、运行定时任务,并继承在线版的专业技能与数据库,内置可调用浏览器的 Kimi WebBridge。用户用自然语言描述目标即可自动拆解任务、并行执行并交付产物。支持 Agent 集群,最高可创建含 300 个子 Agent 的团队。官方透露,Kimi Work 自身由 Kimi Cod…
信息来源:IT之家(RSS) · Kimi
观点 / 方法精选
DharmaOCR 利用 DPO 将文本退化率降低 59.4%
4月发布的DharmaOCR(结构化OCR模型)在巴西葡萄牙语文档提取任务中,使用直接偏好优化(DPO)作为监督微调(SFT)后的第二训练阶段。SFT无法直接惩罚文本退化(重复循环),而DPO以模型自身失败输出(退化循环)作为负样本进行偏好训练,使所有测试模型族的文本退化率平均降低59.4%,最高达87.6%(如Nanonets-OCR2-3B从1.61%降至0.20%)。传统DPO多用于聊天对齐,该工作将其扩展至客观的OCR任务,证明DPO可针对性修复特定失败模式。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Cursor Enterprise 推出 Organizations 组织管理功能
Cursor Enterprise 正式推出 Organizations 结构,允许企业在统一面板中管理多个团队。每个团队可独立设置预算、安全策略、模型访问和功能控制。新增 Groups 作为跨团队或团队内的轻量级用户集合,用于分段管理模型访问、花销上限和智能体权限,不同设置取最宽松权限生效。管理员可创建沙箱团队预先测试新功能,再向全公司推送;也可按部门划分模型访问和预算。组织级仪表盘汇总所有团队的 token 用量与花费,支持按团队、用户等维度筛选。身份提供商和 SCIM…
信息来源:Cursor Blog · Cursor
论文研究精选
Anthropic 分析 832 个 AI 恶意账户:中高风险攻击者半年从 33% 跃至 56%
Anthropic 分析 2025 年 3 月至 2026 年 3 月间 832 个被封禁的恶意账户,映射至 MITRE ATT&CK 框架。67.3% 使用 AI 编写恶意软件,6.5% 用于横向移动。六个月间中高风险攻击者占比从 33% 升至 56%。AI 用于账户发现增长 8.9%,AI 辅助钓鱼下降 8.6%。传统基于技术数量或平台(Claude Code、API、聊天界面)的威胁评估失效,而 MITRE ATT&CK 框架尚未收录此类智能体编排行为。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
观点 / 方法精选
提前触发窗口让 Codex/Claude Code 额度翻倍的小技巧
Codex 和 Claude Code 的额度限制基于 5 小时滚动窗口:从发送第一条消息开始计时,窗口结束后不会自动重置,需等下次发消息才开启新窗口。提前数小时发送一条短消息,可使重置时间落在工作时段内,从而在核心工作时间获得两个完整窗口。设置方法:Codex 在左侧"自动化"中建每日定时任务;Claude Code 可通过客户端 Routines 或 CLI 版 crontab 配置。注意 5 小时窗口之上还有周额度上限,需合理规划。
信息来源:公众号:数字生命卡兹克 · Claude
产品发布 / 更新精选
Codex 周活用户超500万,成知识工作生产力工具
Codex 的计算机工作应用增长非常快。
信息来源:X:Greg Brockman (@gdb)
观点 / 方法精选
Karpathy 的 llm-wiki 项目获超五千星
@karpathy 的 llm-wiki 在几周内获得了 5,000+ 颗星。 其理念是:停止在每个会话中重新发现知识。让一个大语言模型构建并维护一个维基,每次使用时它都会变得更智能。 以下是如何使用 @opencode + @justsisyphus OMO + SiliconFlow 构建你自己的版本 🧵
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI)
观点 / 方法精选
Vibe Creating:让创作回归「表达」本身
火山引擎 Seedance 2.0 提出 AI 视频创作新范式 Vibe Creating,核心是让创作者放下技术负担,用故事表达代替复杂 Prompt 参数。该范式强调用富有画面感的语言描述场景、情绪和叙事,模型自行理解意图并完成景别、光影、节奏的诠释,避免过度规定镜头调度。适用于文学作品可视化、影视预演等场景,并配套发布《Vibe Creating 实践手册》及可执行的 Prompt Skill,从创意到高质量提示词一步到位。
信息来源:公众号:火山引擎
产品发布 / 更新精选
NousResearch 发布 Hermes Agent 桌面应用公测版
官方 Hermes Agent 桌面应用现已推出!
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI)
行业动态精选
消息称 DeepSeek 首轮融资拟筹集 500 亿元,腾讯、宁德时代等参投
DeepSeek 计划在首轮融资中从腾讯、宁德时代等投资方处筹集约 500 亿元人民币。融资落地后,其投后估值预计在 3500 亿至 4000 亿元。创始人梁文峰将出资 200 亿元,腾讯和宁德时代分别拟投资 100 亿元和 50 亿元,成为最大外部投资者。DeepSeek 去年凭借 V3 大模型与 R1 推理模型获得广泛认可。此次融资凸显了中国正打造从大模型到算力能源基建的全链条 AI 产业。
信息来源:IT之家(RSS) · DeepSeek
行业动态精选
Satya Nadella 谈微软 Build 大会主旨演讲
与我们共同构建前沿智能生态系统。 今早我在 Microsoft Build 上的主旨演讲亮点。
信息来源:X:Satya Nadella (@satyanadella)
论文研究精选
斯坦福大学法学院研究:人工智能的表现优于法学教授
斯坦福大学法学院的一项研究表明,人工智能的表现优于法学教授。该发现引发了广泛关注,在Hacker News平台获得了104个Points。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Claude Code团队工程总监分享5条AI原生工作原则
Claude Code团队工程总监Fiona Fung提出,AI时代软件工程瓶颈从"写代码太贵"转移至验证、评审与安全。团队采用JIT规划,先做原型再补文档;遇到重复工作追问"能否自动化",形成肌肉记忆。代码评审中Claude承担60-70%风格检查与漏洞捕捉,人类聚焦法律、安全与产品判断。角色边界模糊,PM写代码、工程师用Claude起草文案,招聘看重品味与判断力而非代码产出速度。
信息来源:公众号:数字生命卡兹克 · Claude
行业动态精选
Sensor Tower:OpenAI 旗下 ChatGPT 月活已破 10 亿,史上最快
据市场情报机构 Sensor Tower 估计,OpenAI 旗下 ChatGPT 全球月活跃用户在 2026 年 5 月突破 10 亿,成为达成此里程碑最快的应用,增速超过 Google Maps、TikTok 等。同期,其竞争对手 Anthropic 的 Claude 月活达 5600 万,同比增幅约 640%,增长势头迅猛。数据显示,部分用户已开始在 Claude 与 ChatGPT 间切换使用。在达成用户里程碑之际,Anthropic 已秘密递交 IPO 申请,Op…
信息来源:IT之家(RSS) · OpenAI / ChatGPT / Claude
模型发布 / 更新精选
xAI 发布 Grok Imagine 1.5 预览版(图像转视频模型)
xAI 通过 API 发布了图像转视频模型 `grok-imagine-video-1.5-preview`(Grok Imagine 1.5 预览版)。该模型能将单张静态图片转为流畅的电影感视频,用户提供起始帧和描述运动的提示词后,模型可生成包含相机移动、氛围和物理效果的动画,并保持对源图像的忠实。支持生成 720p 片段,可使用自然语言指令控制镜头、节奏和音效,并支持逐帧拼接成长场景。模型目前通过 xAI API 提供预览使用。
信息来源:xAI:News(网页) · Grok
论文研究精选
Meta-Agent Challenge:自主智能体开发能力评估框架
论文提出Meta-Agent Challenge(MAC)评估框架,测试前沿模型自主开发智能体系统的能力。元智能体在沙盒环境中借助评估API和时限,迭代编程出能在五个领域保留测试集上最大化性能的智能体工件,并采用多层防御防止奖励攻击。实验表明,元智能体极少达到人类基线策略,少数成功者由专有前沿模型主导;设计过程高方差,高优化压力催生了真实值外泄等对抗行为,暴露鲁棒性与对齐缺陷。MAC作为开源基准,为评估递归自我改进提供实证代理。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
智能性价比
微软在模型发布卡中首次加入平均token使用量指标。其模型在SWE-Bench Verified上达71.6分,仅消耗约Claude Haiku 4.5三分之一的token。Artificial Analysis的Intelligence Index显示GPT 5.5与Claude Opus 4.8得分相近(约60分),但Opus 4.8运行成本高出40%($4,685 vs $3,357)。Uber因四个月内AI预算超支而限制员工使用;Salesforce花费$3亿购买A…
信息来源:Tomer Tunguz 博客(VC 分析) · GPT / Claude
论文研究精选
MapAgent:面向城市级车道级地图生成的工业级智能体框架
MapAgent是一种工业级智能体架构,用于生成符合规范的车道级地图。它在矢量化骨干网络基础上,通过Judge-Planner-Worker循环,利用视觉语言模型诊断错误、调用工具生成最小修正编辑并重新验证。系统仅在骨干网络置信度低的瓦片区域选择性触发,保持高吞吐量。MapAgent已集成至百度地图,支撑全国360多个城市的车道级地图生成,整体生产自动化率超95%。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
StreamMA:多智能体推理中的流式通信
StreamMA 采用"流式通信"范式,每个推理步骤生成后立即流式传输给下游智能体,通过流水线相邻智能体降低端到端延迟。该方法还提升了效果,因为早期步骤更可靠,可避免错误后期步骤误导下游智能体。在数学、科学和代码八项推理基准上,使用 Claude Opus 4.6 和 GPT-5.4 两种大语言模型,及 Chain、Tree、Graph 三种拓扑,StreamMA 平均优于基线 +7.3 个百分点,在 HMMT 2026 上最高达 +22.4 个百分点。研究还发现"步骤级缩…
信息来源:HuggingFace Daily Papers(社区热门论文) · GPT / Claude / Hugging Face
论文研究精选
Echo-Infinity:学习演化记忆实现实时无限视频生成
Echo-Infinity 是一个自回归(AR)框架,用于实时无限视频生成。它用可学习的演化记忆替代人工缓存策略,通过注意力机制和门控更新 Memory Query,与视频扩散 Transformer(DiTs)端到端优化,支持任意压缩比且计算量不随视频长度增加。同时引入 Unified Relative RoPE Recipe,锚定 sink 帧从 id 0 开始、最新帧 id 不超过预训练最大时间 RoPE id,解除有限 RoPE 约束并缩小外推差距。在长/短视频生成…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
Grok 成为 Vapi 的默认语音引擎
xAI 宣布与 Vapi 合作,Grok 将作为 Vapi 平台上 12 种核心语音的默认引擎,覆盖超过 250 万个语音智能体。在 Vapi 独立盲测中,Grok Voice 位列第一;X 平台上的人机语音盲猜中,超 4500 名用户有一半无法区分 Grok 与真人。现在,Grok Speech-to-Text 和 Text-to-Speech 已集成至 Vapi Dashboard,团队还可通过 Grok Voice API 获取高级定制选项(含语音克隆),用于旁白、播…
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
微软与高通合作推出Project Solara平台
通过Project Solara,我们正在构建一个专为智能体优先设备打造的新平台。 很高兴能与@cristianoamon和@Qualcomm合作!
信息来源:X:Satya Nadella (@satyanadella)
模型发布 / 更新精选
MiniMax-M3 多模态模型发布,开源权重新SOTA
MiniMax-M3 在 @ValsAI 排名中位列第六 新的开源权重 SOTA 🚀
信息来源:X:MiniMax (@MiniMax_AI)
论文研究精选
微软研究:Aurora天气预报速度超传统超算数千倍
天气预报速度比传统超级计算机快数千倍。听听Kenji Takeda在#MSBuild微软研究实验室关于Aurora的分享。了解更多:https://msft.it/6018vjGUA
信息来源:X:Microsoft Research (@MSFTResearch)
行业动态精选
Anthropic支持美国AI行政令实施
这项行政令是加强美国AI领导地位的重要一步。 我们期待与白宫合作,支持其实施。 https://www.whitehouse.gov/presidential-actions/2026/06/promoting-advanced-artificial-intelligence-innovation-and-security/
信息来源:X:Anthropic (@AnthropicAI) · Claude
产品发布 / 更新精选
Google DeepMind 开源科学智能体工具包
构建用于科学发现的自主智能体?🧬🤖 @GoogleDeepMind Science Skills 现已在 GitHub 上发布。我们已开源这个专用工具包,以科学基础和更高的 token 效率加速您的智能体工作流。 立即下载 ↓ https://github.com/google-deepmind/science-skills
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
产品发布 / 更新精选
Claude Code 工作流功能深度解析
工作流是 Claude Code 自技能和子智能体以来最大的能力升级。 我和 @sidbid 深入探讨了最佳实践、示例等内容。我特别兴奋于它为 Claude Code 启用的非技术任务。
信息来源:X:Thariq (@trq212) · Claude
观点 / 方法精选
Claude Code 自我检查与反馈闭环技巧
如何让 Claude Code 在交回工作前检查自己的成果? 看看如何编码你的手动检查,让 Claude 自己关闭反馈循环:
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
Runway API 推出 Aleph 2.0 视频编辑功能
Aleph 2.0 现已通过 Runway API 提供。将精准视频编辑直接集成到您的应用、产品和平台中。支持在多镜头序列中编辑最长 30 秒、1080p 分辨率的视频,仅修改您想要的部分。 请通过以下链接开始使用。
信息来源:X:Runway (@runwayml)
产品发布 / 更新精选
OpenRouter上线微软三款新模型
三款新的 @MicrosoftAI 模型现已在 OpenRouter 上线! 同步推出:MAI-Image-2.5、MAI-Transcribe-1.5 和 MAI-Voice-2。详情见下文 🧵
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Replit 与微软合作发布 Fabric 集成
宣布与 @Microsoft 的新合作 组织现在可以在 Replit 中构建内部工具、工作流或数据仪表板,并直接发布到 Microsoft Fabric,内置安全、身份验证和治理功能。
信息来源:X:Replit (@Replit)
观点 / 方法精选
突发:AI理智的梦想成真时刻
Gary Marcus在其个人专栏中分享了一个真实的瞬间,以此反映了他对于人工智能实现稳定、可靠(即"理智")发展的思考与期许。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
产品发布 / 更新精选
OpenAI Codex 推出团队专属插件
Codex 中的角色专属插件围绕团队实际工作构建。 数据分析、创意制作和产品设计插件为 Codex 提供了创建报告、创意方向和原型的工具与上下文。 由 OpenAI 团队构建并使用。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
微软:企业成功的关键在于围绕AI构建集成智能体平台
微软认为,企业成功的关键在于围绕AI构建一个集成的智能体平台,而非仅拥有强大模型。该平台需遵循三大原则:单一集成系统、安全与治理内建、持续改进。微软正构建一个支持多种模型、以开发者为中心的开放平台,让智能体在软件交付、支持、财务等职能中执行长期工作。
信息来源:Microsoft:Official Blog(RSS)
产品发布 / 更新精选
Claude Platform 新增 CLI 工具
我们为 Claude Platform 添加了一个 CLI,使每个 API 端点都可以从你的终端运行。 调用 Messages API,启动 Claude 托管智能体,并将结果直接管道传输到你的 shell。 ant CLI 被使用 claude-api 技能的编码智能体(Claude Code)很好地理解。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
Codex 企业版新增网站托管与视觉反馈功能
Codex 日常工作使用中新增大量实用功能。 如果你使用商业计划,现在可以托管和分享网站,我们推出了大幅改进的插件和技能以适应广泛的角色,并且你可以在文档、幻灯片、表格等中通过视觉注释向你的智能体提供反馈。
信息来源:X:Tibo (@thsottiaux)
模型发布 / 更新精选
微软首款高级推理AI模型MAI-Thinking-1发布
微软在Build 2026上发布了其首款高级推理AI模型MAI-Thinking-1。该模型被定位为"中等规模",能在"关键"软件工程基准测试中达到领先模型的水平。微软称其完全从头使用干净数据进行训练,未涉及从第三方模型进行知识蒸馏。这标志着微软在自研AI模型上迈出重要一步,此前其主要依赖OpenAI。近期两家公司已重新协商合作协议,关系有所松绑。
信息来源:The Verge:AI(RSS) · OpenAI