AI 情报文章归档
浏览 AI圈报 已保存的 5676 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5676
正式分类6
精选内容3361
全部文章
第 113 / 142 页 · 每页 40 条
行业动态精选
毕马威与Anthropic建立全球联盟,全面整合Claude AI模型
毕马威宣布与Anthropic建立全球联盟,将Claude人工智能模型全面整合至其核心业务与数字平台。此举将向毕马威全球超过27.6万名员工开放Claude访问权限,并率先应用于税务与法律等领域的客户工具开发。双方还将合作开发面向私募股权投资组合公司及网络安全漏洞检测的新产品。毕马威强调此次合作基于其可信AI框架,旨在通过负责任、可治理的AI部署,加速企业数字化转型。
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
Forge:通过防护机制大幅提升8B模型性能的可靠性层
Forge 是一个为自托管大语言模型设计的可靠性层,专注于提升工具调用能力。它通过错误解析、重试提示、步骤强制等防护机制以及高效的上下文管理,成功将8B参数模型在复杂多步骤智能体任务中的表现从53%大幅提升至99%。其核心配置(Ministral-3 8B模型)在自建的26项评估中综合得分达86.5%。Forge 提供三种集成方式:作为全托管工作流运行器、多智能体架构的共享调度器,或嵌入自有编排循环的防护中间件,并附带一个可透明接入的OpenAI兼容代理服务器。
信息来源:Hacker News:AI 热帖 · OpenAI
模型发布 / 更新精选
谷歌I/O大会发布Gemini 3.5 Flash
谷歌I/O 🔥:我们今天将迎来 Gemini 3.5 Flash! >; GEMINI >; GEMINI >; GEMINI >; GEM 👀 【引用 @AiBattle_】:Gemini 3.5 Flash 刚刚出现在 Google Cloud 控制台中 它来了
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
观点 / 方法精选
对话设计:塑造面向客户AI体验的五个模式
当生产环境的目标从功能准确性转向更好的对话时,哪些设计模式依然有效?文章提出五个对话设计模式,用于改善面向客户的AI体验,并探讨从精准应答到自然交互的实践路径。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
苹果发布全新辅助功能,并引入Apple Intelligence进行更新
苹果公司宣布推出由Apple Intelligence驱动的重大辅助功能更新。此次更新为VoiceOver、放大镜(Magnifier)和语音控制(Voice Control)功能引入了新的能力,旨在提升残障用户设备的可用性。这是苹果首次将Apple Intelligence应用于其辅助功能技术组合。
信息来源:Apple:Newsroom(RSS)
观点 / 方法精选
前高管称微软 AI 布局失利,Copilot 付费使用率不足 3%
微软前高管马特·韦洛索批评称,尽管微软与OpenAI合作在2023至2025年间获得约300亿美元营收,但相关成本高达1000亿美元,盈利前景不明。他指出,微软在AI布局上存在多项失误,包括押注必应搜索AI转型未增市场份额、Copilot付费用户实际使用率不足3%、人才任用不当等。虽然微软称Copilot企业付费用户已超2000万家,但市场对其AI巨额投入的盈利路径存在担忧。微软仍计划2026年在AI基础设施投入最高1460亿美元。
信息来源:IT之家(RSS) · OpenAI
行业动态精选
现代汽车集团计划部署 2.5 万台波士顿动力 Atlas 人形机器人
信息来源:IT之家(RSS)
观点 / 方法精选
我真的要吹爆HTML!
作者通过向Claude Code提供精确的提示词,仅用2分钟就生成了一个功能完整的交互式HTML项目计划页面。该页面为单文件、无外部依赖,包含暗色主题、时间线、可折叠表格等丰富交互,可直接交付。相比过去在Notion中耗费30-40分钟制作模板,效率提升了近20倍。其核心在于使用明确的提示词来规范视觉、内容结构与交互细节,确保AI一次性交付完整产物。这充分展示了在AI时代,HTML作为轻量、高保真生产力工具的巨大潜力。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
模型发布 / 更新精选
Qwen3.5-LiveTranslate:从声音到视觉,从词语到准确
Qwen3.5-LiveTranslate-Flash 是 Qwen 家族最新的同声传译模型,基于 Qwen3.5-Omni 架构,支持实时多模态翻译(音频、视频及视觉上下文)。语言覆盖大幅扩展:输入音频与输出文本从18种增至60种,输出音频从10种增至29种。采用 Readable Unit 技术,平均端到端每 token 延迟降至2.8秒,相比前代首 token 延迟降低3.45秒、每 token 延迟降低1.88秒。支持一句话启动的实时语音克隆和可动态配置的热词增强。…
信息来源:Qwen:Blog Retrieval(API) · Qwen
产品发布 / 更新精选
Claude智能体托管平台新增自托管沙箱与MCP隧道功能
Anthropic为其Claude智能体托管平台推出两项更新:自托管沙箱允许用户在自有基础设施或合作云平台上运行工具,确保敏感数据与服务保留在用户控制范围内;MCP隧道则通过轻量网关,使智能体能安全连接企业私有网络内的数据库与API,无需暴露于公网。目前沙箱功能已进入公测,隧道处于研究预览阶段。这两项更新进一步增强了企业用户对智能体执行环境与内部资源访问的安全管控能力。
信息来源:Claude:Blog(网页) · Claude
模型发布 / 更新精选
地平线开源 HoloMotion-1 4 亿参数机器人小脑大模型,可实现舞蹈、健身、搬箱子等动作
地平线机器人实验室发布了其开源的人形机器人全身控制模型 HoloMotion-1。这是一个拥有 4 亿参数的"小脑"大模型,通过 MoE 稀疏激活与 KV-cache 推理机制,在端侧实现了约 300FPS 的实时推理能力。该模型利用互联网视频、光学动捕、VR 遥操作等多种来源的动作数据进行训练,并在真实机器人上成功展示了舞蹈、爬行、健身、搬箱子等复杂动作的零样本迁移能力。相关代码与技术报告已公开。
信息来源:IT之家(RSS)
行业动态精选
Kimi最新融资获国资与央企加注,估值半年翻四倍
月之暗面旗下AI助手Kimi正在进行20亿美元新融资,国智投、中国移动等国资机构及央企已加入股东名单,该轮融资已进入收尾阶段。今年1月和2月,Kimi已密集完成3轮融资,累计融资超39亿美元(约376亿元人民币),最新估值相比去年11月已翻4倍有余,成为大模型创业公司中融资最多的企业。产品层面,基于Kimi K2.5模型的Composer 2.5已集成至编程应用Cursor,公司近期也发布了开源模型Kimi K2.6。
信息来源:IT之家(RSS) · Kimi / Cursor
论文研究精选
开源古代汉字视觉感知评估基准Chronicles-OCR
开源了评估视觉大语言模型(VLLM)对古代汉字视觉感知能力的基准测试Chronicles-OCR。该数据集覆盖了从甲骨文到草书的3000年演变历程,包含7种历史书体与2800张均衡图像。评估涵盖字形定位、细粒度识别、古代文本解析和字体分类四项核心任务,旨在探究视觉分布随时间的变化如何影响模型感知。相关论文与代码已开源。
信息来源:X:腾讯混元 (@TencentHunyuan)
行业动态精选
Anthropic联合创始人将与教皇利奥十四世共同发布人工智能通谕
Anthropic联合创始人将于2026年5月与教皇利奥十四世共同发布首个人工智能通谕"magnifica humanitas"。这是教皇利奥十四世的首次通谕,聚焦人工智能技术与伦理,标志着科技企业与宗教领袖在AI议题上的合作。通谕由梵蒂冈新闻发布,具体探讨人工智能对人类社会的影响,在Hacker News平台获得104点关注,反映了话题的广泛热度。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
行业动态精选
谷歌联手黑石组建 AI 云公司:50 亿美元起步,2027 年冲刺 500 兆瓦
谷歌与黑石集团宣布合作成立一家新的AI云服务公司,黑石率先投入50亿美元股权资本,结合后续杠杆,总投资规模预计约250亿美元。该公司计划依托谷歌自研的TPU芯片和云基础设施,与CoreWeave等算力服务商展开竞争,并争取在2027年上线容量达500兆瓦的数据中心,相当于一座中等城市的用电规模。此举标志着谷歌迄今最大规模的对外芯片商业化尝试,将加剧与英伟达等公司在AI算力市场的角逐。
信息来源:IT之家(RSS) · NVIDIA
产品发布 / 更新精选
Claude AI助手v2.1.144版本更新
Claude AI助手发布了v2.1.144版本。此次更新主要新增了对后台会话的`/resume`支持,并将"extra usage"更名为"usage credits"。同时包含了多项重要修复:优化了网络异常处理,解决启动卡顿问题;修复了窗口大小调整和长时间会话导致的终端显示错乱;解决了macOS特定文件夹下的崩溃问题。此外,还改进了模型选择持久化、文件读取、工具调用以及MCP服务器分页工具列表的处理,并减少了在VS Code中的渲染故障。本次更新显著提升了工具的稳定性和…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
论文研究精选
优化_anything:通用文本参数优化API
该研究提出了一种基于大语言模型的通用文本优化系统,将优化问题统一表述为通过评分函数改进文本产物。在六项任务中达到最优结果:智能体架构使Gemini Flash在ARC-AGI上的准确率从32.5%提升至89.5%;调度算法降低40%云成本;87%的CUDA内核匹配或超越PyTorch表现;圆包装问题超越AlphaEvolve。实验表明,可操作的附加信息比仅使用分数反馈收敛更快、得分更高;多任务搜索通过跨任务迁移学习,在同等预算下优于独立优化,且任务数量越多收益越大。该工作首…
信息来源:HuggingFace Daily Papers(社区热门论文) · Gemini / Hugging Face
论文研究精选
CopT:基于连续空间对比验证的在策略推理
CopT提出了一种反转传统链式思考(CoT)顺序的推理框架:先生成草稿答案,再进行策略内反思。其核心是将连续嵌入向量转化为推理时的对比验证器,通过比较模型在离散令牌与连续嵌入输入下对同一生成令牌的支持度,构建序列级反向KL估计器,以此评估答案的可靠性。当答案不可靠时,CopT会执行进一步思考,并利用第二个KL估计器动态控制草稿答案的可见性,在保留有用信息与规避误导间取得平衡。在无需额外训练的前提下,该方法在数学、编程等任务上显著提升了准确率(最高达23%)并大幅减少了令牌消…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
GoLongRL:面向能力的长期上下文强化学习与多任务对齐
GoLongRL是一个全开源的长期上下文强化学习方案,聚焦于使用可验证奖励的强化学习。该工作提出了面向能力的数据构建方法,公开发布了包含23K样本的数据集、完整构建管线及训练代码。数据集依据长期上下文能力分类,涵盖9种任务类型,由真实文档生成的问答对构成;实验证明该数据集性能优于闭源的QwenLong-L1.5数据集。训练得到的Qwen3-30B-A3B模型在长期上下文任务上达到了与DeepSeek-R1-0528等先进模型可比的性能。此外,提出了TMN-Reweight多…
信息来源:HuggingFace Daily Papers(社区热门论文) · DeepSeek / Qwen / Hugging Face
模型发布 / 更新精选
引入 Ettin Reranker 系列
Hugging Face 发布六个 Ettin Reranker 重排序模型(17m、32m、68m、150m、400m、1b),基于 Ettin ModernBERT 编码器,蒸馏 self-mxbai-rerank-large-v2 分数训练,在 MTEB(eng, v2) Retrieval 达各自规模 SOTA。模型以 Sentence Transformers CrossEncoder 接口提供,三行代码可调用。同时发布 train-sentence-transf…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
行业动态精选
明日10点见,I/O 2026预热开启
我们正在前往 I/O 2026 的路上。明天太平洋时间上午10点见!
信息来源:X:Sundar Pichai (@sundarpichai)
产品发布 / 更新精选
Claude Design 全面升级创作能力
现在你可以用 Claude Design 创作更多内容了。 我们已将所有套餐的 token 限制翻倍。
信息来源:X:Claude (@claudeai) · Claude
模型发布 / 更新精选
Qwen 3.7 预览版
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
产品发布 / 更新精选
xAI Grok创意套件三款新模型上线OpenRouter
@xai 的 Grok 创意套件中 3 款新模型现已在 OpenRouter 上线: • Grok Imagine Image Quality:照片级真实图像生成与编辑 • Grok Imagine Video:从文本、图像或参考生成短片 • Grok Voice TTS 1.0:支持 20 多种语言的 5 种语音 更多详情见下方 🧵
信息来源:X:OpenRouter (@OpenRouter) · Grok
行业动态精选
埃隆·马斯克对山姆·阿尔特曼和OpenAI提起的诉讼败诉
埃隆·马斯克对山姆·阿尔特曼及OpenAI提起的诉讼以败诉告终。这场广受关注的案件主要涉及人工智能公司OpenAI的创立初衷、公司治理结构以及未来发展方向等核心争议。法院的裁决标志着这一涉及商业、技术伦理与公司控制权的重大法律纠纷阶段性落幕。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
行业动态精选
陪审团一致同意:马斯克起诉OpenAI耗时过长
陪审团在裁决中一致认定,埃隆·马斯克对OpenAI提起的诉讼已超出合理时限。法官随后立即确认了该裁决。马斯克的法律团队计划就此提起上诉。这一决定可能涉及复杂的商业纠纷与知识产权争议的时间界限问题。
信息来源:Ars Technica:AI(RSS) · OpenAI
产品发布 / 更新精选
Claude控制台新增提示缓存诊断功能
提示缓存诊断现已在Claude控制台上线。 当请求未命中缓存时,您现在可以准确查看提示的哪一部分发生了变化,以及这消耗了多少令牌。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
将你的本地GitHub会话带到任何地方
GitHub为Copilot功能推出了远程控制会话能力,并已全面上线。该功能允许用户在VS Code或命令行中启动Copilot任务后,可随时随地通过github.com网站或GitHub Mobile移动端应用继续操作,实现了开发工作流从桌面端到移动端的无缝衔接。此更新增强了开发者在不同场景下的灵活性和工作效率。
信息来源:GitHub Blog
产品发布 / 更新精选
Grok Build 实战受赞,马斯克呼吁优化反馈
马斯克在推文中请求帮助提升 Grok Build。用户 @morganlinton 分享了使用 Grok Build 完成 PasteLocal 项目中 relay 功能开发的体验,称赞其全面性令人惊叹。该功能实现周期短,且包含了端到端加密、数据持久化、自动同步、双向命令行交互等关键技术特性,并经过了多轮严格的代码审查与修复。马斯克此举意在收集更广泛的反馈,以持续改进该开发工具。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
观点 / 方法精选
NVIDIA Cosmos Predict 2.5 微调:使用 LoRA/DoRA 生成机器人视频
NVIDIA Cosmos Predict 2.5 是一个 2B 参数的世界模型,可根据文本、图像或视频片段生成物理合理的视频。通过 LoRA 或 DoRA 在 DiT 的注意力层(to_q, to_k, to_v, to_out.0)和前馈层注入可训练适配器,冻结全部基座权重,在单个 80GB GPU 上即可完成参数高效微调,避免了全量微调的高成本与灾难性遗忘。该流程使用 diffusers 和 accelerate 库,利用 92 个机器人操作视频训练集与 50 个 (…
信息来源:Hugging Face:Blog(RSS) · NVIDIA / Hugging Face
产品发布 / 更新精选
经验研究助手(ERA):从Nature发表到催化计算发现
Google Research开发的经验研究助手(ERA)现已在《Nature》期刊发表论文。这是一款基于Gemini的AI工具,旨在协助科学家编写专业级经验科学代码,其核心能力包括搜索文献、生成代码、探索方案并迭代优化,以加速耗时的计算实验过程。该工具已被用于构建"计算发现"原型,并已通过Google Labs的"可信赖测试者计划"向更广泛的科学家群体开放初步试用。
信息来源:Google Research:Blog(网页) · Gemini
产品发布 / 更新精选
更智能的 Google AI Edge Gallery:MCP 集成、通知和会话连续性
Google AI Edge Gallery 应用在安卓平台上扩展了设备端 AI 能力,通过引入对开源模型上下文协议(MCP)的实验性支持,使得 Gemma 4 模型能够协调处理跨 Google Workspace 和 Google Maps 等外部数据源的复杂任务。此次更新添加了"定时通知"技能,用于实现日常事务的自动化管理,并新增了持久化聊天记录功能,允许用户近乎即时地恢复长会话上下文。该平台依托开源工具包,积极鼓励社区开发者通过其 GitHub 仓库构建并分享专注实用…
信息来源:Google Developers Blog(RSS)
观点 / 方法精选
拓宽关于前沿AI的对话
Anthropic为构建负责任的先进AI,正与全球多元群体展开对话。首轮讨论汇集了超过15个宗教、哲学及跨文化传统的学者与伦理学者,旨在为Claude等模型的道德形成与价值观对齐提供多元视角。受"外部良知"概念启发,团队开发并测试了伦理承诺提醒工具,初步实验显示其能有效降低模型不对齐行为。公司计划未来将对话拓展至法律、心理学及公民社会等领域,以共同应对AI对社会结构的重塑。
信息来源:Anthropic:Newsroom(网页) · Claude
行业动态精选
创新一周年:庆祝Google Cloud x NVIDIA开发者社区达到10万会员
Google Cloud与NVIDIA开发者社区迎来成立一周年,会员规模突破10万。社区为开发者提供先进AI基础设施与资源支持,包括LLM优化、GPU加速数据分析等专项学习路径及专家网络研讨会。第二年计划将进一步扩展,推出实践实验室、工程活动及聚焦代理式AI增长的专项内容。
信息来源:Google Developers Blog(RSS) · NVIDIA
产品发布 / 更新精选
重要更新:Gemini CLI将迁移至Antigravity CLI
Google正在整合其AI终端工具,将面向社区的Gemini CLI迁移至全新平台Antigravity CLI。这款新工具采用Go语言开发,作为代理优先的平台,支持复杂的多代理工作流,并提供更快的执行速度、异步处理能力以及与Antigravity 2.0桌面应用同步的统一架构。企业客户可维持现有访问权限,但个人及免费用户必须在2026年6月18日Gemini CLI停止服务前,完成向新平台的迁移。
信息来源:Google Developers Blog(RSS) · Gemini
产品发布 / 更新精选
在OpenClaw中使用Grok
5月22日,xAI宣布,其用户现可在开源个人助理OpenClaw中直接使用Grok模型。所有持有SuperGrok或X Premium订阅的用户均可使用该功能。OpenClaw是一个开源的、本地优先的智能助手,可在多种硬件上运行并保持跨会话记忆,同时能接入WhatsApp、Telegram等多款主流通讯平台。用户通过简单安装和登录,即可在自有设备上运行OpenClaw,并通过其界面或关联的聊天工具与Grok交互。此举进一步扩展了Grok的应用场景,未来还将推出更多开源代理与…
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Google Tensor ML SDK 测试版发布
Google Tensor ML SDK 进入测试版,支持开发者直接在 Pixel 10 设备的 TPU 上构建和部署高性能机器学习模型。该 SDK 集成边缘部署框架 LiteRT,提供统一工作流,可高效转换、编译并运行 PyTorch 或 TFLite 模型,并具备稳定回退机制。此外,新推出的模型库包含超过 100 个经典及生成式 AI 模型(如 Gemma 3),支持低延迟、注重隐私的语音识别、计算机视觉与文本生成等功能。
信息来源:Google Developers Blog(RSS)
教程 / 实战精选
Claude Code大规模部署最佳实践指南
在大规模运行Claude Code有哪些最佳实践? 关于我们从团队在数百万行单体仓库、数十年历史的遗留系统和分布式微服务中运行的经验总结,新博客文章已发布: https://claude.com/blog/how-claude-code-works-in-large-codebases-best-practices-and-where-to-start
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
观点 / 方法精选
InsForge:面向编程智能体的一体化开源后端平台
InsForge是一个专为AI编码智能体设计的一站式开源后端平台。它通过MCP Server和CLI+Skills两种接口,让智能体能像后端工程师一样直接操作数据库、认证、存储、边缘函数、模型网关等全套后端服务,从而端到端地构建全栈应用。平台支持云托管与基于Docker的自托管,可一键部署至Railway、Zeabur等主流平台。
信息来源:Hacker News:AI 热帖
产品发布 / 更新精选
PaddleOCR 3.5:使用Transformers后端运行OCR和文档解析任务
PaddleOCR 发布 3.5 版本,正式将 Transformers 确立为运行 PP-OCRv5 及 PaddleOCR-VL 1.5 模型的可选推理后端之一。此次更新引入了更灵活的 `engine` 与 `engine_config` 参数,允许开发者自主选择后端并配置数据类型、设备等选项。其核心价值在于,显著降低了将文档处理能力集成至以 Transformers 为中心的主流开发栈(如 RAG、智能体、文档AI)的门槛,使开发者能更便捷地利用现有生态,减少集成阻力…
信息来源:Hugging Face:Blog(RSS) · Hugging Face