AI 情报文章归档
浏览 AI圈报 已保存的 5711 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5711
正式分类6
精选内容3361
全部文章
第 105 / 143 页 · 每页 40 条
观点 / 方法精选
免费领取6个月ChatGPT Pro及AI工具思考
OpenAI为开源项目维护者提供福利,可免费领取6个月ChatGPT Pro(价值$1200),申请无硬性Star数要求,有项目链接即可。同时,文章引用讨论了AI工具的分类:一类是"agent型"(如Claude Code、Codex),可自主运行;另一类是"实习生型"(如Cursor),需人工决策,有助于使用者以术入道、培养判断力,但受限于需人在场。作者推荐了网易的UU远程工具,称其免费两年,支持4K 144帧无延迟连接Mac并可使用原生终端,解决了"实习生型"工具的地点…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI / ChatGPT / Claude
行业动态精选
AI 骗子正在创建虚假的黑人形象来销售 Shein 劣质商品
有卖家利用 AI 生成虚假的黑人形象,在 TikTok、Facebook 和 Instagram 上扮演手工制品创作者进行销售。例如一个名为 Aliyah 的 AI 生成形象,以带泪诉说的方式售卖所谓手工皮带扣,但该形象及其产品均为虚构。此类 AI 虚拟网红被用于推广通过代发货模式销售的批量生产品。
信息来源:The Verge:AI(RSS)
模型发布 / 更新精选
Nano Banana Pro与Nano Banana 2正式发布
ICYMI:Nano Banana Pro 【gemini-3-pro-image】 和 Nano Banana 2 【gemini-3.1-flash-image】 现已正式发布,可通过 Gemini API 投入生产使用。 查看这些优秀的社区示例,了解两个模型的实际能力 🧵
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
行业动态精选
xAI放弃JAX GPU转向自研训练框架
突发新闻:JAX NVIDIA GPU & XLA:GPU最大客户刚刚宣布已放弃JAX GPU,宁愿用Grok Build"氛围编程"一个C训练框架。据报道xAI的JAX堆栈MFU低于10%。NVIDIA JAX团队过去两年全部主力996专注于支持xAI却失败了,我想他们现在可以休息并兑现期权了。
信息来源:X:SemiAnalysis (@SemiAnalysis_) · Grok / NVIDIA
产品发布 / 更新精选
ComfyUI现已支持OpenRouter模型直接调用
现在你可以直接在ComfyUI工作流中使用你的OpenRouter模型了! 【引用 @ComfyUI】:ComfyUI刚刚添加了@OpenRouter支持。 你不再局限于单一的大语言模型,现在可以直接在Comfy中访问20多个模型。 更多灵活性,更少摩擦,同样的工作流。 工作流链接在下方👇
信息来源:X:OpenRouter (@OpenRouter)
教程 / 实战精选
这个 skill 看着不错,可将文字、URL 或文章直接生成公众号首图、小红书图文卡、教程步骤卡等视觉物料,支持 28 种布局和 10 种主题。
claude-design-card 是一款专为中文内容创作者设计的 Skill。它能将文字、URL 或文章直接转化为可发布的视觉卡片,如公众号首图、小红书图文卡、教程步骤卡等,支持 28 种布局与 10 种主题。其核心价值在于自动化了"写完文章"后最繁琐的流程:自动提炼重点、选择版式、生成 HTML 并截图成 PNG,替代了以往手动使用 Figma 或 Canva 等工具的步骤。该工具开源,适合经常撰写相关内容的创作者尝试。
信息来源:X:洪明 (@hongming731) · Claude
产品发布 / 更新精选
Codex可自主管理对话线程与并行任务
Codex用于管理Codex界面: 【引用 @guinnesschen】:如果你厌倦了管理Codex对话线程,就让Codex自己管理自己吧!Codex现在可以创建对话线程、搜索它们、整理它们、固定重要的线程,并为并行任务启动工作树。
信息来源:X:Greg Brockman (@gdb)
模型发布 / 更新精选
Liquid AI 公布了在 38T 数据集上训练的 8B-A1B MoE 模型
Liquid AI 发布了其 LFM2-5 系列的 8B-A1B 模型,该模型采用混合专家(MoE)架构,在包含 38T token 的数据集上训练完成。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
ChatGPT长对话新增目录导航功能
为每个始于"就问一句"却演成长篇大论的ChatGPT对话:目录功能现已上线。 适用于包含5条以上回复的对话。
信息来源:X:Greg Brockman (@gdb) · ChatGPT
产品发布 / 更新精选
ChatGPT对话目录功能现已上线
对于每个始于"就问一件事"却演变成完整长篇的ChatGPT对话:目录功能现已推出。 适用于包含5条以上回复的对话。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT
产品发布 / 更新精选
v2.1.157 更新
此版本主要改进了插件系统,现可自动加载 `.claude/skills` 目录中的插件,并通过 `claude plugin init` 创建;`/plugin` 命令增加了自动补全。`claude agents` 现在会应用 `settings.json` 中的 `agent` 字段,并支持 `--agent` 参数覆盖。更新修复了多个具体问题,包括处理不可用图片导致的崩溃、在 tmux 中的剪贴板复制失效(2.1.153 回归)、后台会话恢复后日期不正确等。此外,优化了…
信息来源:Claude Code:GitHub Releases(RSS) · Claude / Cursor
产品发布 / 更新精选
Runway API持续扩展模型与端点支持
我们持续为 Runway API 添加新模型和端点,以便您能将最佳生成能力直接集成到应用、产品和平台中。通过 Runway API,您可以在一个地方获得所需的所有模型,包括 Seedance 2.0、GPT Image 2、HappyHorse 1.0、Nano Banana Pro、Magnific Precision Upscaler V2 等更多内容。请通过下方链接开始使用。
信息来源:X:Runway (@runwayml) · GPT
模型发布 / 更新精选
OpenAI推出实时翻译模型,支持70+语言输入
OpenAI 实时翻译功能--使用70多种输入语言说话,翻译成13种输出语言: gpt-realtime-translate 接收任意语言的语音输入,并输出目标语言的语音。 大语言模型很棒,但特定用例需要专用模型。 我们正在智能眼镜上运行此功能。
信息来源:X:Greg Brockman (@gdb) · OpenAI / GPT
观点 / 方法精选
参与我们的 I/O 2026 测验:该测验由 Google AI Studio 氛围编程生成
Google 使用其开发工具 Google AI Studio,通过氛围编程(vibe coding)方式,创建了一个关于 Google I/O 2026 主要公告的在线测验。
信息来源:Google Blog:AI(RSS)
产品发布 / 更新精选
Gemini Omni可将草图变为现实
Gemini Omni甚至能将简单的草图变为新的现实。 在Gemini应用中亲自尝试。上传一段有人画圆的视频,然后输入这个提示词:当我画完这个圆时,它变成了___。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
Opus 4.8支持对话中途添加系统指令
使用 Opus 4.8,您可以在对话中途添加系统指令,而不会破坏提示词缓存。 更多缓存命中意味着您的 API 请求成本更低、延迟更小。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
Codex Windows端重大升级,支持计算机操作与移动端协同
Codex 用户在 Windows 上迎来重大升级: 现在计算机操作功能已在 Windows 上可用,Codex 可以在你的 Windows 电脑上执行操作。 同时,ChatGPT 移动应用中的 Codex 也支持 Windows,让你可以随时随地启动、审查和引导任务,而工作则在你的 Windows 机器上继续进行。 这是一次早期体验,但我们正在努力提供更多方式,让你无论身在何处都能保持工作推进。
信息来源:X:Greg Brockman (@gdb) · ChatGPT
产品发布 / 更新精选
Codex现已支持Windows端计算机使用功能
Windows用户,这条消息是给你的。 计算机使用功能现已在Windows上可用,因此Codex可以在你的Windows电脑上执行操作。 通过ChatGPT移动应用中Codex的Windows支持,你可以在工作继续在Windows电脑上进行时,随时随地启动、审查和引导任务。 这是一项早期体验,但我们正在努力提供更多方式,让你的工作无论身在何处都能持续进行。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT
产品发布 / 更新精选
OpenRouter融合预算模型性能超越GPT-5.5与Claude Opus 4.7
一组预算模型通过OpenRouter平台进行模型融合,在包含100个复杂研究任务的评估中,得分超过了GPT-5.5与Claude Opus 4.7。
信息来源:OpenRouter:Announcements(RSS) · GPT / Claude
观点 / 方法精选
当公司过于"AI上瘾"时会发生什么?
Box创始人Aaron Levie指出,决定用AI替代员工的人往往最不了解工作的实际内容,他将此称为"AI psychosis"。ClickUp近期为部署AI智能体裁员22%即是一例。2026年的科技行业裁员规模已接近2025年全年。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新精选
Gemini Omni 与 Gemini 3.5 的 11 个实战展示
Google 在 2026 年 Google I/O 大会上发布了新一代多模态模型 Gemini Omni 与 Gemini 3.5,并同步提供了 11 个视频,集中演示了这两款模型在实际场景中的能力。
信息来源:Google Blog:AI(RSS) · Gemini
观点 / 方法精选
亲测为实:难以置信的推理速度
Kog团队在标准数据中心GPU上实现了极高的单用户推理速度,在8× AMD MI300X GPUs上达到3,000 tokens/s,在8× NVIDIA H200上达到2,100 tokens/s。相比常规推理速度(约100-300 tokens/s),实现了10-30倍提升。其核心思路是将LLM解码视为内存流问题,通过协同设计monokernel、重建同步机制、针对性内存访问映射及采用延迟张量并行的Laneformer模型架构,消除了传统流程的阻塞点。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
论文研究精选
GPIC:大规模视觉生成基准数据集发布
我对这个适用于大规模生成模型新时代的视觉生成基准数据集感到非常兴奋!🤩
信息来源:X:Fei-Fei Li (@drfeifei, World Labs)
产品发布 / 更新精选
Replit Canvas:对话式设计与原型生成工具
你试过新的 Replit Canvas 了吗? - 探索多种设计方向 - 通过与设计框架对话来调整设计 - 设计 UI 原型并将其转换为应用 - 为社交媒体创建营销素材
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
OpenRouter支持模型生成文件补丁
OpenRouter 现已支持 "apply_patch",这是一个服务器工具,允许任何模型通过 Responses API 使用 V4A diffs 提出文件编辑建议。 模型生成一个补丁(创建、更新或删除文件)。OpenRouter 在服务器端验证 diff 语法。
信息来源:X:OpenRouter (@OpenRouter)
模型发布 / 更新精选
xAI 发布 Grok Build 0.1 公测版
grok-build-0.1 现已通过 xAI API 提供公开测试版。 这是驱动 Grok Build CLI 的同一模型,擅长智能体编码。 定价为输入 $1/m,输出 $2/m,极具成本效益、智能且快速。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
模型发布 / 更新精选
Qwen-VLA:迈向通用具身智能的统一动作框架
通义实验室提出Qwen-VLA,以Qwen3.5-4B视觉语言主干与1.15B参数DiT动作解码器构建统一视觉-语言-动作模型。通过文本到动作DiT预训练和本体感知提示,将操作、导航与轨迹预测统一在同一框架下,支持11种机器人平台。在5个仿真基准中,单一通用模型在3个上超越最佳专用模型;ALOHA真机in-domain成功率83.6%,OOD泛化76.9%,分别超越π0.5超35和40个百分点;DOMINO动态操作零样本达26.6%;VLN-CE导航R2R和RxR分别达57…
信息来源:公众号:通义实验室(千问) · Qwen
产品发布 / 更新精选
OpenRouter 推出 Guardrails:保护你的 AI 智能体、数据与成本
OpenRouter 发布 Guardrails 可配置安全与治理工具,支持预算执行、零数据保留、模型和提供商限制、提示词注入防御以及数据丢失防护,帮助用户保护 AI 智能体、数据与成本。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
OpenRouter Guardrails 发布:可配置安全与治理工具,保护 AI 智能体、数据与成本
OpenRouter 推出 Guardrails,一套可配置的安全与治理工具,支持预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失防护等策略,用于保护 AI 智能体、数据和成本。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
Guardrails:保护你的智能体、数据与成本
Guardrails 是一套可配置的安全与治理工具,提供预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失预防等功能,旨在保护智能体(Agents)、数据与控制成本。
信息来源:OpenRouter:Announcements(RSS)
教程 / 实战精选
Claude Code--文档中未提及的所有可配置选项
该篇文章标题涉及"Claude Code"的可配置选项,但提供的正文内容仅包含一张图片和一个外部链接,未给出任何关于模型版本、参数、性能、价格或功能的具体信息。根据规则,无法在摘要中提及原文不存在的细节。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
行业动态精选
中央网信办等四部门:提升全民人工智能素养,加快人才培育、深化普及应用
中央网信办等四部门联合印发《2026年提升全民数字素养与技能工作要点》,部署了六项重点任务。其中明确要求"提升全民人工智能素养",具体包括强化人工智能赋能教育、加快人工智能人才培育、深化人工智能普及应用。其他任务涵盖数字资源供给、应用场景建设、普惠包容发展、安全有序网络空间以及协同联动机制。
信息来源:IT之家(RSS)
观点 / 方法精选
通义实验室发布教程:在 Android 手机部署 MCP 感知服务器
通义实验室发布教程,演示如何在 Android 手机上部署 MCP 感知服务器,使手机具备本地视觉与听觉分析能力。核心基于端侧 MNN 推理引擎和 Qwen3-VL 2B 模型(约 1.3GB),摄像头与麦克风采集的音视频在本地实时转化为结构化 JSON,再通过 MCP Tool 供 Claude Code 等云端 Agent 远程调用。整个过程不上传原始数据,仅传输语义提取结果。项目已开源,实测可识别红绿灯状态等场景。
信息来源:公众号:通义实验室(千问) · Qwen / Claude
模型发布 / 更新精选
ChatGPT上线GPT-5.5 Instant新版本
ChatGPT 新增 GPT-5.5 instant 模型: 我们今天发布了 GPT-5.5 instant 的新版本。之前的模型过于"子弹化"。新版本在其他一些重要维度上有所改进:谄媚性、事实性和多语言性能。希望你喜欢!我们始终对反馈感兴趣。
信息来源:X:Greg Brockman (@gdb) · ChatGPT / GPT
模型发布 / 更新精选
小米开源可控视频音效生成模型 ControlFoley,让声音"按你想要的来"
小米大模型应用团队发布开源可控视频音效生成模型 ControlFoley,旨在解决创作中的可控性难题。该模型统一支持文本引导视频配音、文本控制视频配音和参考音频控制视频配音三类任务。ControlFoley 在 VGGSound-Test 等多个 benchmark 上取得开源 SOTA 表现,其代码、模型权重和在线 Demo 均已开放。
信息来源:IT之家(RSS)
模型发布 / 更新精选
Qwen-VLA:从理解世界到付诸行动
通义千问推出通用视觉-语言-动作模型Qwen-VLA,基于Qwen多模态骨干,将视觉感知、语言理解与空间推理扩展至连续动作生成和轨迹预测。训练分四阶段:文本到动作预训练(T2A)、持续预训练(CPT)、监督微调(SFT)和强化学习(RL)。在LIBERO上达97.9%,Simpler-WidowX达73.7%,RoboTwin-Easy/Hard达86.1%/87.2%,匹配或超越专精模型。数据涵盖超10,000小时公共机器人轨迹、1,000+小时内部真实轨迹及800万+合…
信息来源:Qwen:Blog Retrieval(API) · Qwen
观点 / 方法精选
谷歌 DeepMind CEO 哈萨比斯:AGI 最快三年内到来,研发速度远超预期
谷歌 DeepMind 首席执行官德米斯·哈萨比斯预测,AGI 研发速度远超预期,最快可能在 2029 年至 2030 年前后出现。作为 AlphaGo、AlphaFold 的主导者,他认为当前 AI 智能体是未来更强智能的预演,随着多模态和自主决策能力成熟,三年内迎来 AGI 关键突破已非科幻。但他同时警示,全球社会对 AGI 到来的准备严重不足,必须提前建立规则与防护机制。
信息来源:IT之家(RSS)
产品发布 / 更新精选
阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力
信息来源:IT之家(RSS)
论文研究精选
面壁智能联合清华、OpenBMB开源最大中文预训练合成数据集及千万级SFT数据集,公开MiniCPM5-1B核心数据
面壁智能联合清华大学、OpenBMB发布并开源两大数据集:Ultra-FineWeb-L3(超600B Tokens,中文200B+,为当前最大中文预训练合成数据集)和UltraData-SFT-2605(国内首个千万级同时含深思考与非思考标注的SFT数据集)。两者基于UltraData数据分级治理体系构建,在MiniCPM5-1B训练流程中得到完全验证,覆盖预训练退火到后训练SFT全链路。已上线UltraData网站与HuggingFace,免费开放。
信息来源:公众号:面壁智能(MiniCPM) · Hugging Face
论文研究精选
蚂蚁百灵团队为何重新设计 SwiGLU?PowLU 激活函数的诞生始末
蚂蚁百灵团队提出新激活函数 PowLU,以解决 SwiGLU 在 FP8 等低精度训练中因二次增长放大异常值导致的 Loss Spike 和训练崩溃问题。
信息来源:公众号:蚂蚁百灵(Ling)