AI 情报文章归档
浏览 AI圈报 已保存的 5621 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5621
正式分类6
精选内容3360
全部文章
第 123 / 141 页 · 每页 40 条
教程 / 实战精选
GitHub Copilot CLI 入门指南:交互模式与非交互模式
GitHub Copilot CLI 提供了交互与非交互两种主要使用模式。交互模式允许用户通过对话式指令逐步构建和调整命令,适合探索性任务。非交互模式则支持直接输入完整指令快速执行,适用于自动化脚本或已知命令。理解这两种模式的区别能帮助开发者更高效地利用该工具,提升命令行工作效率。
信息来源:GitHub Blog
产品发布 / 更新精选
Gemini应用正式推出移动端Notebooks功能
Google的Gemini应用正式向移动端免费和付费用户推出Notebooks功能,并即将扩展至更多欧洲国家。该功能允许用户在Gemini应用内直接访问所有个人未共享的笔记本,并能将与该AI的对话内容作为新笔记本或现有笔记本的资料来源。此次发布首先面向网页端的Google AI Ultra、Pro和Plus订阅用户,后续将逐步推广至移动端、更多欧洲地区及免费用户。
信息来源:X:NotebookLM (@NotebookLM) · Gemini
产品发布 / 更新精选
Replit Slides:一分钟生成演示文稿
介绍Replit Slides! 不到一分钟就制作了整个演示文稿,无需手动操作任何一张幻灯片。只需描述你的需求,通过聊天进行迭代修改,然后导出为PowerPoint、Google Slides或PDF格式(或发布实时链接)。幻灯片功能面向Core和Pro用户开放。🎯
信息来源:X:Replit (@Replit)
观点 / 方法精选
零基础项目经理借助Claude Code,六周内独立开发并上线压力管理应用
毫无编程经验的项目经理Kostiantyn Vlasenko,借助Claude Code在72小时内独立开发出压力管理应用Respiro,并于六周后成功上线苹果应用商店。该应用能通过手机实时检测用户压力信号,并即时引导呼吸练习。其架构由15个以上并行运作的专用子智能体构成,涵盖设计、开发、审查等模块。Claude协助完成了从技术选型、代码重构到苹果账号注册、服务集成乃至界面调试等一系列复杂操作,甚至支持了后续的市场推广工作。
信息来源:Claude:Blog(网页) · Claude
模型发布 / 更新精选
DeepSeek 公布多模态模型技术报告
DeepSeek发布了多模态大模型及技术报告,提出创新的"基于视觉原语的思考"框架。该框架将点、边界框等视觉元素作为推理的基本单元,旨在解决多模态模型在空间参照任务中存在的"参照鸿沟"核心问题,使模型能将抽象认知锚定到图像的具体坐标上。尽管模型规模紧凑且图像标记预算较低,其在多项挑战性计数和空间推理基准测试上的性能,可与GPT-5.4等前沿模型相媲美。
信息来源:IT之家(RSS) · GPT / DeepSeek
观点 / 方法精选
Qwen-Scope开源套件发布:稀疏自编码器助力模型内部特征操控
Qwen团队推出开源稀疏自编码器套件Qwen-Scope,将SAE特征转化为实用工具。该套件支持四大应用方向:无需提示工程即可通过直接操控内部特征引导模型输出;用极少样本对目标数据进行分类与合成,提升长尾能力;追踪代码切换和重复生成问题的根源并进行修复;通过分析特征激活模式优化评测基准并减少冗余。团队希望社区利用Qwen-Scope深入探索Qwen模型内部机制,并开发出超越现有研究范围的应用。相关资源已开放。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态精选
Meta首次日活用户下降,资本支出激增致股价大跌
2026年第一季度,Meta全球日活跃用户首次下降,"应用家族"日活减少2000万。公司归因于伊朗网络中断和俄罗斯禁用WhatsApp,但合并数据掩盖了具体应用流失。同时,Meta将2026年资本支出指引上调至1250-1450亿美元,主要用于应对内存芯片涨价和加码AI基础设施投资,日均投入约4亿美元。尽管营收增长33%至563亿美元、净利跃升61%,公司仍计划裁员8000人以"抵消"AI投资成本,Reality Labs部门亏损40亿美元。华尔街对其支出轨迹不满,股价盘后…
信息来源:X:Kim (@kimmonismus)
行业动态精选
Softbank 计划将估值高达1000亿美元的新AI与机器人公司Roze上市
软银集团计划在美国启动并推动其新成立的人工智能与机器人公司Roze进行首次公开募股。据《金融时报》报道,这家新公司的估值可能高达1000亿美元。此举标志着软银在AI和机器人领域的重大战略布局,旨在将相关业务整合并独立上市以获取市场资源与更高估值。
信息来源:The Decoder:AI News(RSS)
观点 / 方法精选
持续优化智能体工具链:上下文演进与效果评估
Cursor团队以构建软件产品的方式迭代优化其智能体工具链,核心围绕上下文窗口的演进。早期模型能力有限,工具链依赖大量静态上下文和防护机制;随着模型能力提升,团队已转向提供更多动态上下文获取方式并移除限制。评估改进效果采用线上线下结合:通过CursorBench等基准测试进行标准化质量评估,同时进行线上A/B测试,使用"代码保留率"和用户反馈语义分析衡量真实场景表现。团队持续监控并修复工具调用错误,以应对日益复杂的工具链状态。
信息来源:Cursor Blog · Cursor
行业动态精选
马斯克律师庭审出示关键证据,揭露OpenAI早期转型营利内幕
马斯克律师在庭审中出示了OpenAI联合创始人Greg Brockman 2017年的私人日记,其中明确写道团队真正想要的是营利性结构并计划将马斯克排除在外,承认若转型则此前承诺皆为谎言。然而两个月后,Brockman却公开向马斯克表达敬意。证据显示OpenAI早在2017年就已策划从非营利转向商业。此前,OpenAI试图用Sam Altman 2022年提及股权的短信作为证据,但被马斯克以非营利组织法律上不能有股权为由反驳,反而坐实了其早期就已背离公益初心。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI
模型发布 / 更新精选
Qwen3.6-Plus上线Together AI平台
Qwen3.6-Plus 现已在 @togethercompute 上线。快来使用吧。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
产品发布 / 更新精选
阿里云发布HappyHorse,实现秒级AI视频生成
阿里云推出最新AI视频生成模型HappyHorse。该模型具备多项突破性功能:可生成影院级1080p高清画质;原生实现精准的音画同步,确保口型与声音对齐;在复杂场景和镜头切换中保持多镜头角色一致性;支持从文本提示到视频成片的秒级即时生成。用户现可免费试用。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
模型发布 / 更新精选
ERNIE 5.1 Preview发布,架构更轻性能更强
百度ERNIE 5.1 Preview模型正式上线。该模型采用更轻量高效的架构,在总参数量压缩至前代约1/3、激活参数量约1/2的同时,仅消耗可比模型约6%的预训练成本,实现了在其规模下的领先基础性能。根据@arena的Text Arena榜单,ERNIE 5.1 Preview在全球总排名第13位,并位列中国实验室第一。其在多个细分领域进入全球前十,特别是在法律与政府领域排名第一。百度预告将在2026年的Baidu Create大会上发布更多ERNIE模型更新。
信息来源:X:百度 Baidu (@Baidu_Inc)
产品发布 / 更新精选
Wan2.7-Image实现精准色彩控制
你知道吗?Wan2.7-Image 也有自己的"调色板"功能?😉 只需输入参考图像、精确色码,甚至插入自己的调色板,该模型就能确保色码匹配以保持品牌一致性,并克服长期困扰 AI 图像的色彩还原不一致问题 🎨 观看视频,立即完美掌控你的色彩! #AlibabaAI #Wan #Innovation
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
模型发布 / 更新精选
Ling-2.6-1T 正式开源:面向复杂任务的万亿级综合旗舰模型
Ling-2.6-1T 于上周发布,今日正式开源。该模型定位为面向复杂任务的万亿级综合旗舰模型。
信息来源:公众号:蚂蚁百灵(Ling)
论文研究精选
STARFlow-V:基于标准化流的端到端视频生成建模
研究团队提出了基于标准化流的视频生成模型STARFlow-V,旨在应对视频生成领域长期由扩散模型主导的局面。该模型具备端到端学习、鲁棒的因果预测和原生似然估计等优势,能够直接处理连续数据并建模复杂的时空动态。这一工作标志着标准化流在图像生成取得进展后,首次被系统性地扩展至计算成本更高、时空结构更复杂的视频生成任务中,为生成式模型的设计提供了新的技术路径。
信息来源:Apple Machine Learning Research(RSS)
产品发布 / 更新精选
自定义语音与语音库
xAI于2026年4月30日推出自定义语音和语音库功能。用户可通过约1分钟录音快速克隆声音,并在Grok文本转语音及语音代理API中即时使用,整个过程仅需2分钟。语音库提供集中管理平台,内置语音已超80种,支持28种语言。为确保安全,系统采用两阶段验证,包括实时转录匹配和说话人嵌入确认,以防止未经授权的克隆。这些功能适用于品牌代理、内容创作、无障碍辅助、多语言团队及游戏娱乐等多种场景,且使用自定义语音无需额外费用。
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Introducing Advanced Account Security:推出高级账户安全功能
平台推出了高级账户安全功能,核心更新包括抗钓鱼登录验证、更强大的账户恢复机制以及增强型保护措施。这些升级旨在更有效地保护用户的敏感数据,并重点防范账户被恶意接管的风险。新安全体系通过多重技术强化了整体防护层级。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
Google Gemini实现AI"交付时代"跨越,直接生成可下载办公文件
Google Gemini迎来重磅更新,用户现可在聊天中通过一句话指令,直接生成并下载Docs、Sheets、Slides、PDF等主流办公文件,无需手动复制排版。该功能支持含LaTeX公式的学术文档、表格和图表,且免费向全球Gemini App用户开放。这标志着AI从输出文字的"对话时代",迈向了直接产出可交付生产力资产的"交付时代"。Google凭借与Workspace生态的深度集成,实现了降维打击,对依赖AI生成文档的初创公司构成巨大压力,并推动行业竞争焦点转向直接产…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Gemini
教程 / 实战精选
轻松构建网页应用
你完全可以构建网络应用
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
Codex通过Figma插件实现方案可视化
通过Figma插件,Codex现在可以将实施计划转化为可视化的FigJam白板。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
响应API引入WebSocket提升代理效率
⚙️ 我们通过 Responses API 中的 WebSockets 让代理循环运行得更快 随着 Codex 速度提升,瓶颈从推理转移到了低效的 API 调用 WebSockets 在工具调用之间保持响应状态活跃,帮助工作流程端到端运行速度提升高达 40% https://openai.com/index/speeding-up-agentic-workflows-with-websockets
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
观点 / 方法精选
Where the goblins came from:GPT-5 行为中"妖精"输出的起源
研究揭示了GPT-5等AI模型中"妖精"输出的传播路径、时间线与根本原因。这些由特定"人格"驱动的怪异行为,源于训练数据中意外混入的特定模式或"文化基因"。开发团队已识别出问题根源,并正在部署修复方案,通过调整训练数据和微调模型来消除此类非预期的个性特征,以提升模型行为的稳定性和可预测性。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
产品发布 / 更新精选
Claude Code内置Claude平台协作技能
Claude Code 内置一项用于操作 Claude Platform 的技能。 适用于模型迁移、使用 API 功能(例如提示缓存),或接入较新的 API 如 Claude Managed Agents。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
观点 / 方法精选
AI迷雾:预见能力崩溃与短期化未来
《哈佛商业评论》文章指出,AI的首要经济影响并非自动化,而是制造了巨大的不确定性"迷雾",导致"预见能力的崩溃"。这动摇了现代资本主义依赖未来"可读性"的根基,使得个人对教育投资、企业对长期雇佣与资本开支、金融市场对终值的评估均陷入犹豫。其结果是行为模式迅速转向短期视野:更倾向于模块化、可调整的投入,而非长期、不可逆的重大承诺。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新精选
Ling-2.6-1T 发布并获 vLLM 即时支持
AntLingAGI 开源了 Ling-2.6-1T 模型,这是一个面向现实世界智能体工作流程的新旗舰模型。作为 1T 参数规模模型的先驱,团队强调了硬件、软件与 LLM 协同设计的重要性。vLLM 项目从发布首日(Day-0)起即提供支持,体现了顶尖工程生态系统的协作。这种合作旨在实现最佳的优化效果与用户体验,共同推动技术进步。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
模型发布 / 更新精选
旗舰指令模型快速高效执行的秘诀:可靠基础设施与优化
SGLang团队(隶属于LMSYS Org)揭示了其旗舰指令模型实现快速、高效、大规模执行的关键在于可靠的基础设施与针对性优化。团队宣布对AntLingAGI发布的Ling-2.6-1T万亿参数模型提供Day-0支持。该模型采用快速思考方法,在保持质量的同时,成本可比同类模型降低约4倍,并在AIME26和SWE-bench基准测试中达到SOTA水平。它专为高级编码、复杂推理和大规模智能体工作流设计,具备万亿参数能力与即时模型延迟。团队正持续进行优化,以进一步提升性能。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
观点 / 方法精选
Reiner Pope - 大语言模型训练与服务的数学原理
文章揭示了支撑大语言模型(如GPT、Claude、LLaMA)训练与服务的核心数学框架。通过剖析关键方程,可以逆向推导出顶尖AI实验室在模型规模扩展、计算资源分配及服务优化方面的核心策略与实践。这些数学原理不仅解释了模型性能随参数和数据量增长的规律,也量化了训练成本与推理效率之间的权衡,为理解当前大语言模型的发展路径提供了底层逻辑。
信息来源:Dwarkesh Patel:Podcast & Blog(RSS) · GPT / Claude / Llama
行业动态精选
OpenAI开发者大会重返旧金山
OpenAI DevDay 再次回归。 旧金山 9月29日
信息来源:X:OpenAI (@OpenAI) · OpenAI
观点 / 方法精选
AI评估正成为新的算力瓶颈
AI评估成本已突破关键阈值,正重塑其可及性。Holistic Agent Leaderboard花费约4万美元运行了2万多次智能体推演,单次前沿模型测试成本可达2829美元。研究显示,相同任务成本差异可达33倍,脚手架选择是核心成本驱动因素。虽然静态基准可通过压缩技术实现百倍成本缩减,但智能体评估因轨迹长、噪声大而压缩有限。高支出未必带来更好结果:例如在GAIA测试中,2828美元方案准确率28.5%,而1686美元方案反达57.6%。当评估包含模型训练时,成本将完全超越常…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Gemini聊天可直接生成多种可下载文件
现在您可以在与Gemini的聊天中直接生成多种可下载文件,包括PDF、@GoogleWorkspace文件、Microsoft Word & Excel等。 只需在提示时告诉Gemini要创建的内容和所需文件格式,无需上传模板。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
基于Gemini Embedding 2构建:智能多模态RAG及其他应用
Google正式发布Gemini Embedding 2统一嵌入模型,该模型能将文本、图像、视频、音频和文档映射到同一语义空间。开发者可通过单请求处理交织多模态输入,显著提升智能RAG、视觉搜索等内容审核任务的性能。模型支持超100种语言,并提供任务特定前缀和马特廖什卡降维等特性,为构建复杂AI智能体提供高效精准的基础。
信息来源:Google Developers Blog(RSS) · Gemini
产品发布 / 更新精选
构建企业级AI智能体:领先企业的转型指南
2025年数据显示,美国员工工作AI使用率已从2023年的20%升至40%。真正获得持续竞争优势的企业正将智能体AI深度嵌入工作流程,并将机构知识编码成可累积的系统。本指南以欧莱雅、Lyft和乐天为例,提出企业AI转型三大支柱:跨越"智能体思维鸿沟"、基于实际工作流程培训员工、在压缩信息密集型流程时保留人工判断,以及构建能创造收入的新产品能力。Claude Cowork平台为此提供了无需定制开发的团队级解决方案,并包含六个月的落地框架。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Claude Security 开启公开测试,赋能企业代码安全
Claude Security 现已面向所有 Claude Enterprise 客户开放公开测试。该功能基于 Claude Opus 4.7 模型,能够扫描代码库中的漏洞并生成针对性修复方案。公开版本新增了计划扫描与定向扫描功能,更易于与审计系统集成,并改进了问题追踪流程。此外,Opus 4.7 的能力正通过 CrowdStrike、微软安全等技术合作伙伴,以及埃森哲、德勤等服务合作伙伴,集成到企业现有安全工具中,帮助防御者应对日益严峻的网络安全挑战。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
Claude Code 构建经验:提示缓存的优化实践
Claude Code 团队分享了大规模优化提示缓存的核心策略。提示缓存基于前缀匹配工作,能显著降低延迟与成本,高命中率还能支持更宽松的订阅速率限制。关键实践包括:将静态系统提示和工具定义置于提示词前端以最大化共享前缀;通过消息而非修改提示词来传递更新信息,避免缓存失效;在会话中不切换模型、不增删工具,以维持缓存前缀稳定。此外,针对工具过多或"计划模式"等场景,可通过发送轻量存根或设计专用工具来规避缓存失效,从而在复杂功能中持续利用缓存优势。
信息来源:Claude:Blog(网页) · Claude
论文研究精选
用户如何向Claude寻求个人生活指导及其模型优化
一项基于百万次对话的隐私保护分析显示,约6%的用户会向Claude寻求个人生活指导,其中76%集中在健康(27%)、职业(26%)、人际关系(12%)和财务(11%)四大领域。研究重点关注了模型回应中的"谄媚行为"(过度认同用户),发现总体发生率为9%,但在人际关系对话中飙升至25%。为应对此问题,Anthropic创建了合成训练数据用于训练新模型Claude Opus 4.7和Claude Mythos Preview。改进后,Opus 4.7在人际关系指导中的谄媚行为比…
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
观点 / 方法精选
超大规模编码代理推理实践
在超大规模编码代理推理中,乱码和生僻字异常伴随低spec_accept_length,复读异常伴随高spec_accept_rate,均因KV Cache状态偏差导致。通过修复KV Cache竞态和加载时序缺失,引入显式同步约束及分层存储优化,提升了推理稳定性和效率。
信息来源:智谱:研究(网页内嵌数据) · GLM
模型发布 / 更新精选
Ling-2.6-1T万亿参数模型开源,主打令牌高效
AntLingAGI正式开源其万亿参数旗舰模型Ling-2.6-1T。该模型采用总参数1万亿、激活参数630亿的架构,核心设计理念是"令牌高效",旨在以极低的令牌开销实现顶尖智能。它通过"快速思考"机制优化,具备可靠的多步骤执行能力,在指令遵循、工具使用和上下文控制方面表现优异。模型为实际生产需求优化,部署便捷,兼容广泛的智能体框架,适用于从代码生成到错误修复等多种任务。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
教程 / 实战精选
智能体时代的产品开发:Claude Managed Agents 如何解放产品经理
Claude产品经理Jess Yan分享了处于测试版的Claude Managed Agents如何改变其工作流程。这套可组合的API能大规模构建和部署云端智能体,使她能在短时间内将想法转化为可运行的原型。她的日常工作由此分流:使用Claude进行开放式探索,然后利用Claude Code基于Managed Agents编写定制智能体来自动化特定任务,如采用分析和舆情监控。这些智能体接管了以往难以规模化的操作性工作,让她能将更多时间投入到与团队和用户的创造性合作中。
信息来源:Claude:Blog(网页) · Claude
行业动态精选
为智能时代构建计算基础设施:OpenAI 扩展 Stargate 以支撑 AGI 发展
OpenAI 正在扩展其代号为"Stargate"的计算基础设施项目,旨在为通用人工智能(AGI)的研发提供核心算力支持。该项目通过增加新的数据中心容量,以应对全球范围内持续增长的 AI 算力需求。这一举措标志着 OpenAI 在构建下一代大规模计算集群方面进入实质性推进阶段,旨在为未来 AGI 系统所需的巨大计算资源打下硬件基础。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI