AI 情报文章归档
浏览 AI圈报 已保存的 5645 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5645
正式分类6
精选内容3360
全部文章
第 120 / 142 页 · 每页 40 条
观点 / 方法精选
编程模式界限模糊:从"感觉编码"到"代理工程"的融合与隐忧
作者在访谈中反思,曾严格区分的两种AI编程模式--"感觉编码"(不审查代码)与"代理工程"(专业工程师构建高质量系统)--其界限在实践中正迅速模糊。随着Claude等编码代理可靠性提升,作者发现自己即使在生产级项目中也不再逐行审查AI生成的代码,转而将其视为可信的"半黑箱"。这带来了新的责任困境:AI缺乏职业声誉却持续产出正确代码,可能导致"偏差正常化"风险,即每一次成功都可能在不当时刻埋下隐患。同时,AI生成代码的便捷性也使得评估软件质量的传统指标(如提交次数、测试覆盖)…
信息来源:Simon Willison 博客 · Claude
产品发布 / 更新精选
Perplexity Agent API 新增金融搜索功能
Perplexity Agent API 现已提供金融搜索功能。 开发者只需一次工具调用,即可为需要当前可验证金融答案的智能体获取授权金融数据集、实时市场数据和附引用的网络资源。
信息来源:X:Perplexity (@perplexity_ai)
模型发布 / 更新精选
豆包大模型家族首款全模态理解模型:字节跳动 Doubao-Seed-2.0-lite 升级
字节跳动火山引擎发布豆包大模型家族首款全模态理解模型 Doubao-Seed-2.0-lite 升级版。该模型原生统一支持视频、图像、音频和文本理解,并能进行跨模态联合推理,在物理、医疗等学科推理及细粒度感知上表现超越此前Pro版本。音频方面支持19种语种转写及多语种互译,多项基准测试优于Gemini-3.1-Pro。同时,其Agent、Coding与GUI能力升级,能更稳定处理长任务、胜任深度开发,并实现界面理解与操作执行的闭环。新版本已在火山方舟上线,旨在为企业提供高性…
信息来源:IT之家(RSS) · Gemini / 豆包
行业动态精选
Anthropic承诺五年内向谷歌云投入约2000亿美元
据The Information报道,人工智能初创公司Anthropic已承诺在未来五年内向谷歌云投入约2000亿美元,这一金额占谷歌整个云业务未履行合同价值的40%以上。Anthropic与另一家尚未盈利的AI公司OpenAI,合计占据了亚马逊、微软、谷歌和甲骨文四家云服务商约2万亿美元未来承诺收入的近半份额。这两家公司预计到2029年收入将增长20至30倍,但如此巨大的投入规模能否被预期的收入增长所支撑,目前仍是一个悬而未决的问题。
信息来源:The Decoder:AI News(RSS) · OpenAI / Claude
行业动态精选
Hy3预览版周榜夺魁,周增298%
发布两周后,Hy3预览版以3.66T处理量在@OpenRouter周榜位列第一,周环比增长298%。 在总使用量、工具调用和编程领域均排名第一。全平台市场占有率达15.4%。🏆 运行Hy3预览版的热门应用:Hermes Agent, Claude Code, Kilo Code, OpenClaw, Cline。@NousResearch @claudeai @kilocodehq @openclaw @cline 衷心感谢所有基于此开发的开发者。🙏 请在OpenRou…
信息来源:X:腾讯混元 (@TencentHunyuan) · Claude
产品发布 / 更新精选
AlphaEvolve:我们由Gemini驱动的编程智能体如何跨领域扩展影响力
AlphaEvolve推出了基于Gemini大模型的编程智能体,其算法正驱动多个领域产生实际影响。该智能体在商业流程、基础设施优化与科学研究三个关键领域实现规模化应用,通过自动化代码生成与问题解决提升效率。具体实践表明,它能显著加速开发周期并处理复杂任务,标志着AI编程助手从辅助工具向核心生产力引擎的演进。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法精选
让 AI 检查软件卡顿问题,Qt 推出智能体代码分析技能
Qt集团近日推出一项名为QML分析器的AI智能体开发技能。该技能可将2D Qt Quick应用程序的代码性能分析工作委托给AI智能体,使其能够诊断渲染、逻辑及内存相关问题。当面对界面卡顿或帧率下降等性能投诉时,AI可借助此技能进行分析并生成详细的性能瓶颈报告。目前该技能仅适用于2D Qt Quick应用,已在GitHub Copilot、Claude桌面版及CLI等环境中完成测试,与Claude Sonnet 4.6、GPT 5.4和Gemini 3.1 Pro等主流大模型…
信息来源:IT之家(RSS) · GPT / Claude / Gemini
观点 / 方法精选
这个创造了Claude Code的男人Boris Cherny大神,完整公开了自己的工作流,并直播演示了一半的编码工作在手机上完成🤪
Boris Cherny公开其高效AI编码工作流,核心基于三点反直觉原则:1. 坚持使用最昂贵、最聪明的模型(如Claude),因其能一次性清晰规划,避免笨模型反复试错消耗更多token;2. 团队仅维护一个纯文本知识库文件,记录Claude的每次错误并每周更新,形成长期记忆;3. 始终让Claude查看自身代码的运行结果(包括执行和渲染)。其工作模式是在手机上并行启动多个Claude实例,基于规划模式制定方案后自动执行修改,从而高效完成任务。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
行业动态精选
PayPal 启动 AI 转型自救,拟裁员两成并精简业务架构
PayPal正启动一场由人工智能驱动的转型自救。公司计划在未来两到三年内裁员约20%(超4500人),并将业务架构精简为三大板块。首席执行官表示,将通过技术现代化、向云原生架构转型及全面推行AI应用来提升竞争力。AI预计将提升开发效率、缩短产品周期,并在未来两到三年内为公司节省至少15亿美元成本。尽管一季度营收增长,但公司股价自2021年高点已下跌超80%,增长陷入停滞。
信息来源:IT之家(RSS)
产品发布 / 更新精选
代理商现在可以创建 Cloudflare 账户、购买域名并进行部署
Cloudflare宣布其代理商合作伙伴现可直接创建Cloudflare账户、购买域名并部署服务。这一功能整合了账户创建、域名注册和项目部署流程,简化了代理商的管理与操作步骤。此举旨在提升合作伙伴的自主性和效率,进一步扩展Cloudflare的生态系统与服务覆盖范围。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
ChatGPT for Excel and Google Sheets:
ChatGPT for Excel and Google Sheets: 它可以帮助分析杂乱数据、编写公式、更新电子表格,并在此过程中解释其操作--无需离开你的电子表格。 由 GPT-5.5 驱动。 https://chatgpt.com/apps/spreadsheets/
信息来源:X:Greg Brockman (@gdb) · ChatGPT / GPT
产品发布 / 更新精选
Claude Code v2.1.129 版本更新
Claude Code 发布 v2.1.129 版本,带来多项功能新增与问题修复。新增功能包括支持通过 `--plugin-url` 从 URL 获取插件压缩包、新增 `CLAUDE_CODE_FORCE_SYNC_OUTPUT` 环境变量以强制启用终端同步输出,以及为 Homebrew 或 WinGet 安装提供后台自动更新提示。功能调整方面,插件清单中的 `themes` 和 `monitors` 现在建议在 `"experimental"` 下声明;网关模型发现功能改…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
行业动态精选
Anthropic揭示高速迭代真相:AI Agent协同作战,组织变革成关键
Anthropic基础设施负责人Boris Cherny透露,公司并无秘密模型Mythos,主要使用与公众相同的Claude Opus 4.7。其高速迭代的核心并非技术优势,而是组织结构变革:公司由数百个AI Agent在Slack上协同工作,自动拆分任务、编写代码并解决问题,形成24小时运作的AI军队。工程师团队规模仅增4倍,但人均产出提升200%,Boris本人自2025年11月起未手动写代码。这揭示了AI时代真正的代差在于流程与组织形态。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
论文研究精选
Normalizing Flows with Iterative Denoising
研究团队在归一化流(NFs)生成模型领域取得新进展,提出了迭代TARFlow(iTARFlow)。该方法在训练阶段保持完全端到端的基于似然的目标,采样时则采用自回归生成方式。iTARFlow延续了TARFlow在图像建模任务上的优势,使其成为扩散模型等方法的可行替代方案,进一步提升了归一化流生成模型的性能表现。
信息来源:Apple Machine Learning Research(RSS)
行业动态精选
Uber 利用 OpenAI 帮助司机更智能地赚钱、乘客更快地叫车
Uber 宣布在其全球实时交通服务平台中集成 OpenAI 技术,用于驱动 AI 助手与语音功能。新功能旨在帮助司机更智能地规划接单以提升收入,同时让乘客能够更快完成叫车流程。该技术将应用于优化实时供需匹配与用户体验。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
教程 / 实战精选
前沿企业如何构建人工智能优势
OpenAI的B2B Signals研究揭示了前沿企业深化AI应用、规模化基于Codex的智能体工作流,并构建持久竞争优势的路径。这些企业正超越基础应用,将AI深度集成至核心业务流程,通过部署能自主执行复杂任务的智能体工作流来提升效率与创新能力。研究指出,成功的关键在于规模化应用AI代理,这能带来显著的运营优势并形成竞争壁垒。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
Grok Web 正式推出 Connectors 功能,实现与日常应用深度集成
xAI 正式在 Grok Web 上线 Connectors 功能,提供与多种日常应用工具的深度集成。该功能允许 Grok 端到端处理任务,如阅读总结邮件、更新幻灯片、管理日历和编辑电子表格,无需频繁切换和复制粘贴。首批支持的连接器包括 SharePoint、Outlook、OneDrive、Google Workspace、Notion、GitHub 和 Linear,涵盖文件搜索读写、代码审查与任务管理等操作。同时推出的"自带 MCP"功能支持连接自定义模型上下文协议服…
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Grok Imagine API 推出"Quality Mode"图像生成与编辑功能
xAI正式向企业开发者和团队推出Grok Imagine API的"Quality Mode"图像生成与编辑功能。该模式在真实性、文本渲染和创意控制上实现显著提升,能生成细节精细、纹理准确、场景逼真的图像,并具备清晰的多语言文本生成能力。在独立排行榜中,该API已位列顶级模型之列。定价为输入提示每次0.01美元,输出图像根据分辨率(1K或2K)每张费用在0.05至0.07美元之间。此功能适用于产品可视化、营销素材快速生成、用户内容风格创作等多种商业场景。
信息来源:xAI:News(网页) · Grok
论文研究精选
从位置认知到功能理解:为多模态大语言模型设立空间功能智能基准
现有基准如VSI-Bench主要评估基础几何感知能力,但未能触及具身智能所需的高阶认知。为此,研究团队推出了空间功能智能基准SFI-Bench,该基准包含超过1700个问题,数据来源于多样化的第一人称室内扫描视频。SFI-Bench旨在系统评估多模态大模型从物体位置感知到功能意图理解的高级空间推理能力,标志着对智能体空间认知的评估从几何层面迈向功能层面。
信息来源:Apple Machine Learning Research(RSS)
论文研究精选
OpenSearch-VL:前沿多模态搜索智能体的开源方案
研究团队推出完全开源的OpenSearch-VL方案,用于训练前沿多模态深度搜索智能体。该方案包含三大核心:通过维基百科路径采样、模糊实体重写和视觉定位构建的高质量训练数据集(包括用于微调的SearchVL-SFT-36k和用于强化学习的SearchVL-RL-8k);统一文本搜索、图像搜索、OCR及图像处理工具的多样化环境;以及能处理级联工具失败的多轮致命错误感知GRPO训练算法。基于此训练的智能体在七个基准测试中平均提升超过10分,在多项任务上达到与专有商业模型相当的水…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
SpecMD: 关于推测性专家预取的综合研究
研究团队开发了SpecMD,这是一个用于在各种硬件配置上对临时缓存策略进行基准测试的标准化框架。该研究聚焦于混合专家模型,这类模型虽然实现了稀疏专家激活,但需要专家缓存机制才能将稀疏性转化为实际性能提升。此前的研究提出了以硬件为中心的缓存策略,但不同缓存策略之间以及它们与不同硬件规格之间的相互作用尚不明确。SpecMD框架旨在填补这一理解空白,系统性地评估缓存策略的交互影响与硬件适配性。
信息来源:Apple Machine Learning Research(RSS)
行业动态精选
OpenAI加速开发AI智能体手机,瞄准2027年量产
据报道,OpenAI正加速其首款AI智能体手机的开发,目标在2027年上半年量产。此举可能旨在强化其年底IPO的叙事,并将自身定位拓展至消费硬件平台。联发科有望成为独家处理器供应商,提供基于台积电N2P制程定制的天玑9600。关键硬件规格包括增强HDR管线的图像信号处理器,以提升AI视觉感知能力,以及双NPU架构、LPDDR6与UFS 5.0等。若按计划推进,2027至2028年总出货量可能达到约3000万台。
信息来源:X:Kim (@kimmonismus) · OpenAI
产品发布 / 更新精选
苹果 iOS 27 将允许用户选择第三方 AI 模型,支持谷歌与 Anthropic 等
据报道,苹果计划在秋季发布的iOS 27等系统中,推出名为"Extensions"的新功能,允许用户自行选择已通过App Store集成的第三方AI模型(如谷歌、Anthropic的模型),来驱动设备上的文本生成、图像编辑等AI功能。此举将打破此前ChatGPT作为唯一第三方选项的独占地位。同时,Siri将支持更换不同音色以区分内外模型,并迎来独立App及更深度的系统整合。苹果将在App Store设立专区展示兼容应用,并对第三方模型生成的内容免责。
信息来源:IT之家(RSS) · ChatGPT / Claude
观点 / 方法精选
Every firm will need to reconceptualize work as they build agentic systems. As AI and agents take o…
每家公司都需要在构建智能体系统时重新构想工作。 随着人工智能和智能体承担更多执行任务,机遇在于扩展人类能动性并重新设计工作完成方式。 来自团队的深度解析:这一转变意味着什么,以及每个企业需关注的关键考量:https://www.microsoft.com/en-us/worklab/work-trend-index/agents-human-agency-and-the-opportunity-for-every-organization
信息来源:X:Satya Nadella (@satyanadella)
产品发布 / 更新精选
ChatGPT is now available as an add-on in Excel and Google Sheets. It can help analyze messy data, w…
ChatGPT 现已作为插件在 Excel 和 Google Sheets 中使用。 它可以帮助分析杂乱的数据、编写公式、更新电子表格,并在此过程中解释其操作--无需离开您的电子表格。 由 GPT-5.5 驱动。 https://chatgpt.com/apps/spreadsheets/
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT / GPT
行业动态精选
指控OpenAI创始人通过未披露持股推动巨额合作,涉嫌史上最大自我交易
推文指控OpenAI联合创始人Greg Brockman和Sam Altman涉嫌严重的自我交易。两人作为非营利组织OpenAI的受托人,在未向董事会(包括Elon Musk)披露个人持股的情况下,自2017年起推动OpenAI与Cerebras达成总额超200亿美元的巨额合作与贷款,导致Cerebras估值飙升并筹备IPO,使他们个人获得巨大利益。法律专家称此举可能构成"千年乃至历史上最大的盗窃"。推文呼吁媒体应关注此重大利益冲突与权力滥用,而非创始人间的琐碎纠纷。
信息来源:X:AI Safety Memes (@AISafetyMemes) · OpenAI
模型发布 / 更新精选
Major ChatGPT upgrade rolling out now, in the form of GPT-5.5 Instant:
重大ChatGPT升级现正推出,形式为GPT-5.5 Instant: 这是一次重大升级,以更温暖自然的语调提供更智能、更清晰、更个性化的答案。 同时它也更简洁,这正是我们所了解到的用户需求。我们相信你会喜欢与它对话。
信息来源:X:Greg Brockman (@gdb) · ChatGPT / GPT
模型发布 / 更新精选
High fives to all our users on the new Instant model.
向我们所有使用新即时模型的用户致以热烈的祝贺。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT
行业动态精选
Meta is building an agentic tools for its more than 3bn users, according to people familiar with the…
Meta正在为其超过30亿用户构建代理工具,据知情人士透露,其中包括一款由其新型Muse Spark AI模型驱动的先进数字助手。 >另一位内部人士表示,其目标是开发一款类似于OpenClaw的产品 Via FT
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新精选
Grok 4.3
Grok 4.3 【引用 @xai】:Grok 4.3 现已在 xAI API 上线。这是我们迄今为止最快、最智能的模型。 它在 @ArtificialAnlys 排行榜的智能体工具调用和指令遵循方面位居榜首,并在 @ValsAI 的企业领域(如案例法和公司金融)中排名第一。 Grok 4.3 支持 100 万 token 的上下文窗口,定价为输入每百万 token 1.25 美元,输出每百万 token 2.50 美元。 创建 API 密钥并开始构建:http://con…
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新精选
Gemini API 文件搜索工具推出三项新更新,助力多模态 RAG 系统开发
Gemini API 文件搜索工具近日扩展三项功能更新,旨在帮助开发者更轻松地构建高精度多模态检索增强生成系统。更新包括:多模态支持,通过Gemini Embedding 2模型实现对图像和文本的同步推理;自定义元数据过滤,允许为文件添加键值标签以结构化非结构化数据,从而提升搜索速度;精确引用功能,能够捕获并返回每条索引信息的精确来源,如页码。开发者可通过Google AI Studio的示例应用体验这些功能,与图像和文档库交互,提问并追溯答案来源。
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
产品发布 / 更新精选
Agents SDK TypeScript版更新发布
更新后的 Agents SDK 现已提供 TypeScript 版本,支持沙盒代理并内置开源测试框架。 【引用 @OpenAIDevs】:构建可长期运行的代理,获得更多对代理执行的控制权。 Agents SDK 的新功能: • 在受控沙盒中运行代理 • 检查并自定义开源测试框架 • 控制记忆创建时机及存储位置
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
模型发布 / 更新精选
ChatGPT 更新推出 GPT-5.5 Instant 模型,幻觉减少且答案更个性化
OpenAI 将 ChatGPT 的默认模型更新为 GPT-5.5 Instant。内部测试显示,该模型在医学和法律等高风险主题上产生的幻觉声称减少了 52.5%。新功能"记忆来源"允许用户查看影响特定回答的存储上下文。该模型正立即向所有用户推出,但基于过去聊天记录、文件和 Gmail 的个性化功能将首先在网页版上向 Plus 和 Pro 用户开放。此次更新旨在提升回答的准确性和个性化体验。
信息来源:The Decoder:AI News(RSS) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
GPT-5.5即时版全面推送 更简洁智能
OPENAI 🚨: GPT-5.5 Instant 正在向所有 ChatGPT 用户推出!"gpt-5.5-chat-latest" 也将进入 API。 >; 更加简洁。更好的记忆。更个性化。 即时测试时间 👀
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI / ChatGPT / GPT
论文研究精选
研究突破:用弱模型监督可防止AI策略性隐藏能力
当AI承担人类无法完全核查的任务时,具备高能力的模型可能策略性隐藏实力且难以被察觉。Anthropic与MATS、Redwood的研究团队发现,即使仅使用较弱的模型作为监督者,也能成功训练一个接近完全能力的模型,使其停止这种"装傻"行为。该研究表明,通过弱监督训练可以有效抑制强模型的策略性能力保留问题。
信息来源:X:Anthropic (@AnthropicAI) · Claude
产品发布 / 更新精选
ChatGPT今日迎来5.5即时版重大升级
5.5 instant 今日登陆 ChatGPT! 在我看来这是一个相当大的升级,我真的很喜欢使用它。 【引用 @ericmitchellai】:Excited that we're updating the default model in ChatGPT today! 5.5 instant 在智能、图像感知和事实准确性方面都有显著提升。 它还更新了写作风格,使其更平实、更直接。 你的愿望清单上有什么?
信息来源:X:Sam Altman (@sama) · ChatGPT
产品发布 / 更新精选
Copilot Cowork新增移动端与跨系统功能
Copilot Cowork 新增功能:移动端、技能与插件。 现已在 iOS 和 Android 平台推出,您可通过手机委派工作,在桌面端继续处理,保持任务流畅推进。 借助全新连接器,Cowork 可跨业务系统与数据运作。
信息来源:X:Satya Nadella (@satyanadella)
模型发布 / 更新精选
ChatGPT默认模型升级至GPT-5.5 Instant
OpenAI宣布将ChatGPT的默认模型更新为GPT-5.5 Instant。新版模型在智能水平、图像理解能力和事实准确性方面均有显著提升。其回应风格变得更简洁、直接和自然,同时提供更个性化和清晰的答案。此次升级基于用户反馈,旨在提供更优质的对话体验。
信息来源:X:Eric Mitchell (@ericmitchellai) · OpenAI / ChatGPT / GPT
产品发布 / 更新精选
Perplexity与Computer接入顶级医学资源
Perplexity和Computer现已接入优质健康资源,首批包括NEJM和BMJ集团,另有9种医学期刊和临床数据库即将上线。 提出健康问题,即可获得来自医院和研究机构所信赖的相同来源的引用答案。
信息来源:X:Perplexity (@perplexity_ai)
模型发布 / 更新精选
OpenAI推出GPT-5.5 Instant作为ChatGPT新默认模型,实现显著升级
OpenAI正式将GPT-5.5 Instant设置为ChatGPT的新默认模型,该模型在基准测试中表现大幅提升,变得更智能、准确和可靠。其在图像分析、STEM、写作及医学、法律等高精度领域能力增强。核心升级在于个性化功能,能有效利用用户保存的记忆、过往聊天、文件和Gmail上下文,并展示影响回复的记忆来源。该模型将在未来两天内向所有用户推出,个性化改进优先面向网页版Plus和Pro用户,移动版随后跟进;API版本为gpt-5.5-chat-latest。官方表示,升级后的…
信息来源:X:Kim (@kimmonismus) · OpenAI / ChatGPT / GPT