AI 情报文章归档
浏览 AI圈报 已保存的 5690 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5690
正式分类6
精选内容3361
全部文章
第 111 / 143 页 · 每页 40 条
产品发布 / 更新精选
Krea 2 推出 LoRA 微调系统
为 Krea 2(测试版)引入 LoRA。 我们迄今最强大的微调系统;现在你可以用惊人的精度,在 Krea 2 上训练你自己的特定风格、对象或角色。 了解其工作原理 👇
信息来源:X:Krea AI (@krea_ai)
模型发布 / 更新精选
Qwen3.7-Max:面向Agent时代的旗舰模型
Qwen3.7-Max是Qwen系列面向Agent时代推出的最新旗舰模型,旨在为能完成实际任务的智能体提供强大基础。其核心能力包括:可作为端到端编码智能体,处理前端原型与多文件重构;作为可靠的办公助手,通过MCP集成与多智能体编排协同工作;并支持超长时间(超过35小时)的自主运行,执行复杂任务链。该模型兼容Claude Code、OpenClaw等主流开发框架,现已上线阿里云模型工作室与Qwen Studio提供服务。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen / Claude
教程 / 实战精选
构建云端智能体的经验总结
云端智能体已从本地智能体的简单扩展,发展为具备独立环境、可并行无人值守处理长任务的系统。构建的核心经验在于:完整的开发环境是输出质量的关键,这需重建大量基础设施;可靠性方面,团队从自研架构迁移至Temporal平台,将可靠性提升至99.9%以上,该平台每日处理超5000万次操作,支撑超40%的代码拉取请求;同时,实现了智能体循环、机器状态与对话状态的解耦,以适应复杂的跨环境协作。
信息来源:Cursor Blog · Cursor
模型发布 / 更新精选
LongCat-Video-Avatar-1.5:升级版音频驱动数字人视频生成框架
美团LongCat团队发布了LongCat-Video-Avatar-1.5,一个专注于音频驱动数字人视频生成的开源框架。其核心升级在于采用Whisper-Large音频编码器,显著优化了唇部动态的流畅度与自然度。该版本实现了精准的唇形同步、全身时序稳定性以及长视频中的身份一致性,并能泛化应用于动漫、动物及多人交互等复杂场景。通过基于DMD2的步蒸馏技术,模型仅需8步即可高效推理。团队还构建了一个涵盖多场景、多语言的人工评估基准,通过大规模主观评分与专家分析,验证了其在多项…
信息来源:美团 LongCat:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
腾讯开源Hy-MT2多语言翻译模型
腾讯正式开源Hy-MT2多语言翻译模型,支持33种语言间的无缝互译。其7B与30B-A3B版本在开源模型中达到最先进的翻译性能,超越了许多参数规模大数十倍的模型。更具突破性的是,1.8B轻量级版本性能超越微软等主流商业API,并凭借腾讯AngelSlim 1.25-bit极量化技术,仅需440MB存储空间,即可在主流手机芯片上本地运行,推理速度较前代提升1.5倍,显著降低了高质量AI翻译的部署门槛。
信息来源:X:腾讯混元 (@TencentHunyuan)
观点 / 方法精选
游戏开发门槛被AI大幅降低
Grok展示了AI深度介入游戏开发的全新工作流。通过"提示词生成角色图→图片转动画视频→自动拼接成Spritesheet→导入引擎"四步流程,将传统需要美术与动画师耗时数天的工作,在几分钟内完成。这标志着AI不再仅生成静态内容,而是能实时生成可直接导入Unity或Godot等游戏引擎的可运行资产。该技术极大压缩了游戏原型的迭代周期,将反馈循环从"天"缩短至"秒",使得独立开发者也能快速实现创意,显著降低了游戏创作的门槛。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Grok
观点 / 方法精选
谷歌高级副总裁曼尼卡:AI短期内不会摧毁就业市场
谷歌高级副总裁詹姆斯·曼尼卡近日表示,AI短期内不会摧毁就业市场,也不同意"大规模失业"的激进预测。他援引其2017年参与的麦肯锡报告指出,自动化将同时导致岗位减少、新岗位出现以及现有岗位被重新定义。他认为当前争议在于这三种情况的占比,而非是否发生。曼尼卡批评AI行业放大了公众焦虑,这种恐慌可能削弱技术价值。他强调,AI最大的影响是改变工作内容与方式,而非让职业消失。
信息来源:IT之家(RSS)
行业动态精选
SpaceXAI全球招募顶尖工程师/物理学家
SpaceX正在为SpaceXAI积极招聘世界级工程师/物理学家,即使你此前没有任何AI经验。聪明的人能很快掌握。请发送邮件至ai_eng@spacex.com,附上约3个要点证明你的卓越能力。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
行业动态精选
Intuit将裁员逾3000人,以重新聚焦人工智能
软件公司Intuit宣布将裁员超过3000人,作为其战略重组的一部分。此次裁员旨在将公司资源重新聚焦于人工智能(AI)领域的发展,以适应技术趋势并提升长期竞争力。裁员规模约占其全球员工总数的10%。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
论文研究精选
智谱联合驭驯网络与清华提出ZCube组网架构,破解大模型推理网络瓶颈
智谱、驭驯网络与清华大学联合提出并落地ZCube组网架构,以扁平化拓扑替代传统Clos/ROFT架构,从结构层面消除PD分离推理中的可避免拥塞。在GLM-5.1 coding生产环境千卡集群实测中,ZCube相比ROFT将GPU平均推理吞吐提升15%以上,TTFT P99降低40.6%,同时减少约三分之一的交换机与光模块成本。
信息来源:公众号:智谱(GLM) · GLM
产品发布 / 更新精选
为AI配备科学工具包加速研究工作流
如何加速你的日常研究工作流? 通过为AI提供正确的科学工具包。 我们为Google @Antigravity推出了Science Skills,整合了来自30多个主要生命科学来源的洞见,包括UniProt和AlphaFold数据库。
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
论文研究精选
Gated DeltaNet-2:解耦线性注意力中的擦除与写入
线性注意力通过固定循环状态替代无界缓存,但面临精确编辑压缩记忆的挑战。现有模型如Delta-rule与KDA使用单一标量门同时控制"擦除"与"写入"两个操作。本文提出Gated DeltaNet-2,引入独立的通道级擦除门和写入门,实现了这两个操作的解耦,从而泛化并改进了前代模型。该模型在1.3B参数规模、100B tokens训练下,在语言建模、常识推理等任务中表现优异,尤其在长上下文RULER多键检索基准上优势显著。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
从推理链到可验证子问题:课程强化学习实现LLM推理的信用分配
针对基于结果的强化学习在处理困难推理问题时因正确样本稀少而效率低下的问题,本文提出子问题课程强化学习框架。该框架从参考推理链中提取可验证子问题,并将最终子问题固定为原始问题,从而将部分解题进展转化为可验证的学习信号。其通过在子问题位置独立归一化奖励并分配优势值,实现了更细粒度的信用分配。实验表明,SCRL显著提升了模型在多个数学推理基准上的性能,有效增强了在复杂问题上的探索与推理能力。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
SpaceX的无限野心:AI企业集团
SpaceX在提交S-1文件后,展现为一家AI时代的企业集团。公司由三大业务构成:Starlink(星链)、太空业务与AI业务。2025年总营收达187亿美元。其中,星链是绝对的核心与现金引擎,贡献了61%的营收并实现39%的营业利润率。太空业务收入占比22%,而AI业务(含X平台与xAI)虽仅占17%且处于巨额投入阶段,但代表了未来的战略方向。整体上,星链的强劲盈利为公司的太空探索与AI雄心提供了关键的资金支持。
信息来源:Tomer Tunguz 博客(VC 分析) · Grok
论文研究精选
RiT:在表示空间中使用原生扩散变换器已足够
本研究探讨预训练表示空间在流匹配学习中的优势。比较像素、SD-VAE与DINOv2特征后发现,尽管像素与DINOv2的内在维度相近,但DINOv2在几何统计特性(如有效秩、协方差条件等)上表现更优,使回归过程更稳定。基于此,我们提出了表示图像变换器(RiT),它使用冻结的DINOv2特征,通过x-prediction目标训练一个原生扩散变换器。在ImageNet 256×256生成任务上,RiT性能优于参数量更多的DiT^DH-XL模型,且生成的常微分方程仅需少量步骤即可高…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
在OpenCode中使用Grok
xAI宣布,其SuperGrok或X Premium订阅用户现可在开源编程工具OpenCode中使用Grok模型。OpenCode提供终端或独立桌面应用两种形式,用户连接Grok账户后,即可调用驱动xAI终端编程代理的Grok Build模型进行开发。该集成通过xAI Grok OAuth实现认证接入,官方表示未来将推出更多开源代理及集成方案。
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
腾讯张军官宣操作系统层级 AI 助手"马维斯"正式上工,Windows、Mac、安卓端同步上线
腾讯于5月21日发布了操作系统层级AI助手"马维斯",支持Windows、Mac和安卓平台同步上线。该助手具备文档归类解析、图片智能识别处理、系统维护等功能,并强调与操作系统深度集成,可调度不同模型处理任务,部分功能可在离线状态下使用。腾讯表示"马维斯"能完成市面主流Agent的大部分工作,并具备桌面操控手机应用等能力。这是继3月WorkBuddy和"龙虾"产品矩阵后,腾讯推出的又一AI助手产品。
信息来源:IT之家(RSS)
行业动态精选
冲刺 9 月上市,OpenAI 最快本周五提交 IPO 招股书草案
据CNBC报道,OpenAI预计最快本周五递交首次公开募股(IPO)招股书草案,这标志着公司向资本市场迈出关键一步。首席执行官萨姆·奥尔特曼设定最早于2026年9月上市的目标。公司正与高盛和摩根士丹利合作,借助这两家投行的资源推动上市申报和承销安排。此前,埃隆·马斯克针对OpenAI的诉讼失利后,上市障碍消除,进程明显加速。OpenAI目前私募估值超过8500亿美元,若顺利推进,可能成为公开市场历史上规模最大的首发之一。此外,公司最早考虑在今年第四季度上市,内部治理和运作已…
信息来源:IT之家(RSS) · OpenAI
行业动态精选
SpaceX与Anthropic合作提供大规模AI算力服务
正如最近与@AnthropicAI扩大合作所展示的,@SpaceX正在大规模提供AI算力服务。 我们正在与其他公司进行类似合作的讨论。 随着时间的推移,特别是通过轨道数据中心,我们预计将以极高的规模提供AI服务。
信息来源:X:Elon Musk (@elonmusk, xAI) · Claude / Grok
行业动态精选
xAI去年亏损64亿美元--SpaceX的IPO文件揭示其支出远未停止的原因
SpaceX的IPO文件首次披露了xAI在2025年的财务状况,显示该AI公司去年亏损高达64亿美元。文件同时揭示了xAI计划对Grok进行大规模扩张的战略,解释了马斯克旗下AI业务持续高额支出的原因。这份公开文件为外界提供了观察马斯克AI产业投资规模与财务表现的罕见窗口。
信息来源:TechCrunch:AI(RSS) · Grok
行业动态精选
Anthropic将向xAI支付每月12.5亿美元用于算力采购
人工智能公司xAI意外与Anthropic达成一项算力供应协议,该交易每月为xAI带来12.5亿美元收入。这笔由埃隆·马斯克旗下xAI提供的计算资源租赁合同,成为近期AI基础设施领域最大规模的商业合作之一。
信息来源:TechCrunch:AI(RSS) · Claude / Grok
产品发布 / 更新精选
Google Stitch更新:AI设计助手实现全流程构建
Google推出了其AI设计伙伴Stitch的多项重要更新。新功能支持实时流式构建设计,允许用户在不中断流程的情况下直接进行编辑和互动反馈。Stitch现已能够导入现有代码库或Design.md文件,基于实际生产组件进行设计以保持品牌一致性。同时,工具新增了动态界面生成功能,并可将设计项目直接导出为可分享的线上URL,简化了从原型到生产的部署流程。该工具现已面向全球用户开放。
信息来源:X:Google AI for Developers (@googleaidevs)
产品发布 / 更新精选
OpenClaw 2026.5.19版本发布
OpenClaw 2026.5.19 🦞 📱 Android Talk Mode 实现实时化 🍎 Mac 设置界面更清爽 🔐 xAI 登录支持无头模式 🧵 Telegram 话题功能更稳定 大版本更新,简短公告。 https://github.com/openclaw/openclaw/releases/tag/v2026.5.19
信息来源:X:OpenClaw (@openclaw) · Grok
论文研究精选
OpenAI 声称其解决了一道存在了80年的数学问题--这次来真的
OpenAI 宣布其推理模型成功证伪了一道自1946年起悬而未决的几何猜想。与以往不同,此次声称获得了此前曾指出OpenAI相关声明存在错误的数学家们的认可与支持,这为其结论的可靠性提供了关键背书。
信息来源:TechCrunch:AI(RSS) · OpenAI
行业动态精选
英伟达 2027 财年第一财季归母净利润 583.21 亿美元,同比增长 211%
英伟达2027财年第一季度业绩创新高,营业总收入达816.15亿美元,同比增长85%。净利润为583.21亿美元,同比激增211%。数据中心业务是核心增长引擎,营收达752亿美元,同比大增92%。公司毛利率提升至74.9%,并宣布了800亿美元股票回购及提高季度股息。展望第二季度,公司预计营收为910亿美元。
信息来源:IT之家(RSS) · NVIDIA
模型发布 / 更新精选
Gemini 3.5 Flash 正式发布
Gemini 3.5 Flash 已正式发布。
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
论文研究精选
ZCube:超大规模大模型推理的网络优化
针对超大规模大模型推理,ZCube网络架构通过取消Spine层、将Leaf交换机分组并全互联等创新设计,有效解决了推理网络的拥塞问题。该架构在集群实测中,实现了交换机与光模块资本支出减少33%、GPU平均推理吞吐提升15%,同时将首token延迟的P99值大幅降低40.6%,在降低成本的同时显著提升了推理性能。
信息来源:智谱:研究(网页内嵌数据) · GLM
产品发布 / 更新精选
V8.1新增反向提示功能
今日小幅更新。许多用户要求为V8模型恢复"反向提示"功能(旧版本已有),我们称之为--no标志。该功能现已在V8.1中上线!如果您想从图像中排除某些元素(例如人物),可以尝试使用--no people。玩得开心!
信息来源:X:Midjourney (@midjourney)
产品发布 / 更新精选
我们在 I/O 2026 发布的 100 件事
在 Google I/O 2026 开发者大会上,公司共发布了 100 项内容,重点介绍了 Gemini Omni、Google Antigravity 和 Universal Cart 等新产品的核心亮点。
信息来源:Google Blog:AI(RSS) · Gemini
产品发布 / 更新精选
GPT-5即将发布
GPT-5即将发布 🚢
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT / GPT
行业动态精选
Meta万人重组:裁员与AI转型并举
Meta启动大规模裁员,计划削减约8000个岗位。与此同时,约7000名员工将被调配至新的AI相关职位。此次调整并非单纯的削减成本,更是公司围绕AI进行内部结构重塑的关键举措,重点将资源集中于AI基础设施、基础模型的构建以及AI技术的商业化,旨在打造从模型训练、产品开发到实现盈利的完整链条。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态精选
Gemini与XPRIZE联合举办全球黑客松
用Gemini构建,改变世界🌍 我们正与@xprize合作,发起一场全球黑客松,旨在利用我们全新的智能体工具解决现实世界的挑战。 点击加入:https://www.geminixprize.com/
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
产品发布 / 更新精选
Gemini Omni让视频创作编辑更轻松
使用Gemini Omni创建、混剪和编辑视频比以往任何时候都更容易。 它提供了一种流畅的对话式创作和编辑方式。只需从相册上传视频,并让Gemini进行修改即可。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
ChatGPT移动端支持Codex,实现跨设备协作
你的笔记本电脑可以留在家里。 通过ChatGPT移动应用使用Codex,随时随地回答问题,之后还能在电脑上继续同一对话。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
模型发布 / 更新精选
Gemini 3.5 Flash快速整理混乱输入
Gemini 3.5 Flash能快速提供整理好的结果,无论输入多么混乱。 看看Gemini如何将与客户的聊天和文本,转化为您小企业可用的文档。
信息来源:X:Gemini (@GeminiApp) · Gemini
行业动态精选
谷歌的人工智能正遭到操纵。这家搜索巨头正在悄然反击
谷歌的AI系统正面临被操纵的风险。为应对这一挑战,这家科技巨头已悄然启动防御措施,以保护其AI生成内容的结果免受恶意干扰。此举旨在确保搜索和AI服务的可靠性与可信度,反映了当前人工智能安全领域日益增长的对抗性问题。谷歌在未公开宣传的情况下,正在通过技术手段加强对其AI系统的防护。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
合作伙伴如何运用Opus强化网络安全
多家企业正利用Claude Opus模型强化网络安全防御。Wiz通过其Red Agent,每周对超过15万个生产资产进行持续渗透测试,发现数千个高风险漏洞且误报率为零。Palo Alto Networks在不到三周内完成了相当于一年的渗透测试工作量。埃森哲将安全测试覆盖率从约10%提升至80%以上,涉及1600个应用和50万+个API,扫描周期从3-5天缩短至1小时内。应用主要围绕三个方向:开展大规模攻击性测试、缩短漏洞发现与修复的间隔,以及将受控AI系统部署到生产环境。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
推出 Gemini for Home 赋能服务提供商与硬件合作伙伴
Google 通过推出全栈 Gemini AI 解决方案扩展其智能家居生态系统。该方案集成了先进的摄像头智能、自然语言查询功能和日常活动摘要能力。它为服务提供商和硬件制造商提供了现成的参考设计与API,使其无需大量研发投入即可构建主动式、品牌化的智能家居服务。该计划旨在超越基础设备控制,迈向能够理解情境并实时响应用户需求的AI原生智能家居。
信息来源:Google Developers Blog(RSS) · Gemini
产品发布 / 更新精选
Runway发布Aleph 2.0视频编辑模型及Edit Studio应用
Runway于2026年5月21日发布了视频编辑模型Aleph 2.0及其新产品Edit Studio。Aleph 2.0支持编辑最长30秒的1080p视频,具备精准局部编辑能力,可只改变指定内容而完全保留原视频其余部分。该模型引入了基于单帧图像的精确控制,并支持一次性跨多个镜头应用编辑。Edit Studio是基于这些新能力构建的应用,旨在帮助用户高效地将现有视频素材转化为所需版本,例如更换产品、调整背景或修复拍摄瑕疵。该功能现已向所有付费Runway桌面网页端用户开放,…
信息来源:Runway:News(网页)
产品发布 / 更新精选
Claude现已支持更多安全合规工具
Anthropic宣布为Claude企业版及平台新增28项安全与合规工具集成。这些集成均通过Claude Compliance API实现,允许企业安全团队统一获取Claude的对话内容与活动事件,从而将其纳入现有的DLP、SIEM等监控与合规流程。新增合作伙伴包括Cloudflare、CrowdStrike、Microsoft Purview等28家供应商,覆盖数据安全、身份验证等多个关键领域,帮助企业快速将Claude接入现有安全平台,实现跨组织工具的统一治理与可视化监…
信息来源:Claude:Blog(网页) · Claude