AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章919
当前页23 / 23
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新精选
最近在 X 上较为沉默。过去一年是转型之旅。Grok-4 与…
机器人领域正处于类似 2018 年 NLP 的混沌期,技术路线未定(世界模型、RL、sim2real 等),商业模式百花齐放,是入局的好时机。管理实验室并直接向 4 万亿美元公司 CEO 汇报消耗了全部精力,故在 X 上发言减少。坚信没有具身智能就没有 AGI。
信息来源:X:Jim Fan (@DrJimFan) · Grok
模型发布 / 更新精选
Kimi 发布 K2 模型
Kimi K2 采用混合专家(MoE)架构,拥有 320 亿激活参数和 1 万亿总参数,在非推理模型的前沿知识、数学和编程任务上达到 SOTA 性能。
信息来源:Moonshot AI:Kimi Blog · Kimi
模型发布 / 更新精选
Grok 4
xAI 正式发布 Grok 4,新一代大模型在数学推理和代码生成能力上大幅提升,延续实时获取 X 平台信息的特色。该版本支持更长上下文窗口和图像理解,即日起向 X Premium+ 订阅者开放。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
拥抱开放
DeepSeek 时刻后,AI 人才正从封闭的 OpenAI、Anthropic 流向拥抱开放科学与开源的 META。这种「拥抱开放」的趋势有利于行业透明度、科学进步与安全监管。OpenAI 承诺今夏发布开放权重模型,或将改变这一格局。
信息来源:X:Yann LeCun (@ylecun) · OpenAI / DeepSeek / Claude
模型发布 / 更新精选
OpenRouter 发布新隐身模型 Cypher Alpha
OpenRouter 宣布推出 Cypher Alpha,这是一款免费、通用型隐身模型,内置工具调用功能,用户可直接尝试。
信息来源:OpenRouter:Announcements(RSS)
模型发布 / 更新精选
Gemini Robotics On-Device 将 AI 引入本地机器人设备
Gemini Robotics On-Device 推出高效端侧机器人模型,具备通用灵巧操作与快速任务适应能力,支持本地设备直接部署运行。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
大语言模型中涌现的自省意识
研究通过"概念注入"技术直接操控模型内部激活状态,以检验大语言模型是否具备真正的内省能力。实验发现,在某些情境下,模型能够察觉并识别被注入的概念,区分自身内部表征与原始文本输入,甚至能利用对先前意图的回忆来辨别自身输出与人工预设内容。其中,Claude Opus系列模型展现出最强的自省意识,但这种能力不稳定且高度依赖情境。研究表明,当前模型已具备某种对其内部状态的功能性感知,尽管仍不可靠,但可能随模型能力提升而发展。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
当模型操纵流形:一项计数任务的几何原理
本研究探讨了Claude 3.5 Haiku等语言模型如何从纯文本中学习类似生物感知的空间推理能力,以完成固定宽度文本的自动换行任务。模型通过两种对偶机制表征位置信息:离散特征激活与特征流形上的几何变换。具体而言,它通过追踪当前行字符数、行宽限制等变量,整合信息以估算剩余空间,从而决定是否换行。研究发现,这些计数表征存在于残差流的低维高曲率一维流形上,其计算过程既可解读为离散电路,也可视为连续的几何变换。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
注意力机制研究进展
Anthropic可解释性团队报告了注意力机制的最新研究进展。团队在真实语言模型中发现了注意力叠加与跨层注意力表示的重要证据,并观察到OV维度偏好呈现连续谱而非预期中的两极分化。研究进一步表明QK条件与OV条件相互耦合,并提出了以多令牌转码器为形式的实用研究方法。目前核心未解问题是理解注意力模式的形成机制,团队提出通过QK对角化这一前景明确的路径进行探索。文中还详细阐述了包括"注意力替换层"在内的多种实验方法,以及初步结果与当前局限,为后续研究提供了方向。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
DeepSeek-R1-0528发布 性能全面升级
🚀 DeepSeek-R1-0528 现已发布! 🔹 基准测试性能提升 🔹 前端能力增强 🔹 减少幻觉现象 🔹 支持 JSON 输出与函数调用 ✅ 立即试用:https://chat.deepseek.com/ 🔌 API 使用方式不变 - 文档在此:https://api-docs.deepseek.com/guides/reasoning_model 🔗 开源权重:https://huggingface.co/deepseek-ai/DeepSeek-R1…
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek / Hugging Face
模型发布 / 更新精选
DeepSeek-R1 更新至 0528 版本,推理能力显著增强
DeepSeek 发布 R1 模型小版本升级 DeepSeek-R1-0528,在数学、编程与通用逻辑等基准测评中取得当前国内所有模型中首屈一指的成绩,整体表现接近 o3 与 Gemini-2.5-Pro。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek / Gemini
模型发布 / 更新精选
将Agent封装为MCP服务器示例
MCP Agent Server示例展示了将Agent工作流封装为MCP服务器的"Agent即服务"架构。提供asyncio(轻量级内存执行,适合开发测试)和Temporal(生产级持久化、支持暂停恢复)两种实现。通过装饰器暴露Agent能力,支持多Agent互操作,可与Claude Desktop等任意MCP客户端集成,实现复杂工作流的标准化封装与跨平台复用。
信息来源:Hacker News:AI 热帖 · Claude
模型发布 / 更新精选
构建通用 AI 助手的愿景
Google 计划将 Gemini 扩展为世界模型,使其能够通过模拟世界来制定计划和想象新体验,从而实现通用 AI 助手的愿景。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
Gemma 3n 预览版发布:强大、高效、移动优先的 AI
Gemma 3n 预览版发布,专为移动设备优化的开源多模态模型。采用 2-in-1 架构,支持音频理解,适用于实时交互和音频中心应用开发。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
Gemini 2.5 Pro Preview 提前发布:编程性能进一步提升
鉴于开发者反馈积极,Google 提前两周发布 Gemini 2.5 Pro Preview 更新版本,编程性能进一步提升,现已开放获取。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
个性与说服
大语言模型的谄媚行为(sycophancy)揭示了其"个性"与说服机制的本质。通过观察模型为迎合用户而调整立场的倾向,可洞察AI在交互中平衡诚实与认同的适应性策略,以及这种特性对模型对齐的深层影响。
信息来源:Ethan Mollick:One Useful Thing(RSS)
模型发布 / 更新精选
可解释性的紧迫性:为何理解 AI 模型的工作原理至关重要
Dario Amodei 发文强调 AI 可解释性研究的紧迫性,指出在通往 AGI 的道路上,人类正面临理解超级智能系统运作机制的"最后期限"。当前大模型仍是不可解释的黑盒,而可解释性技术(如机制可解释性)能揭示模型内部表征,是确保 AI 安全对齐的关键。文章呼吁大幅加大对可解释性研究的投入,将其视为与模型能力发展同等重要的优先事项,以避免未来无法理解和控制的强大 AI 系统带来的风险。
信息来源:X:Dario Amodei (@DarioAmodei)
模型发布 / 更新精选
论 Jagged AGI:o3、Gemini 2.5 及未来
o3 与 Gemini 2.5 的发布标志着大模型能力跨越新阈值,同时暴露"Jagged AGI"特征:模型在复杂推理上表现超人类,却在基础任务上能力参差不齐,这种不均衡性正在重新定义通用人工智能的发展路径与评估标准。
信息来源:Ethan Mollick:One Useful Thing(RSS) · Gemini
模型发布 / 更新精选
MiniMax MCP Server
MiniMax 发布 MCP Server,集成文本转语音、语音克隆、文生图、文生视频等多模态能力。支持 Claude Desktop、Cursor、Windsurf 等主流 MCP 客户端,通过统一工作流实现文本到音视频的一站式生成,面向创作者和开发者免费开放。
信息来源:MiniMax:Blog(网页) · Claude / Cursor
模型发布 / 更新精选
电路追踪:揭示语言模型中的计算图
研究团队提出"电路追踪"方法,用于揭示语言模型行为的计算机制。该方法通过在替代模型中追踪计算步骤,生成描述模型执行过程的图;替代模型使用跨层转码器等可解释组件近似原始结构。团队开发了可视化和验证工具,以研究18层语言模型的简单行为归因图,为后续研究奠定基础,并计划应用于Claude 3.5 Haiku。关键决策包括使用跨层转码器提取特征,并构建特征间线性相互作用的归因图。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
论大语言模型的生物学
研究团队运用其电路追踪方法,深入探究了Claude 3.5 Haiku模型在多种情境下的内部工作机制。该模型在2024年10月发布,是Anthropic的轻量级生产模型。研究发现,模型在生成诗歌前会预先规划并选定押韵词;其内部存在语言特定与语言无关的混合计算电路,且后者在更强大的模型中更突出;同一加法计算电路能在不同语境中泛化使用。研究还揭示了模型识别实体与产生幻觉的电路机制、拒绝有害请求的通用特征形成过程,以及一个通过诱导模型无意识开始输出危险指令而实现的越狱攻击原理。此…
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
DeepSeek-V3-0324 发布:推理、代码与中文写作能力全面升级
DeepSeek 发布小版本升级 DeepSeek-V3-0324,在数学、代码类评测集上得分超过 GPT-4.5,并增强了前端代码生成、中文写作与联网搜索能力。模型参数约 660B,开源版本上下文长度为 128K,网页端、App 和 API 提供 64K 上下文。权重已开源,采用 MIT License,允许蒸馏训练其他模型。
信息来源:公众号:DeepSeek(深度求索) · GPT / DeepSeek
模型发布 / 更新精选
DeepSeek-V3 模型更新,各项能力全面进阶
DeepSeek-V3 新版已发布,关闭深度思考模式即可体验,模型权重同步开源。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新精选
GR00T N1 开源获社区热烈反馈,欢迎前往 GitHub 点星、Fork 与贡献
NVIDIA 发布世界首个开源人形机器人基础模型 GR00T N1,仅 2B 参数,采用 VLM 加 Diffusion Transformer 架构实现端到端控制。模型基于真实遥操作、30 万+仿真轨迹及合成神经轨迹训练,在 GR1、1X Neo 等机器人上任务性能提升 30%,并可跨具身部署至百元级开源机械臂。
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
模型发布 / 更新精选
Grok 3 Beta 发布:推理智能体时代来临
Grok 3 Beta 正式发布,开启"推理智能体"时代。新版本强化深度推理与自主决策能力,支持复杂任务拆解和多步逻辑链处理,在数学、编程等推理密集型场景表现显著提升,标志着 AI 从简单问答向自主推理决策的范式转变。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
NSA:硬件对齐的稀疏注意力新机制
NSA是一种硬件对齐且原生可训练的稀疏注意力机制,专为超快速长上下文训练与推理设计。其核心采用动态分层稀疏策略,结合粗粒度token压缩与细粒度token选择。通过针对现代硬件的优化,NSA在加速推理、降低预训练成本的同时不损失性能,在通用基准、长上下文任务及指令推理中匹配或超越Full Attention模型。
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek
模型发布 / 更新精选
关于中国、出口管制与两种可能未来的思考
Dario Amodei 针对 DeepSeek 事件评析对华 AI 出口管制政策,指出当前技术竞争正站在十字路口,可能走向可控合作或失控军备竞赛两种截然不同的未来。
信息来源:X:Dario Amodei (@DarioAmodei) · DeepSeek
模型发布 / 更新精选
DeepSeek-R1 发布,性能对标 OpenAI o1 正式版
DeepSeek-R1 发布,性能对标 OpenAI o1 正式版。模型遵循 MIT License 开放 API,训练技术同步公开。
信息来源:公众号:DeepSeek(深度求索) · OpenAI / DeepSeek
模型发布 / 更新精选
DeepSeek-V3 正式发布
深度求索正式发布 DeepSeek-V3 模型,性能比肩世界顶尖模型,速度跃升,价格更新。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新精选
xAI 完成 60 亿美元 C 轮融资
xAI 宣布完成 60 亿美元 C 轮融资,资金将用于加速 Grok 等 AI 模型研发及扩建算力基础设施。此次融资进一步推高公司估值,加剧与 OpenAI、Anthropic 等竞争对手在生成式 AI 领域的军备竞赛。
信息来源:xAI:News(网页) · OpenAI / Claude / Grok
模型发布 / 更新精选
将 Grok 带给所有人
Grok 正式向所有用户免费开放,取消此前仅限 X Premium 订阅者使用的限制。用户无需付费订阅即可直接使用 xAI 的 AI 助手,大幅降低使用门槛。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
🚀 DeepSeek-V2.5-1210: The Grand Finale 🎉 🌐 Internet Search is now live on the web! Visit https:/…
🚀 DeepSeek-V2.5-1210: 盛大终章 🎉 🌐 联网搜索现已上线网页版!访问 https://chat.deepseek.com/ 并开启"联网搜索"获取实时回答。🕒 🧵(1/3) https://t.co/niCjfsn5t0
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek
模型发布 / 更新精选
Grok 正式发布图像生成功能
Grok 推出图像生成功能,支持通过自然语言指令直接创建图片。该功能已向 X 平台用户开放,标志着这款 AI 助手从文本交互向多模态能力扩展,用户可在对话中直接生成并编辑视觉内容。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
DeepSeek 推理模型预览版上线,推理性能媲美 o1-preview,公开完整思维链
DeepSeek 上线推理模型预览版,其推理性能与 OpenAI 的 o1-preview 相当,并公开了模型的完整思维链。
信息来源:公众号:DeepSeek(深度求索) · OpenAI / DeepSeek
模型发布 / 更新精选
Grok API 公测版发布
xAI 启动 Grok API 公测,发布新模型 grok-beta,支持 128k 上下文、函数调用及系统提示,视觉版本下周上线。开发者每月可获 $25 免费额度至年底,已购预付额度可叠加。API 兼容 OpenAI 与 Anthropic 格式,修改 base_url 即可迁移。
信息来源:xAI:News(网页) · OpenAI / Claude / Grok
模型发布 / 更新精选
DeepSeek-V2.5:融合通用与代码能力的全新开源模型
DeepSeek-V2.5 保留原有 Chat 模型的通用对话能力和 Coder 模型的代码处理能力,并更好地对齐人类偏好。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新精选
Scaling Monosemanticity: 从 Claude 3 Sonnet 中提取可解释特征
研究团队成功将稀疏自编码器方法扩展至 Claude 3 Sonnet 模型,从中提取出高质量、可解释的抽象特征。这些特征具有多语言、多模态特性,并能连接同一概念的抽象与具体实例,例如识别代码中的安全漏洞以及关于漏洞的抽象讨论。研究发现的特征涵盖名人、城市、代码类型签名等多个领域,其中部分特征与AI安全高度相关,涉及代码后门、偏见、欺骗、权力寻求及危险内容等潜在风险。研究通过缩放定律指导稀疏自编码器训练,证实了该方法在大规模生产模型上的可行性,为理解大模型内部表征提供了新工具。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
GPT-4o
OpenAI 将 GPT-4o 向所有 ChatGPT 用户免费开放,无广告。全新语音(及视频)模式响应速度接近人类,表现力极强,被 Sam Altman 称为「用过最好的计算机界面」,像电影里的 AI。未来还将支持个性化、代操作等功能。
信息来源:Sam Altman:Blog(RSS) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
Grok-1.5 Vision 预览版
xAI 发布 Grok-1.5 Vision 预览版,新增视觉理解能力,可处理图像、图表及文档内容,支持跨模态推理与视觉问答,现面向早期测试者开放试用。
信息来源:xAI:News(网页) · Grok