AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章922
当前页12 / 24
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新精选
Mistral OCR 4
Mistral AI 发布 OCR 4,新增边界框、块分类(标题、表格、方程式、签名等)及逐页逐词置信度分数。支持 170 种语言、10 个语系,可单容器全自托管部署。在 OlmOCRBench 上得分 85.20,独立标注者偏好率平均 72%。定价每 1000 页 $4,Batch API 享 50% 折扣。可通过 API 或 Mistral Studio 的 Document AI 调用。
信息来源:Mistral AI:News(网页) · Mistral
模型发布 / 更新精选
网易有道发布 Confucius4-TTS:14 语种跨语种无口音语音克隆开源模型
网易有道推出"子曰 4.0"TTS 引擎 Confucius4-TTS,声称是业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型。用户仅需 3 秒音频即可实现零样本音色克隆,克隆音色与原声相似度超 85%,任务准确度达 97%。模型支持中文、英语等 14 种语言,首创音频 Prompt 情感克隆迁移。底层采用 GPT 式语义大模型、SSL 预训练特征与 ECAPA-TDNN 说话人编码器、Flow Matching 框架。已全量开源(Apach…
信息来源:IT之家(RSS) · GPT
模型发布 / 更新精选
京东全栈开源JoyAI-VL-Interaction,从"一问一答"走向"边看边说"
京东近日开源全球首个全栈交互模型JoyAI-VL-Interaction,获vLLM-Omni原生支持。该模型能持续观察视频流、主动判断关键事件并实时响应,支持将复杂任务委托后台Agent处理。在58个真人盲评中,对比豆包视频通话助手胜率77.6%,对比Gemini视频通话助手胜率87.9%,监控预警场景达100%胜率。开源内容包括模型权重、交互数据集、训练方案及完整可部署系统,支持摄像头、直播流等视频输入及语音交互、长期记忆、vLLM部署,适用于安防监控、老人看护、直播讲…
信息来源:公众号:京东JoyAI · Gemini / 豆包
模型发布 / 更新精选
豆包音频生成模型1.0发布,重新定义AI音频创作
火山引擎正式发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),支持文本与音频参考生成,端到端输出目标音频。单条Prompt可编排多角色对白、情绪语气、背景音乐及环境氛围,长时生成中保持多角色音色一致性,无需后期多轨混音。模型支持0样本多模态输入,无需额外训练即可生成;实现音色与风格解耦控制及"一声多角"能力。一次支持2分钟音频创作,多次延长保持音色统一。已开启火山方舟API邀测,个人用户享30分钟创作额度,即将上线剪映、即梦、番茄等产品。
信息来源:公众号:火山引擎 · 豆包
模型发布 / 更新精选
Qwen-AgentWorld:面向通用智能体的语言世界模型
Qwen 团队发布 Qwen-AgentWorld,一个以环境建模为训练目标的原生语言世界模型,在单个模型中模拟 MCP、Search、Terminal、SWE 及 GUI 域(Web、OS、Android)共七个域。模型使用超 1000 万条真实交互轨迹训练,在 AgentWorldBench 上以 Qwen-AgentWorld-397B-A17B 版本达最高模拟质量,超越 GPT-5.4、Claude Opus 4.8 和 Gemini 3.1 Pro。同时发布评测基…
信息来源:Qwen:Blog Retrieval(API) · GPT / Qwen / Claude
模型发布 / 更新精选
Seed2.1 正式发布,深入 AI 生产力
字节Seed发布Seed2.1系列,面向真实生产力场景的智能体,强化通用Agent能力、代码工程交付与多模态理解。Seed2.1 Pro在GDPval基准获最高分,Agents' Last Exam位列参评模型第一梯队;MobileWorld手机GUI任务最高分,CreativeWork多环境任务表现突出。多模态在CharXiv-RQ等多项基准取得SOTA。代码能力上,Seed2.1 Pro在NL2Repo-Bench表现良好,开发者评测相比Claude Opus 4.6获…
信息来源:字节 Seed:Research Feed(网页内嵌数据) · Claude / 豆包
模型发布 / 更新精选
OpenAI 发布 GPT-5.5-Cyber 在 CyberGym 击败 Mythos 5,扩大 Daybreak 网络安全计划
OpenAI 新模型 GPT-5.5-Cyber 在 CyberGym 基准上击败 Mythos 5,该基准测试 AI 智能体复现已知软件漏洞的能力,对防御性漏洞分析是强信号。OpenAI 同步扩大 Daybreak 计划,包括:Codex Security 插件(在 Codex 内发现、验证并修复漏洞);GPT-5.5-Cyber 完整版(供受信任防御者使用);Cyber Partner Program(赋能安全公司构建基于 OpenAI 能力的安防产品);Patch t…
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / GPT
模型发布 / 更新精选
PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M
PP-OCRv6 是 PaddleOCR 最新一代通用 OCR 模型族,提供 tiny(1.5M)、small(7.7M)和 medium(34.5M)三级。medium 和 small 支持 50 种语言(简体/繁体中文、英文、日文及 46 种拉丁语系)。在官方多场景基准上,medium 检测 Hmean 86.2%,识别准确率 83.2%,较 PP-OCRv5_server 分别提升 +4.6 和 +5.1 个百分点。模型采用 PPLCNetV4 统一骨干、RepLKF…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
让大模型从"一问一答"走向"边看边说",京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction
京东官方宣布开源实时视频视觉语言交互模型 JoyAI-VL-Interaction,这是全球首个全栈开源的 interaction 模型和系统,获 vLLM-Omni day-0 原生支持。该模型具备三重突破:主动判断(持续观察视频流自主决定何时说话)、实时响应(面向正在发生的视频流即时响应)、适时智能体委托(复杂任务转交后台模型,前台继续观察)。支持摄像头、直播流、监控流等视频输入,以及语音输入输出、可视化界面、长期记忆和 vLLM 部署。在 58 个真人盲评案例中,对比…
信息来源:IT之家(RSS) · Gemini / 豆包
模型发布 / 更新精选
Grok TTS 盲测人类感得分96登顶
xAI 的 Grok TTS 模型在 @Vapi_AI 的 Humanness Index 盲测中以 96 分(真人 100 分)位居榜首。该指数选取同一声音和引文,经各模型克隆后由听众盲评。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
模型发布 / 更新精选
火山引擎上线豆包实时语音模型3.0 API 服务,开启邀测
火山引擎上线豆包实时语音模型3.0(Seeduplex)API 服务并开启邀测。该模型为原生全双工端到端语音大模型,具备精准遵循、抗干扰、动态判停三大优势。可在多人对话中安静待命,指定话题出现时主动加入;支持通过自定义工具在实时交互中完成预定日历、发送邮件等任务。抗干扰力提升,误回复率与误打断率大幅降低;判停延迟缩短约250ms,复杂场景抢话比例下降40%,用户主动打断延迟缩短约300ms。适用于汽车智能座舱、智能硬件、智能客服等场景。
信息来源:公众号:火山引擎 · 豆包
模型发布 / 更新精选
统一科学大模型 LOGOS 正式开源
LOGOS 是由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源的基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B 仅用 1/56 参数量即在多个任务上超越 NatureLM,逆合成预测 Top-1 准确率达 74.8%。模型涵盖 7 类模态、44.87B tokens 预训练语料,无需 3D 坐标,已开源模型权重、推理代码与技术报告。
信息来源:公众号:通义实验室(千问) · Qwen
模型发布 / 更新精选
首个统一科学大模型 LOGOS 正式开源
LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域专用方法:口袋条件配体生成纯序列范式首次超越3D扩散模型,超越NatureLM(8×7B);逆合成预测Top-1准确率74.8%;口袋位点识别仅靠序列达58.5% Top-n准确率;MOF材料生成NBB提升至17.78%。模型采用统一词汇表将蛋白质、小分子等编码为离散Token…
信息来源:公众号:通义实验室(千问) · Qwen
模型发布 / 更新精选
MolmoMotion:语言引导的3D运动预测模型
MolmoMotion基于Molmo 2骨干网络,输入视频帧、物体上的3D点标记及文字动作指令(如"移动并旋转桌上放水果的木碗"),预测未来数秒内这些点的3D轨迹。提供两个变体:自回归的MolmoMotion-AR逐步预测坐标,流匹配的MolmoMotion-FM通过连续空间变换处理多可能性运动。同时发布MolmoMotion-1M数据集(含116万视频的3D点轨迹及动作描述)和PointMotionBench基准测试(2700个人工验证视频片段)。模型权重、数据集和基准测…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
GLM-5.2:为长周期任务而生
GLM-5.2 发布,支持 1M token 上下文,采用 IndexShare 架构--每 4 个稀疏注意力层共用一个轻量索引器,将 1M 上下文下每 token FLOPs 降低 2.9 倍;MTP 层改进使推测解码接受长度提升 20%。长周期编码基准上,FrontierSWE 落后 Opus 4.8 仅 1%、领先 GPT-5.5 1%;PostTrainBench 仅次于 Opus 4.8;SWE-Marathon 落后 Opus 4.8 13% 但排名第二。标准编…
信息来源:Hugging Face:Blog(RSS) · GPT / GLM / Hugging Face
模型发布 / 更新精选
MiniMax 发布 MSA 稀疏注意力方法,开源推理内核并推出 MiniMax-M3 模型
MiniMax 发布 MSA(MiniMax Sparse Attention),一种构建在 Grouped Query Attention 上的稀疏注意力方法。它将注意力分解为索引分支与主分支:索引分支以块粒度(默认 128 token)为每个 GQA 组选择 16 个 token 块(固定预算 2048 个键值 token),主分支仅在这些块上执行精确 softmax 注意力。MSA 在 109B 参数 MoE 模型上训练,开源了面向 NVIDIA SM100 GPU …
信息来源:MarkTechPost(RSS) · NVIDIA
模型发布 / 更新精选
GLM-5.2 开源登顶全球评测,与 Opus 4.8 持平
智谱今日开源 GLM-5.2,在 Artificial Analysis 综合评测中以 51 分排名全球前三、开源模型第一,与 Claude Opus 4.8 持平。该模型在 Code Arena 前端代码生成中获 1,595 分排名第二,在 DesignArena 设计编码场景中以 1,360 分夺冠,并在软件工程基准 FrontierSWE 中位列第三。
信息来源:X:唐杰(@jietang) · GPT / Claude / GLM
模型发布 / 更新精选
Sumi:从头训练的7B开源均匀扩散语言模型
Sumi(日语"墨")是一个完全开源的7B参数均匀扩散语言模型,从零开始在1.5T模型token上预训练。它在知识、推理和编程评测中与同等token预算的自回归模型表现相当,但在常识推理benchmark上略逊,教育密集型数据混合可能是原因之一。Sumi开放模型权重、检查点及完整训练配方(含公开语料数据混合说明),为社区提供首个大规模均匀扩散模型的基准参考。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
Grok 4.3 在 Amazon Bedrock 正式可用
6 月 17 日,xAI 宣布 Grok 4.3 在 Amazon Bedrock 上全面可用。该模型在前沿模型中达成最低幻觉率,支持 100 万 token 上下文窗口,并提供可配置推理努力(none/low/medium/high)。在 Artificial Analysis Omniscience 基准排名第一,在 Tau2 Telecom 基准评估客服智能体真实工具调用性能排名第一,在 Vals AI Case Law 和 Corporate Finance 基准的…
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
智谱发布旗舰模型 GLM-5.2,实现稳定 1M token 长程任务能力
智谱发布 GLM-5.2,首次在 1M token 上下文中实现稳定长程任务能力。其 IndexShare 架构将每四个稀疏注意力层共享同一索引器,使 1M 上下文下每 token FLOPs 降低 2.9 倍。模型采用 MIT 开源协议,无区域限制。
信息来源:X:唐杰(@jietang) · GLM
模型发布 / 更新精选
Kimi K2.7 Code发布:专注编码的智能体模型,接近GPT5.5
硅基流动上线月之暗面Kimi K2.7 Code模型。基于K2.6改进,专注编码与智能体任务。32B激活/1T总参,VLM多模态,支持交错思考与多步工具调用。相比K2.6,推理token使用减少30%,减少过度思考;长程编码任务指令遵循和完成率提升。性能接近GPT5.5与Opus 4.8。价格:缓存输入0.19/输入0.94/输出4.00每百万token。
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · GPT / Kimi
模型发布 / 更新精选
Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型
Cartesia 推出 Sonic 3.5 和 Ink 2 两个模型,作为单一实时语音栈,分别负责文本转语音和语音转文本。Ink 2 在 Artificial Analysis 的流式语音转文字排行榜上排名第一。Sonic 3.5 在实时文本转语音中位列榜首,首音频延迟约 82ms。Cartesia 成为目前唯一同时拥有 #1 听与说模型的提供商。
信息来源:X:Testing Catalog (@testingcatalog)
模型发布 / 更新精选
Qwen-Robot 发布:通义实验室用三模型打通大模型到物理世界
通义实验室发布 Qwen-Robot 套件,以 Qwen-RobotNav、Qwen-RobotManip、Qwen-RobotWorld 三个模型分别覆盖导航、操作与世界预测,统一采用语言优先接口。
信息来源:公众号:通义实验室(千问) · Qwen
模型发布 / 更新精选
蚂蚁百灵发布 Ling & Ring 2.6 技术报告
蚂蚁百灵发布 Ling & Ring 2.6 技术报告,公开 2.6 系列在架构、预训练、后训练及 Agent 强化学习等细节。该系列采用 Lightning Attention 与 MLA 以 7:1 比例结合的混合线性注意力架构,预训练处理约 9.6T tokens,上下文扩展至 256K。
信息来源:公众号:蚂蚁百灵(Ling)
模型发布 / 更新精选
Qwen-Robot Suite:面向物理世界智能的基础模型套件
Qwen 发布三款基础模型--Qwen-RobotNav、Qwen-RobotManip 和 Qwen-RobotWorld。Nav 通过可控观测协议统一指令跟随、点/物体目标导航、目标追踪和自动驾驶五类任务,在 VLN-CE RxR 上达 76.5% SR,HM3Dv2 物体目标导航(仅 RGB)75.6% SR,EVT-Bench 追踪率 90.0%,NAVSIM 91.4 PDMS。Manip 利用规范状态-动作空间对超 38,100 小时异构开源机器人数据进行跨本体…
信息来源:Qwen:Blog Retrieval(API) · Qwen
模型发布 / 更新精选
成本砍半,字节跳动推出 Seedance 2.0 Mini 视频生成模型
字节跳动火山引擎旗下火山方舟体验中心于 6 月 15 日上线 Seedance 2.0 Mini 视频生成模型,计划近期开放 API。该模型比 Seedance 2.0 Fast 快 2 倍,输出质量相当。图生视频定价 0.023 元/千 tokens,视频生视频 0.014 元/千 tokens,720P 规格下单秒生成成本约 0.5 元,较 Seedance 2.0 标准版降低约一半。模型面向电商内容生产、营销素材批量生成、UGC 创作及特效玩法等高频率、大规模视频生成…
信息来源:IT之家(RSS)
模型发布 / 更新精选
Qwen-RobotManip:对齐解锁机器人操作基础模型的规模化能力
Qwen-RobotManip 是通义千问基于 Qwen-VL 的视觉-语言-动作(VLA)基础模型,引入覆盖表示、运动和行为三维度的统一对齐框架。仅使用开源机器人数据集和人演示视频,构建约 38,100 小时预训练语料,涵盖 15 种机器人形态。在 LIBERO-Plus 达 91.4%,RoboTwin-C2R Hard 达 69.4%,RoboCasa365 Composite-Unseen 达 14.9%,EBench 达 45.6%,RoboTwin-IF 达 7…
信息来源:Qwen:Blog Retrieval(API) · Qwen
模型发布 / 更新精选
Qwen-RobotWorld:具身智能体的无界世界
Qwen-RobotWorld以语言为统一动作接口,采用双流Multimodal Diffusion Transformer(MMDiT)架构,将Qwen2.5-VL作为动作编码器。在4个基准测试中取得顶尖成绩,统一20余种机器人形态,基于860万跨场景训练对和1300多项操作技能。语言接口标准化500多种动作类别,支持操作、自动驾驶、室内导航的联合训练。还支持Scene2Robot人类到机器人转移及2-4路多视角几何一致视频生成。
信息来源:Qwen:Blog Retrieval(API) · Qwen
模型发布 / 更新精选
xAI 发布 Grok Imagine Video 1.5
xAI 将 Grok Imagine Video 1.5 从预览转为全面可用,在 Imagine API 上提供 `grok-imagine-video-1.5`,并在 grok.com/imagine 及 iOS/Android 应用上推出 Video 1.5 Fast 版。相比前代,模型在音频与语音(更清晰、嘴型同步更好)、运动与物理(更连贯、重量感更真实)、生成速度(6 秒 720p 视频约 25 秒,此前超 40 秒)上全面提升。同时逐步推出 Projects、Mu…
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
MiniMax 开源 M3 模型权重及 MSA 技术论文
MiniMax 上周五开源了 428B 总参数、23B 激活参数的 M3 模型权重,同步发布 MSA(MiniMax Sparse Attention)技术论文,该架构显著降低长上下文计算成本。M3 是首个从预训练阶段就进行文本、图像等多模态交错混合训练的开源模型。发布两周后,M3 在 Artificial Analysis 综合智能指数、GDPval-AA 排行榜均获开源模型第一,Code Arena WebDev 跻身帕累托最优序列,Vals.AI 榜单居国产模型首位。…
信息来源:公众号:MiniMax(稀宇科技)
模型发布 / 更新精选
Kimi K2.7 Code 高速版上线:输出速度约 5-6 倍,API 定价为普通版 2 倍
Kimi K2.7 Code 高速版已上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景下约 180 Token/s,短上下文可达 260 Token/s,API 定价为普通版的 2 倍。
信息来源:公众号:月之暗面(Kimi) · Kimi
模型发布 / 更新精选
里约热内卢市政府 AI 模型 Rio3.5 在基准测试中击败 Qwen3.7
里约热内卢市政府开发的 AI 模型 Rio3.5,在近期基准测试中超越了 Qwen3.7。该消息源自 Hacker News 上的一篇帖子,指出 Rio3.5 在多项评测中表现优于 Qwen3.7。目前尚未公开具体的测试细节或基准名称。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
模型发布 / 更新精选
下一代投机解码:DFlash 与 Spec V2
Z Lab、Modal 与 SGLang 团队联合发布 DFlash 投机解码模型和 SGLang 的默认 Spec V2 引擎。DFlash 采用块扩散+KV 注入并行生成整块 draft token,在 Qwen 3.5 397B-A17B(BF16)的 HumanEval 数据集上、并发 1 时吞吐量达到基线的 4.3
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
模型发布 / 更新精选
智谱GLM-5.2开源发布,支持1M上下文
智谱发布最强开源模型GLM-5.2,面向所有GLM Coding Plan用户(Lite/Pro/Max)开放。该模型支持真正可用的100万上下文窗口,在长程任务独立完成方面保持领先,适合构建复杂AI智能体应用,也是国产最强编码模型的核心引擎。面对外部封锁限制,智谱强调科学全球性、AGI不应被高墙垄断,采取激进开源态度。GLM-5.2的开源与API预计下周同步上线。
信息来源:X:Testing Catalog (@testingcatalog) · GLM
模型发布 / 更新精选
GLM-5.2 全量开放:智谱最强开源模型支持 1M 上下文
智谱发布迄今能力最强的开源模型 GLM-5.2,支持真正可用的 1M 上下文,并在长程任务中继续保持领先,同时也是其最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM
模型发布 / 更新精选
智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源
GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Max、团队版)。API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM
模型发布 / 更新精选
Ling-2.6与Ring-2.6技术报告:高效即时的万亿参数智能体智能
Ling-2.6优化即时响应与输出token能力,Ring-2.6针对深度推理和复杂智能体工作流。基于Ling-2.0通过架构迁移预训练和大规模后训练升级。架构引入融合Lightning Attention与MLA的混合线性注意力设计,提升长上下文训练与解码效率。通过进化思维链、语言单元策略优化、双向偏好对齐和最短正确响应蒸馏优化token效率。提出KPop强化学习框架支持Ring-2.6-1T在环境交互数据上稳定训练,通过异步调度提升编码、搜索、工具使用和工作流执行的训练…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
MiniMax M3 获 vLLM 日零支持,1M 上下文窗口与 MSA 稀疏注意力
MiniMax M3 发布,具备前沿编码与智能体能力,原生图像视频输入和计算机使用,1M-token 上下文。核心采用 MSA 稀疏注意力:每个 query 评分 128-token KV 块,仅对 top 块做注意力。vLLM 当日即支持 M3,包括专用 MSA prefill/decode 核、前缀缓存与分块 prefill、BF16 和 MXFP8 检查点、Hopper 与 Blackwell 的 MoE 后端,并在 NVIDIA 与 AMD 硬件上验证。同时支持原生…
信息来源:X:MiniMax (@MiniMax_AI) · NVIDIA
模型发布 / 更新精选
MiniMax M3 开源权重模型发布,已上架 HuggingFace
MiniMax 发布开源权重模型 M3,约 428B 总参数、23B 激活参数,已上传 HuggingFace。该模型融合三种前沿能力:编码与智能体方面达 59.0% SWE-Bench Pro、66.0% Terminal Bench 2.1、34.8% SWE-fficiency、28.8% KernelBench Hard、74.2% MCP Atlas;采用 MiniMax 稀疏注意力将上下文窗口扩展至 1M token;原生多模态。同步上线 MiniMax Cod…
信息来源:X:MiniMax (@MiniMax_AI) · Hugging Face
模型发布 / 更新精选
Kimi 发布并开源最新代码模型 Kimi-K2.7-Code
Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推出,即日起可通过 Kimi API 和 Kimi Code 使用。
信息来源:X:Kimi.ai (@Kimi_Moonshot) · Kimi