AI 情报文章归档
浏览 AI圈报 已保存的 5751 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5751
正式分类6
精选内容3361
全部文章
第 41 / 144 页 · 每页 40 条
行业动态普通
OpenAI 曝光俄罗斯利用 ChatGPT 开展的隐蔽影响力行动
OpenAI 曝光并封禁了一批通过 VPN 从俄罗斯访问 ChatGPT 的账户,这些账户利用该模型生成内容,推广亲克里姆林宫叙事,为据称位于以色列的智库"国际伯克研究所"(IBI)造势。
信息来源:The Decoder:AI News(RSS) · OpenAI / ChatGPT
产品发布 / 更新普通
Suno Studio 2.0 融合传统 DAW 与最新技术
Suno Studio 2.0 弥合了传统 DAW 表现方式(如 MIDI 输入和实时音频效果)与我们最新技术之间的差距。 演奏它、调整它、完善它。🎹🎧 #Suno #SunoStudio2 #MusicTech #DAW
信息来源:X:Suno (@suno)
产品发布 / 更新普通
Gemini macOS 应用新增语音听写与摘要功能
在 macOS 版 Gemini 应用中,直接用语音在任意窗口内听写、总结文件并改写文案。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新普通
Perplexity 便携电脑智能体研究发布
新研究:Portable Computer 是一款本地优先的智能体,用于私密且经济高效的工作。 凭借设备端 27B 模型,我们的框架在真实知识工作中得分 82.6%,超越了开源框架 Pi 和 Hermes。我们后训练的 PPLX 27B 达到 85.4%。
信息来源:X:Perplexity (@perplexity_ai)
行业动态普通
Anthropic 因安全团队可能罢工,要求员工居家办公
Anthropic 因安全团队可能举行罢工,已要求员工居家办公。此举源于公司内部安全团队与管理层之间的紧张关系,罢工威胁可能影响公司运营。目前尚不清楚罢工是否最终成行,以及 Anthropic 将如何应对潜在的安全保障缺口。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新普通
Grok Bot 桌面端上线 DeepLink 插件
刚刚为 Grok @Bot 在桌面端上线了 deeplinks(移动端即将推出)! 试试安装 X 插件:grokbot://app/v1/plugin/add?id=49086599 当然还有 pstack:grokbot://app/v1/plugin/add?id=9717366
信息来源:X:Lauren Tan (@poteto) · Grok
行业动态普通
SpaceX 两大超级项目投资超千亿美元
SpaceX 三周内宣布两大超级项目,合计投资至少 1168 亿美元:得州 Terafab 全球最大芯片制造厂,路易斯安那州 Starbase 全球最大航天港。预计创造超 1.4 万个直接和间接岗位,其一生产用于地球和太空的 AI 芯片,另一支持每年数千次 Starship 发射。
信息来源:X:cb_doge (@cb_doge)
产品发布 / 更新精选
OpenWorker 新版发布,内置网络安全智能体
Andrew Ng 旗下开源智能体 OpenWorker 发布新版,强化安全工作流。其 harness 完全开源,安全团队可审计无后门。新版内置代码漏洞扫描、依赖供应链注入检测和云安全配置检查三类网络安全智能体,并支持本地运行开源权重模型以保护敏感代码。
信息来源:X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)
产品发布 / 更新普通
OpenAI Jalapeño芯片能效超越Vera Rubin
OpenAI 在 Hot Chips 大会上发布的全新 Jalapeño 芯片,在每兆瓦输出吞吐量上超越了 Vera Rubin 七月份的结果。(1/7)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI
产品发布 / 更新普通
GPT-Astra 用 Codex 优化 Jalapeño 芯片内核
OpenAI 博客透露,GPT-Astra 使用 Codex 编写并优化低层内核,让三款此前未规划的开放权重模型在两个月内于 Jalapeño 芯片上达到高性能。在选定的注意力与混合专家模块中,其实现比现有的人类专家代码快 1.5-1.8 倍。Jalapeño 在 OpenAI 自测中已超越 Nvidia GB200/GB300,计划 2026 年底部署。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / NVIDIA
产品发布 / 更新普通
Replit 免费模式:做更多,忧更少
在免费模式下,你实际上可以做得更多,同时担忧得更少。就是这么简单。
信息来源:X:Replit (@Replit)
模型发布 / 更新普通
Skild S1 机器人基础模型:视频即提示词
Skild 发布机器人基础模型 S1,用视频演示替代语言指令来定义任务。只需提供 1 段人类视频,S1 即可直接执行长达 10 分钟的多步骤新任务,无需重新训练或微调。若规模化,基础模型训练的高昂数据成本可摊薄至数千个新任务,有望改变机器人学习的经济性。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
LangSmith Engine 智能体问题检测能力提升 2 倍
LangSmith Engine 现可将智能体问题检测能力提升 2 倍以上,并提出更有效的修复建议。该引擎新增 Slack 与 Linear 工作流支持,同时提供自托管部署选项。
信息来源:LangChain:Blog(RSS)
产品发布 / 更新普通
OpenAI Jalapeño 芯片实测性能亮眼
OpenAI 首款自研推理芯片 Jalapeño 已在实验室完成实测,从概念到真实负载表现优异。该芯片在更高吞吐和更低延迟上实现"每瓦特更多智能",并与 Cerebras 深度合作推动 /ultrafast 高速推理,满足大量客户需求。
信息来源:X:Tibo (@thsottiaux) · OpenAI
产品发布 / 更新普通
OpenAI 自研推理芯片 Jalapeño 据称在推理基准测试中超越 Nvidia Blackwell 和 Rubin
OpenAI 在 Hot Chips 大会上首次展示自研推理芯片 Jalapeño 的基准测试结果,该芯片在每瓦吞吐量和 token 延迟上据称超越 Nvidia Blackwell 和 Rubin。
信息来源:The Decoder:AI News(RSS) · OpenAI / NVIDIA
论文研究普通
WebDev-Skills-Bench 评测:Agent 技能是否真的有用
WebDev-Skills-Bench 在 50 个 Web-Bench 项目和 1000 个有序任务上测试 31 个公开 WebDev 技能,发现注入目标技能使平均 Pass@2 下降 1.3% 至 4.2%,token 成本增加 72% 至 394%。对照实验将损害归因于长度干扰和内容误导两类失败模式,且技能排名在模型间迁移性弱。
信息来源:X:DAIR.AI (@dair_ai)
行业动态普通
Runway AI 峰会九月旧金山召开
更多演讲者将加入 Runway AI 峰会。今年九月在旧金山,来自机器人、自动驾驶、营销和基础设施领域的行业领袖将齐聚一堂,用一天时间探讨 AI 如何重塑智能与世界的交汇方式。 点击下方链接了解更多并注册。
信息来源:X:Runway (@runwayml)
行业动态普通
开发者冲击PR世界纪录仅剩6天
刚刚拿下了历史第4名的位置。距离打破2000个PR的世界纪录还有6天。
信息来源:X:Lauren Tan (@poteto)
产品发布 / 更新普通
OpenRouter 模型变体新增优先服务层支持
TIP 💡 我们的 :nitro 和 :floor 模型变体接入服务层级,而不仅仅是排序 示例:"~openai/gpt-latest:nitro" 将许多功能打包进一个模型标识中: 1. ~latest 别名解析为最新的 gpt 模型 2. :nitro 按实测吞吐量对端点排序 3. (新功能):nitro 将优先服务层端点纳入池中,与默认端点一同比拼速度
信息来源:X:OpenRouter (@OpenRouter) · OpenAI / GPT
产品发布 / 更新普通
Anthropic 合并聊天与 Claude Cowork 记忆系统,Claude 跨场景自动记住信息
Anthropic 宣布将聊天与 Claude Cowork 的记忆系统合并,Claude 在一个场景记住的信息会在另一场景自动可用,用户可查看、编辑或删除已保存记忆。更新后,Claude 会在对话过程中实时添加记忆主题,而非结束时总结。默认不存储健康、种族、政治等敏感信息,该功能默认在 Free、Pro 和 Max 套餐的网页、桌面及移动端启用。
信息来源:TechCrunch:AI(RSS) · Claude
产品发布 / 更新普通
Claude Code 将支持 Agents.MD 与系统提示词修改
Anthropic 正提升 Claude Code 的可扩展性,将支持用户轻松使用 Agents.MD 或修改系统提示词。团队认为不同模型族的系统提示词对性能影响显著,且 Claude Code 已为各模型配置不同提示词。短期内用户可在 Claude.MD 中通过 @Agents.MD 调用。
信息来源:X:Thariq (@trq212) · Claude
产品发布 / 更新普通
Krea 上线 Wan 3.0,支持 20 参考图与 30 秒带音频生成
Wan 3.0 现已登陆 Krea。 支持 20 张参考图像,以及 30 秒带音频的生成,成本仅为同类质量模型的零头。 立即体验 👇
信息来源:X:Krea AI (@krea_ai)
行业动态普通
OpenAI 为 ChatGPT Plus 用户恢复 Codex 和 ChatGPT Work 的 5 小时使用限制
OpenAI 宣布自明日起,为 ChatGPT Plus 订阅者恢复 Codex 和 ChatGPT Work 的 5 小时使用限制,此前数周仅保留每周用量上限。达到 5 小时或每周上限后,用户可等待重置或购买额外额度,OpenAI 也会不定期免费重置。Pro $100 和 Pro $200 订阅在未来数月内不受此 5 小时限制影响。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / ChatGPT
产品发布 / 更新普通
Meta AI 推出 MetaRoCE:面向 AI 规模以太网的全新 RDMA 传输协议
Meta 发布 MetaRoCE,一种为 AI 工作负载设计的全新 RDMA 传输协议,将网络视为有损链路,把排序、路径选择与恢复下沉到网卡,仅需交换机支持 ECN 与 ECMP。在 64 节点 AMD GPU 集群运行 RCCL 集合通信时,1% 丢包率下仍保持约 86% 吞吐量。Meta 将通过 Open Compute Project(OCP)发布规范、合规测试套件及参考软件实现。
信息来源:MarkTechPost(RSS) · Llama
行业动态普通
Anthropic 向投资者兜售超 30 万亿美元潜在营收
WSJ 报道,Anthropic 正向投资者推介超 30 万亿美元的潜在营收机会,超过 SpaceX 的 28.5 万亿美元估值。Testing Catalog 推测其中很大一部分将来自企业级业务,并好奇 OpenAI 是否有机会超越这一数字。
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI / Claude
产品发布 / 更新普通
OpenAI Jalapeño芯片实现效率与速度双提升
自发布我们的首款定制推理芯片 Jalapeño 以来,我们一直在对其及周边系统进行测试。 结果显示这是一项重大进步:每瓦特带来更多智能,响应速度更快,在同一架构中同时实现更高吞吐量和更低延迟,且不牺牲效率。
信息来源:X:OpenAI (@OpenAI) · OpenAI
观点 / 方法普通
AI软件工厂设计模式直播第71期
软件工厂设计模式:🦄 真正可用的 AI 第 71 期 https://x.com/i/broadcasts/1AGRnZYnYNrGl
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
产品发布 / 更新普通
Claude 记忆统一,Cowork 共享聊天上下文
Claude 现在在聊天和 Claude Cowork 之间拥有统一的记忆,由你决定其中包含什么内容。 把任务交给 Cowork,它会从 Claude 在聊天中已经了解的信息开始:你讨论过的项目、你经理的偏好,或者上个季度的客户。
信息来源:X:Claude (@claudeai) · Claude
行业动态普通
Anthropic IPO 或寻求 2 万亿美元估值
Anthropic 可能在 IPO 时向投资者宣称,Claude 等 AI 模型未来可执行的工作对应超 30 万亿美元潜在市场,超过 SpaceX 的 28.5 万亿美元估值。该公司或寻求约 2 万亿美元估值,并募资至多 1000 亿美元。
信息来源:X:Kim (@kimmonismus) · Claude / Grok
观点 / 方法普通
人形机器人金属腿上的纯粹意志力
金属腿上的纯粹意志力 手腕上的力感应必须直接接入平衡控制器 还有,当绳索角度变化时,机器人多么迅速地重新调整臀部重心
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
OpenClaw 回归在即,社区期待发布
本周。 【引用 @realcaptmarbles】:OpenClaw 看起来回来了,很期待。发布吧!
信息来源:X:Peter Steinberger (@steipete)
论文研究普通
终端智能体评测:脚手架比模型更影响分数
一项针对命令行环境AI智能体的综述发现,模型外围脚手架(scaffold)对基准分数的影响大于模型本身,系统间差异可测量而模型变体间差异不显著。同一脚手架内更强的模型变体未带来额外解决任务数,仅增加延迟。研究建议将脚手架选择视为一级工程决策。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Gemini Enterprise 首批法律与金融插件发布
Google 为 Gemini Enterprise 推出首批面向法律与金融场景的插件,将精选 Apps 与 Skills 按用途组合成捆绑包。未来捆绑包有望扩展至消费版 Gemini,但当前仅发布两个。合作生态涵盖 Accenture、Deloitte、KPMG 等全球系统集成商。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
观点 / 方法普通
两大实验室将掌控全球算力
Anthropic 和 OpenAI 有望在几年内控制全球大部分可用 FLOPs,因其能更好变现算力并出价超过所有对手。对话还探讨了本十年末超 10 万亿美元 AI 资本支出或引发主权债务危机,以及训练规模经济与算力稀缺推动行业集中化是否可被逆转。
信息来源:X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) · OpenAI / Claude / Hugging Face
观点 / 方法普通
Aletheia's Quest 回顾:构建 AI 谎言检测器的经验与教训
EleutherAI 在 Aletheia's Quest 项目中构建了黑盒与白盒两类 AI 欺骗检测器,并分享了过程中的关键经验。项目聚焦于识别模型输出中的不实信息,其方法覆盖了从外部行为观察到内部机制分析的不同路径。回顾总结了检测器在实际应用中的局限与未来改进方向。
信息来源:EleutherAI:Blog
论文研究普通
NVIDIA ACES:技能文档高分不等于运行时有效
NVIDIA 新论文提出 ACES 评估框架,指出技能文档得分高不代表智能体运行时真能受益--技能主要贡献是发现与工作流顺序,而非最终答案质量。ACES 固定任务、模型、沙箱等变量,仅对比有无目标技能两次运行的奖励差,定义为 Skill Lift。在生产技能实测中,结构与裁判评分与 Skill Lift 相关性仅 −0.0181 和 −0.0266,几乎为零。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
产品发布 / 更新普通
OpenAI 自研 Jalapeño 推理芯片公布首批性能数据
OpenAI 公布自研 AI 推理芯片 Jalapeño 的初步性能结果。在 InferenceX 上对三个公开模型的测试显示,其每瓦 AI 工作量提升 1.5-1.9 倍,端到端延迟降低 1.7-3.6 倍,高交互负载性能提升 2.1-4.1 倍。
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI
观点 / 方法普通
新Mac mini AI性能暴涨4倍,起售价涨至899美元
苹果发布新Mac mini,AI性能提升4倍,起售价从599涨至899美元。首发2nm M6芯片采用超核加能效核架构,每个GPU核心配备Neural Accelerator,本地LLM提示处理速度达上一代4.8倍。苹果将其定位为7x24小时常开的本地AI Agent服务器,标配2.5G网口和雷雳5接口。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
模型发布 / 更新普通
MAI-Image-2.6登顶图像编辑榜
Microsoft AI 发布 MAI-Image-2.6-Preview,在 Artificial Analysis 图像编辑排行榜登顶第一,文本生成图像位列第二(仅次于 OpenAI 的 GPT Image 2)。该模型在 19 个分类榜单中拿下 5 个第一,现已在 MAI Playground 和 Microsoft Foundry 私有预览中提供。
信息来源:X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman) · OpenAI / GPT
观点 / 方法普通
不读代码就无法评估模型输出质量
你不能声称"模型已经足够好,我不需要读代码"。因为如果你不读代码,就不可能知道有多少"垃圾"混了进来。我们连线 @0xblacklight 和 @vaibcode 获取独家消息。
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)