AI 情报文章归档
浏览 AI圈报 已保存的 5645 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5645
正式分类6
精选内容3360
全部文章
第 18 / 142 页 · 每页 40 条
产品发布 / 更新普通
Claude Code v2.1.248 发布:新增受限模式与跨会话消息功能
Claude Code v2.1.248 发布,新增 --restricted 受限模式,移除运行命令/代码及 WebFetch 等内置工具,并忽略用户、项目及本地设置文件。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
观点 / 方法普通
2026年Anthropic与OpenAI营收加速增长
2025年,Anthropic和OpenAI就已经是历史上同规模中增长最快的公司之一。然而,它们的营收增长在2026年进一步加速。@justjoshinyou13 和 @lynette_bye 在我们最新一期的通讯中讨论了这对AI未来的意义。
信息来源:X:Epoch AI (@EpochAIResearch) · OpenAI / Claude
模型发布 / 更新普通
MiniMax 与 fal 合作推出 H3 Max 视频模型
MiniMax 祝贺 fal 团队推出基于其开源模型的后训练视频模型 H3 Max,该模型在质量、提示理解和美学方面排名第一,生成 5 秒 720p 视频仅需不到 3 秒。fal 同时优化了推理系统以实现超实时性能。H3 Max 发布首周享 50% 折扣。
信息来源:X:MiniMax (@MiniMax_AI)
观点 / 方法普通
Codex 个人安全实践征集
正在写一篇关于使用 Codex 保障个人安全的文章 你如何保护自己的账户和个人信息?Codex 在这方面帮到了你什么? 很想知道你尝试过哪些方法、哪些真正有效。请勿分享敏感细节。
信息来源:X:Jason Liu (@jxnlco)
行业动态普通
我们使用一个基于vibecode的模糊测试工具,在FFmpeg中发现了一个除以零的漏洞
开发者通过一个基于vibecode的模糊测试工具,在FFmpeg中发现了除以零漏洞。该工具利用Anubis的Proof-of-Work机制(类似Hashcash)应对AI公司的大规模爬取,在个体规模下额外负载可忽略,但在大规模爬取时成本显著增加。目前该方案为临时措施,后续将转向通过字体渲染等方式识别无头浏览器。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
创业公司求职:用AI替代被动执行,主动列出优先事项
创业公司里若还需被指挥做事,创始人不如直接问AI。如今唯一难点是决定先做什么,因此求职时别只列擅长清单,而应写明加入后你会按重要性做什么。作者称收到700+私信求职,50M曝光量下却无一人给出具体改进方案。
信息来源:X:Gabriel (@gabriel1)
行业动态普通
Cohere 创始人喊话加拿大人回国共建
Cohere 会支持你。在这里做出酷的东西吧。
信息来源:X:Cohere(@cohere)
论文研究普通
AgentMercury:训练环境与评测集脱钩可提升泛化
AgentMercury 研究表明,智能体的训练环境不必与评测集一致,在无关的模拟商业世界中训练反而能提升目标基准表现。该方法从商业描述生成 4,783 家模拟公司,每家公司含独立服务、工具和数据库,再从中提取训练任务。世界构建本身也可学习,微调后模型生成有效公司的成功率从 3.3% 提升至 83.3%,与 Claude Opus 4.8 持平。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法普通
OpenClaw 团队谈 AI 前沿构建历程
想知道 OpenClaw 构建幕后的故事吗? Peter 和团队最近与 @github 进行了一场炉边谈话。 我们聊了 OpenClaw 的起源、在 AI 前沿的构建,以及下一步计划。🦞 https://www.youtube.com/watch?v=5VSwaUXtPIE
信息来源:X:OpenClaw (@openclaw)
观点 / 方法普通
H3 Max 实时生成 AI 视频突破时间界限
AI 视频的一条线被跨越了。在我仅使用网页界面的实验中,H3 Max 现在生成质量尚可的 AI 视频,所需时间比观看该视频还要短。从我按下"生成"按钮那一刻起就是实时的(其中还包括提示词增强)。
信息来源:X:Ethan Mollick (@emollick)
产品发布 / 更新普通
Replit 智能模型路由:免费与付费版差异解析
借助智能模型路由,Replit 会为你发送的每项任务挑选合适的模型,让你在无需额外成本的情况下,兼顾质量、速度与效率。 以下是其运作方式,以及 Free、Power 和 Max 版本之间的差异详解 ↓
信息来源:X:Replit (@Replit)
教程 / 实战普通
Grok Bot 如何改变智能体协作体验
Grok Bot 的意义比表面看起来更大。 它真正改变了我与智能体协作的方式。 最大的变化:我不再过度思考了。 简化的界面给了我以往常规聊天会话所没有的信心。 我认为还有更多独特的体验和 UI 层有待发掘,以提升对 AI 的信任并增强协作。在我看来,Grok Bot 在这方面处于领先地位。 主动式能力也很出色,而且还在不断改进。这是我最期待的一个方向。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Grok
观点 / 方法普通
Epoch AI实测GPT-5.6游戏表现
过去几周,我们进行了一些非正式实验,让 GPT-5.6 Sol 通过操作电脑来玩《杀戮尖塔》这款视频游戏,以此测试其计算机使用能力。 我们了解到,计算机使用并非 Sol 的主要局限。相反,Sol 主要是在战术和策略方面存在不足。它的游戏水平高于人类新手,但低于专家水平。
信息来源:X:Epoch AI (@EpochAIResearch) · GPT
行业动态精选
诉讼指控 xAI 使用儿童性虐待材料训练 Grok 模型
一项新诉讼指控 xAI 使用儿童性虐待材料(CSAM)训练 Grok 模型,这是首个此类指控。原告 Jane Doe 称其幼年遭虐待所生成的 CSAM 图像及 AI 生成的衍生图像被用于训练 Grok,且 Grok 默认将公开的 X 帖子和自身输出作为训练数据。诉讼要求 xAI 销毁所有 Grok 生成的 CSAM 并阻止模型再生成此类内容。
信息来源:Ars Technica:AI(RSS) · Grok
论文研究普通
Netflix 论文详解 LLM 评委在推荐理由系统中的生命周期
Netflix 发布论文,详解其推荐理由生成系统:一个 AI 模型撰写"因为你看过"短句,另一个 AI 评委逐条打分,人类每周审核。论文提出生产环境中的评委模型需持续维护,分为构建标注样本、调优评委、作为门控运行及监控漂移四阶段,调优基于书面理由而非简单对错。5 周测试显示,相比无解释,该方案让用户略微转向未看过的内容,并更常以播放结束浏览。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
ChatGPT Work 可代登录网站办杂务且不泄露密码
ChatGPT Work 现可在网页和移动端使用其计算机与浏览器登录网站,全程不接触用户用户名或密码。用户可让其代订 Uber、预约理发、办理水电煤、预约 DMV 或护照、提交保险报销等事务。该功能覆盖生活与工作场景,如比价租房保险、整理发票提交会计软件、分析广告活动等。
信息来源:X:Tibo (@thsottiaux) · ChatGPT
模型发布 / 更新普通
MiniMax 开源 H3 基础模型,生态后训练登顶
MiniMax 祝贺 fal 团队基于其开源 H3 基础模型后训练的 H3 Max 视频模型登顶多项评测。H3 Max 在整体质量、提示词理解和美学上均排名第一,生成 5 秒 720p 视频耗时低于 3 秒,且本周价格五折。MiniMax 强调后训练只是释放基础模型已有能力,并指出 SGLang 训练管线及 Sol-Attention 引擎带来 3.95 倍端到端加速。
信息来源:X:MiniMax (@MiniMax_AI)
产品发布 / 更新普通
Gemini Live 新增多项功能,可代你处理复杂任务
看看你能做什么: - 告诉 Gemini 你想做什么 - Gemini 就开始干活 这是语音之年 Gemini Live 正从对话走向代你处理复杂任务。 借助 Live 中的新功能,如 Daily Brief、Gemini Spark、Personal Intelligence 和 @Gmail 收件箱管理,你可以口述一天安排并委派待办事项,不错过任何节奏。🧵
信息来源:X:Josh Woodward (@joshwoodward, Google Labs VP) · Gemini
行业动态普通
OpenAI 联合多家科技巨头呼吁加强全球网络防御
我们加强网络防御的时间窗口有限,现与 @AnthropicAI、@awscloud、@Google、@Microsoft 和 @Oracle 等组织一道,呼吁全球共同努力,为防御者提供保护我们共同依赖的基础设施所需的工具、资源和支持。 如果我们果断行动,就能将当今的 AI 进步转化为持久的安全改善,让我们的数字世界对每个人都更加安全。 https://openai.com/collective-cyberdefense/
信息来源:X:OpenAI (@OpenAI) · OpenAI / Claude
产品发布 / 更新普通
Lumos NIX 太极招式展示引赞叹
这一招太极动作看起来确实沉稳。 每次踢腿后站姿几乎不晃。布料在腿部拖曳,却依然能保持招式形态。 【引用 @rohanpaul_ai】:Lumos NIX 的精彩展示 稳住,轴线,收势。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Gemini Notebook 推出 Expert Intelligence 读书功能
Google 推出跨部门计划 Expert Intelligence,用户可在 Gemini Notebook 中导入符合条件的 Google Play 电子书,将作者观点与其他来源结合,以全新方式与书籍互动。作者和出版商可通过该计划触达更多深度读者。
信息来源:X:Josh Woodward (@joshwoodward, Google Labs VP) · Gemini
行业动态普通
作者将赴柏林GTC,聚焦智能体与开源模型
作者将参加10月20-22日于柏林举办的NVIDIA GTC,期待黄仁勋主题演讲、生产级智能体、可检视部署的开源模型及欧洲AI基础设施讨论。其关注议程包括开源模型构建、欧洲高性能AI工厂,并提及NVIDIA已同意收购Hugging Face。
信息来源:X:Kim (@kimmonismus) · NVIDIA / Hugging Face
行业动态普通
AGNTCon 阿姆斯特丹九月阵容公布
九月阿姆斯特丹 AGNTCon 的主讲阵容太棒了!等不及要和所有我喜欢的欧洲开发者们聚聚 @techgirl1908 @clare_liguori @dsp_ @p3pijn_jasper @Dpbrinkm 还有更多 另外,如果你正在搭建公司的软件工厂,并且至少有 100 名工程师,联系我,我会尽量帮你安排进我们在 9 月 16 日(周三)举办的晚宴。
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
模型发布 / 更新普通
Gemini Omni 1.1 Flash 发布:新增场景扩展、4K 升级等生成视频控制能力
Google 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向专业用途的生成视频能力。新功能包括场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量延长至累计 40 秒)、首尾帧插值、360p 快速草稿(比 720p 快至多 60%、成本为其三分之一)以及最高 4K 分辨率升级。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Gemini
教程 / 实战普通
线束工程:如何用确定性工具与智能体审查约束 AI 生成代码
线束工程是一种围绕 AI 辅助代码生成构建确定性工具、智能体审查与定期熵检查的实践,防止 AI 代码随时间漂移。该概念源自 Birgitta Boeckeler 在 martinfowler.com 上的文章,包含上下文工程、架构约束与垃圾回收三部分。插件通过 HARNESS.md 维护 AI 知识库,并用验证槽(确定性工具或智能体审查)捕获违规,逐步实现约束的确定性硬化。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新普通
Cohere 发布 Parse 5(parse-v5.0):2.3B 视觉语言模型,将企业文档转为 Markdown
Cohere 发布文档解析模型 Parse(parse-v5.0),基于 North-Micro-Vision-Instruct 架构,拥有 2.3B 参数、8,192-token 上下文窗口和约 4.6GB 体积,可将 PDF、PPT、JPEG 页面直接转为含 HTML 表格和边界框坐标的 Markdown,无需独立 OCR 阶段。
信息来源:MarkTechPost(RSS)
观点 / 方法普通
Semafor 调查:310 篇专栏中 50 篇含 AI 痕迹
Semafor 调查发现,两家报纸的 310 篇客座专栏中有 50 篇存在 AI 使用痕迹,尽管其政策严格。许多作者用 AI 润色、完善论点或仅用于部分段落。"AI 检测器"能识别文本统计模式,但无法还原写作过程。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
NVIDIA 开源 srt-slurm 编排推理部署
NVIDIA 开源 srt-slurm,为 Slurm 集群上的生产级推理服务提供基于 YAML 的编排层。它协调 sbatch/srun、GPU 分配、网络、就绪检查及清理,支持 prefill/decode 分离、多 worker、Dynamo 前端、KV-cache 感知路由等拓扑,便于在 GPU 集群上快速部署代表性推理系统进行测试或基准评测。
信息来源:X:SemiAnalysis (@SemiAnalysis_) · NVIDIA
观点 / 方法普通
信念上下文图:记忆知其所以信
推荐阅读! 下一个抽象不是"更多智能体"。 缺失的纪律是在不确定性下做出承诺。 信念上下文图:一种知道自己为何相信的记忆。
信息来源:X:马东锡 NLP (@dongxi_nlp)
观点 / 方法普通
ChatGPT 正成为你的个人 AGI 智能体
ChatGPT 可以帮你预约理发。ChatGPT 正日益成为你的个人 AGI。
信息来源:X:Greg Brockman (@gdb) · ChatGPT
产品发布 / 更新普通
Grok Bot 安卓版开启谷歌商店预注册
突发:Grok Bot 应用现已可在 Google Play 商店面向安卓用户进行预注册。 立即预注册,当 Grok Bot 在您的设备上可用时第一时间收到通知:https://play.google.com/store/apps/details?id=ai.x.grok.bot
信息来源:X:cb_doge (@cb_doge) · Grok
行业动态普通
报道:英伟达拟以130亿美元收购AI模型库Hugging Face
英伟达据报正推进以129亿美元收购AI模型托管平台Hugging Face,交易尚未最终敲定,但双方均积极推动。此举将强化英伟达在开源模型生态中的影响力,并可能重启其云AI业务。Hugging Face目前尚未盈利,但其作为开放权重模型存储与下载核心平台,战略价值显著。
信息来源:Ars Technica:AI(RSS) · NVIDIA / Hugging Face
产品发布 / 更新普通
Anthropic 推 MHS 标准,让 Claude 操控实验室设备
Anthropic 正测试让 Claude 控制机器人与实验设备的新方法,其 Model Hardware Standard(MHS)通过统一接口,让 AI 智能体操控实验室和工厂硬件。MHS 用通用驱动标准化命令、设备属性和安全限制,取代各仪器独立的编程接口,智能体可经 MCP、命令行或代码访问驱动。Anthropic 称早期项目已将集成工作从数周缩短至数小时或几分钟。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
行业动态普通
Barret Zoph 离开 OpenAI 后加入 Google,出任研究副总裁
Thinking Machines 联合创始人 Barret Zoph 在重返 OpenAI 仅五个月后再次离职,现已加入 Google 担任研究副总裁。Google 发言人表示,期待 Zoph 将其强化学习与后训练专长带入 Gemini 项目。Zoph 此前曾在 OpenAI 负责企业 AI 销售,并于今年 1 月从 Thinking Machines 离职回归。
信息来源:TechCrunch:AI(RSS) · OpenAI / Gemini
产品发布 / 更新普通
Grok Bot 安卓应用即将上线开放预注册
Grok @Bot 团队一直在默默耕耘!我们的安卓应用已基本就绪。现在可在 Google Play 商店预注册,等待正式发布! https://play.google.com/store/apps/details?id=ai.x.grok.bot
信息来源:X:Lauren Tan (@poteto) · Grok
观点 / 方法普通
反驳"自建智能体框架无价值"论
Elvis Saravia 反驳"自建智能体框架无 alpha"的观点,认为框架与模型相辅相成,是智能体栈的核心资产。他强调即使模型能即时生成框架,关键定制仍须自持,并主张所有 AI 构建者都应像前沿实验室一样自主构建,而非依赖他人。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
观点 / 方法普通
网友质疑中国是否参与AI网络防御
我唯一的问题是:中国呢?他们会加入吗?我对此表示怀疑。
信息来源:X:Kim (@kimmonismus)
观点 / 方法普通
AI网络防御关键时刻,呼吁紧急行动
这是AI网络防御的关键时刻;行动时间所剩无几。 如果你愿意与我们、我们的竞争对手或合作伙伴合作,我们很高兴,但请认真对待这一时刻。 唯有紧急而密集的集体响应才能奏效。
信息来源:X:Sam Altman (@sama)
观点 / 方法普通
学者遭遇AI伪造论文冒名
我在预印本网站上发现多篇署有我名字的AI垃圾论文,这些论文我从未撰写也从未见过。我交谈过的其他学者也有同样遭遇。 我不认为这些都是真的……尽管质量尚可的AI论文工厂很快就会出现。
信息来源:X:Ethan Mollick (@emollick)
论文研究普通
以人为本AI:从感知到行动的6层连接框架
一项综述研究提出,以人为本AI的下一次飞跃在于将感知、动作等孤立任务连接成统一基础模型。该框架将人体外观、运动、交互、影响世界及物理行动划分为6个关联层级。综述指出,仅靠更大模型并非答案,需共享人类表征、更优人类数据、更强物理基础及协同能力评估。
信息来源:X:Rohan Paul (@rohanpaul_ai)