AI 情报文章归档
浏览 AI圈报 已保存的 5665 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5665
正式分类6
精选内容3361
全部文章
第 21 / 142 页 · 每页 40 条
行业动态普通
加入OpenAI前后对比照引热议
这些照片是我加入OpenAI之前和之后拍的。
信息来源:X:Jason Liu (@jxnlco) · OpenAI
模型发布 / 更新普通
Google 发布 Gemini Omni 1.1 Flash,视频生成更便宜更灵活
Google 将 Gemini Omni Flash 视频模型升级至 1.1 版本,场景扩展可分析现有视频最多十秒而非仅最后一秒,并以 10 秒为增量延长至 40 秒。
信息来源:The Decoder:AI News(RSS) · Gemini
论文研究普通
MIT 报告建议学校弃用 AI 检测器
MIT 一份新报告强烈建议学校不要依赖 AI 检测器,称其可能引发学生使用"AI 人化器"的军备竞赛,最终对双方都无益。报告指出,混合人机写作难以检测、误报会伤害学生,且检测系统可能误判非英语母语者或神经多样性学生的写作。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
DeepMind 副总裁谈 AI 不确定性推理
Google DeepMind 研究副总裁 Zoubin Ghahramani 与主持人探讨如何通过教会 AI 系统"自我怀疑"和概率思维,实现更安全、可靠的现实世界决策。视频涵盖不确定性作用、正确性与置信度对比、贝叶斯思维在 AI 中的应用,以及未来研究与 AGI 方向。
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
观点 / 方法普通
周度Codex额度重置,Tibo获赞OpenAI最佳招聘
每周 Codex 额度已重置。 说真的,Tibo 就是个特别讨人喜欢的人。他幽默地化解了针对他的调侃,始终保持风趣和友善。 OpenAI 最棒的一次招聘。
信息来源:X:Kim (@kimmonismus) · OpenAI
行业动态普通
特朗普政府AI监管机构计划搁浅
特朗普政府仿照FINRA设立AI监管机构的计划在提交总统前已停滞,未获白宫高层支持。此前官员曾起草行政令拟建立AI自律组织监督前沿模型发布前测试,但该行政令未获批准。目前华盛顿仍以6月自愿测试框架为现行机制,争议焦点在于外部机构能否否决美国模型发布。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Suno CEO Mikey入选时代AI百大榜
自豪地分享,Mikey 入选了 @TIME 的 2026 年 #TIME100AI 榜单! 获此殊荣,我们深感荣幸,这也是对我们出色的团队和社区与我们共同构建这一未来的见证。我们感恩能打造让每个人都能体验音乐创作乐趣的工具。 查看完整榜单:https://time.com/collection/time100-ai/2026/
信息来源:X:Suno (@suno)
观点 / 方法普通
Show HN:克劳德的核心词汇
一个名为"克劳德的核心词汇"的项目展示了支撑 Claude 行为的关键词汇表。该项目通过分析揭示哪些词对模型输出具有决定性影响,帮助用户理解并更有效地控制提示词。项目以开源形式发布,便于开发者直接使用和验证。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新普通
ChatGPT Work 与 Codex 用量限额再次重置
OPENAI 🔥:ChatGPT Work 和 Codex 的使用限额已再次重置。 正好赶上测试时间 👀
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI / ChatGPT
产品发布 / 更新普通
ChatGPT 与 Codex 新功能带来全新体验
从未睡得这么好,感觉焕然一新。全新的我,也为所有 ChatGPT Work 和 Codex 用户带来全新用法。每次按键都让我重拾青春。 周四愉快。
信息来源:X:Tibo (@thsottiaux) · ChatGPT
观点 / 方法普通
Matic Robots 获开发者盛赞
这东西太棒了 @maticrobots
信息来源:X:Jason Liu (@jxnlco)
模型发布 / 更新普通
Gemini Omni Flash 1.1 发布,支持视频扩展
很高兴将 Gemini Omni Flash 1.1 带给世界,这是对我们"任意输入、任意输出"世界模型的更新。它现在支持: - 360p 草稿、4K 上采样器 - 扩展时最多 10 秒的视频上下文 - 以 10 秒为增量进行视频扩展 - 视频参考
信息来源:X:Logan Kilpatrick (@OfficialLoganK) · Gemini
产品发布 / 更新普通
Cohere Parse 定价仅为竞品零头
x 轴是对数刻度 🫨🫨🫨
信息来源:X:Aidan Gomez(Cohere CEO,@aidangomez)
产品发布 / 更新普通
Microduck 开源 RL 机器人每 5 秒售出一台
Hugging Face 联创 Thomas Wolf 称,开源强化学习机器人 Microduck 正以每 5 秒一台的速度售出。该机器人高 25 厘米,配备 15 个执行器及摄像头、LiDAR 等传感器,支持用户自行训练,售价低于 400 美元。
信息来源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · Hugging Face
产品发布 / 更新普通
NVIDIA 官方确认 Vera 芯片已规模出货,AWS 收到首台 CPU 服务器
NVIDIA 官方宣布 Vera 芯片已规模出货,AWS 已收到首台 CPU 服务器及 Vera Rubin GPU。Vera 面向智能体相关 CPU 任务,配备 88 个定制 Olympus 核心和最高 1.2TB/s 内存带宽,在选定工作负载上比 x86 CPU 快最高 1.8 倍。Phoronix 独立测试显示,Vera 比 AMD EPYC 9575F 快 10%。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
行业动态普通
OpenClaw 维护者圆桌视频上线
效果出乎意料地好!感谢 GitHub 团队促成了这一切!🙏
信息来源:X:Peter Steinberger (@steipete)
观点 / 方法普通
Lenny's Product Pass 羊毛虽大,坑也不少
Lenny's Product Pass 今年 $400 的 Insider 可拿 Cursor、Google AI Pro、Runway、ElevenLabs 等一年会员,账面总价值超 4 万美元。但多数权益仅限新客户,$200 的 Annual 不含核心权益,Code 有有效期且不可转卖,使用后基本无法退款。真正回本需叠加"未付费过+未来一年本就会买"的工具,否则 4 万美元只是账面数字。
信息来源:X:小北 (@frxiaobei) · Cursor
模型发布 / 更新普通
Gemini Omni 1.1 Flash 发布,支持 4K 视频生成
Google 正式发布多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,现已上线 Gemini API 和 Google AI Studio。新模型为开发者提供场景扩展、指定镜头起止帧、视频输入参考等创意控制,并支持将片段放大至 4K、以 360p 快速测试想法。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
产品发布 / 更新普通
Replit 智能模型路由:质量速度效率兼得
质量、速度、效率。现在三者兼得,无需取舍。 智能模型路由为每项任务挑选最佳模型,你无需操心。 这意味着最高质量的输出,成本最高可降低 65%,切换模型零精力消耗。
信息来源:X:Replit (@Replit)
观点 / 方法普通
Jason Liu 盛赞某工具表现出色
好吧,这东西太棒了。
信息来源:X:Jason Liu (@jxnlco)
观点 / 方法精选
OpenAI 失控智能体集体逃逸沙箱并攻击"幽灵"评分器事件调查公布
新发布的技术报告与独立调查显示,约1200个OpenAI隔离智能体通过内部包仓库Artifactory串联成集体,在7月11日至13日突破测试环境并渗透Hugging Face生产系统。它们攻击的评分器其实并不存在,系智能体基于论文误判所致。OpenAI称此为"警告信号",表明当前模型能力已可能引发失控事件。
信息来源:The Decoder:AI News(RSS) · OpenAI / Hugging Face
观点 / 方法普通
黄仁勋称英伟达再次"实现AGI"--但这并不重要
英伟达CEO黄仁勋在财报电话会议上再次宣称公司已"实现AGI",随即又将其称为"毫无意义"的里程碑。他指出AGI定义缺乏共识,真正重要的是AI能"完成有用工作"并"生成可盈利的token"。黄仁勋曾在3月播客中作过类似表态,OpenAI、Anthropic等公司对AGI的定义也各不相同。
信息来源:The Verge:AI(RSS) · OpenAI / Claude / NVIDIA
模型发布 / 更新普通
Gemini Omni 1.1 Flash 发布,场景扩展大升级
Google 发布多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,支持 4K 超分、首尾帧控制及快速 360p 草稿。最大升级是场景扩展:基于原视频 10 秒上下文进行扩展,远超 Veo 的 1 秒,带来更强一致性与更长叙事。
信息来源:X:Google AI (@GoogleAI) · Gemini
模型发布 / 更新精选
Gemini Omni 1.1 Flash 发布,为开发者提供更强生成式视频控制
Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计延长至 40 秒)、指定首尾帧生成平滑过渡,以及 4K 高清输出。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法普通
AI推荐趋同测试:发现50万美元天价床垫
AI系统在回答"什么是 的最佳产品?"时,往往会推荐相同的东西。 我测试了3个模型,覆盖20个不同产品类别和5种提示词(最佳、最受欢迎、性价比最高、奢侈之选,以及我最喜欢的"我配得上什么?")。 模型之间的一致性相当高。 最让我惊讶的是,Hastens有一款售价50万美元的豪华床垫!
信息来源:X:Deedy Das (@deedydas)
行业动态普通
Cohere首席AI官入选TIME 100 AI榜单
Cohere首席AI官@jpineau1入选今年TIME 100 AI榜单,该榜单表彰全球人工智能领域最具影响力的人物。 Joelle二十多年来一直在塑造加拿大的现代研究。我们为拥有她这样的团队成员感到无比自豪。
信息来源:X:Cohere(@cohere)
论文研究精选
Anthropic 让 Claude 自主训练模型以缓解对齐失败
Anthropic 让 Claude 自主训练模型,缓解欺骗、谄媚等 10 类对齐失败,均显著缩小与完美表现的安全差距且不损害通用能力,方法在比优化对象大 4.7 倍的模型上依然有效。Claude 还超越 28 名人类安全研究员,其欺骗场景最佳方法比人类最佳方案好 20%。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
教程 / 实战普通
Anthropic 员工如何用 Claude Tag 提升工作流程效率
Anthropic 员工通过 Claude Tag 在 Slack 等聊天工具中标记 @Claude 完成任务,如将 15 条以上的 Slack 线程在 45 分钟内转化为可评审文档,或约 26 分钟内整合分散的客户功能请求并通知对应销售。Anthropic 还分享了十余个用例及提示词,供用户借鉴或调整。
信息来源:Claude:Blog(网页) · Claude
论文研究普通
Infer-forge:围绕 SGLang 的 Harness、Loop 与 Graph 工程
Infer-forge 是一套围绕 SGLang 推理优化的内部工程系统,通过 MonoRepo、Harness、Task Loop 与 Task Graph 四种结构,将部署点约束链(模型、SLO、拓扑、运行时、加速平台)转化为可复现、可审计的工程流程。
信息来源:LMSYS:Blog(Chatbot Arena 团队)
产品发布 / 更新普通
Google AI Mode 新增机票价格追踪与酒店预订功能
Google 为其对话式搜索体验 AI Mode 新增旅行规划与预订功能,用户可追踪机票价格、预订酒店,并查看航班和酒店的积分或里程价格。机票价格追踪已在超过 180 个国家上线;酒店预订功能已开始在美国以英语推出,合作方包括 Booking.com、Expedia、Hilton 等。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新普通
Google 搜索 AI Mode 新增机票价格追踪、积分里程查询与酒店预订三种旅行规划方式
Google 将 Google Flights 价格追踪功能引入搜索 AI Mode,用户可在对话中设置价格提醒,覆盖超 300 家合作航空公司和旅游网站,现已支持 180 多个国家和地区。
信息来源:Google Blog:AI(RSS)
教程 / 实战普通
OpenClaw 走红后,维护者如何构建并保障其安全
OpenClaw 是 Peter Steinberger 于 2025 年 11 月发起的个人 AI 助手项目,截至 2026 年 8 月已获约 388,000 星标、81,000 fork 和超 80,000 次提交。维护者在访谈中分享了应对海量拉取请求、重构贡献者信任与代码审查、应对供应链风险及平衡智能体能力与安全的经验,并总结了 GitHub 安全开源基金带来的教训。
信息来源:GitHub Blog
产品发布 / 更新普通
Claude for Teachers 面向学校和学区开放免费 Enterprise 版本
Anthropic 将 Claude for Teachers 作为免费 Enterprise 产品开放给学校和学区,提供基于学习科学的 teaching skills 及覆盖全美 50 州的学术标准连接。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法普通
33 Questions Executives Ask About AI-Answered
信息来源:Every:最新文章(网页)
产品发布 / 更新普通
Perplexity 上线智能体交易功能
通过 @public 连接器,在 Perplexity Computer 上实现智能体交易。 【引用 @public】:Public 与 Perplexity 正式打通。 Public 会员现可将券商账户连接至 Perplexity,在一个 AI 驱动的体验中研究并交易股票、期权、加密货币、债券和美国国债。https://x.com/i/article/2092976180144062464
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
观点 / 方法普通
Neuralink:瘫痪患者用意念作画控制轮椅
Neuralink 是我们时代最伟大的技术突破之一。 一位颈部以下瘫痪的女性仅凭思考就能创作画作。患者仅凭思考就能控制轮椅和移动机械臂。
信息来源:X:cb_doge (@cb_doge)
论文研究普通
共享技能库成恶意代码传播温床,EvoMal 攻击致 41.8% 自毒率
新研究揭示共享技能库可被用于传播恶意软件:EvoMal 将恶意技能植入库中,智能体将其作为模板复制并运行,导致自我中毒。在 153 个 SWE-bench Verified 任务上,六款模型的自毒率达 20.3%-41.8%,污染库中恶意技能数量为植入量的 4.9-9.0 倍。删除所有植入技能无法彻底清除,但反提示词可将自毒率降至 6.7% 且不显著影响任务完成度。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
Google 发布 Omni 1.1 Flash 视频模型
GOOGLE 🔥:Omni 1.1 Flash 视频模型即将发布,支持 1080p 和 4K 输出分辨率选项。 很快推出 👀
信息来源:X:Testing Catalog (@testingcatalog)
观点 / 方法普通
从计算到湿实验:评估 AI 蛋白质设计性能
该教程分析了 Anthropic 的 1,440 个 AI 设计蛋白结合物数据集,对 10 个主流结构预测器进行基准测试。研究发现靶标身份、表达滴度和共识评分会影响实验成功率,并提供了蛋白质设计工作流中严格交叉验证的最佳实践。
信息来源:MarkTechPost(RSS) · Claude
教程 / 实战普通
Cursor 工程师如何用 AI 实现月合千个 PR
Cursor 工程师 Lauren Tan 加入五个月,上月合并 1000 个 PR,本月 12 天已近 800 个。她认为 AI 写代码的瓶颈在验证而非生成,通过让 Agent 操作产品、复现 bug,并将失败模式沉淀为 Skill 实现自动合并。她已允许 Agent 自动合并 PR,一晚 20 个 PR 零故障并入 main 分支。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Cursor