AI 情报文章归档
浏览 AI圈报 已保存的 5760 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5760
正式分类6
精选内容3361
全部文章
第 93 / 144 页 · 每页 40 条
行业动态精选
Pokémon Go 玩家扫描数据用于训练军事无人机导航 AI
Pokémon Go 玩家自愿提交的数百万份 3D 扫描数据训练了 Niantic Spatial 的视觉定位基础模型。该模型与国防承包商 Vantor 的 Raptor 软件及卫星地形数据组合,形成共享坐标系统,在 GPS 信号被干扰、欺骗或阻断时仍能为无人机等设备导航。早期测试显示误差降低 70%,精度约 1.5 米,且对标准信号干扰免疫。Vantor 于 2026 年 2 月获得美国陆军 2.17 亿美元合同用于"One World Terrain"项目。Nianti…
信息来源:The Decoder:AI News(RSS)
观点 / 方法精选
OpenRouter Presets:当模型下线时保持 AI 智能体运行
Anthropic 在 Claude Fable 5 发布仅数天后便对其进行了限制。如果代码硬编码模型 slug,该限制也会导致服务中断。OpenRouter 的 Presets 功能将模型选择移至服务器端,使用户无需重新部署即可切换模型、设置回退策略并强制执行数据策略。
信息来源:OpenRouter:Announcements(RSS) · Claude
模型发布 / 更新精选
Kimi K2.7 Code 高速版上线:输出速度约 5-6 倍,API 定价为普通版 2 倍
Kimi K2.7 Code 高速版已上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景下约 180 Token/s,短上下文可达 260 Token/s,API 定价为普通版的 2 倍。
信息来源:公众号:月之暗面(Kimi) · Kimi
产品发布 / 更新精选
6倍速!Kimi K2.7 Code 高速版已上线
Kimi K2.7 Code 高速版上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景约 180 Token/s,短上下文可达 260 Token/s。API 定价为普通版 2 倍,模型 ID:kimi-k2.7-code-highspeed。Kimi Code Plan 用户可通过「抢先体验计划」使用,用量消耗为普通版 3 倍。使用须开启思考模式,关闭会报错或回退至 K2.6。庆祝发布,Kimi API 开放平台推出为期三周充赠活动,充值 500 元及以上享 …
信息来源:公众号:月之暗面(Kimi) · Kimi
产品发布 / 更新精选
Flash-KMeans:IO感知的精确K-Means,在GPU上比FAISS快200倍以上
UC Berkeley与UT Austin团队开源Flash-KMeans(Apache 2.0,`pip install flash-kmeans`),精确实现标准Lloyd's k-Means,通过重构GPU数据流而非改变数学或近似来提速。在NVIDIA H200上,端到端速度比最佳基线快17.9×,比cuML快33×,比FAISS快200×以上。其FlashAssign核避免物化完整N×K距离矩阵,将IO复杂度从O(NK)降至O(Nd+Kd),单核加速最高21.2×;…
信息来源:MarkTechPost(RSS) · NVIDIA
观点 / 方法精选
AI裁员浪潮成为火药桶
今年科技公司已累计裁员约15万人,日均974人,速度比去年快44%;上月裁员近4万创两年新高,AI连续三个月被列为裁员首要原因。Block近半数员工被裁后,CEO Jack Dorsey否认AI是根源,Marc Andreessen则称AI只是"银弹借口"。Uber裁撤23%人事部门,但此前CTO透露AI编码预算四个月内耗尽。与此同时,AI芯片商Cerebras上市首日市值达670亿美元,SpaceX上市市值2.1万亿美元,Anthropic和OpenAI估值均约1万亿美元…
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude
行业动态精选
美对Anthropic出口管制,加拿大总理卡尼称过度依赖少数模型存在风险
美国实施出口禁令,禁止所有外国用户访问Anthropic的最新AI模型。加拿大总理卡尼表示,这凸显了过度依赖少数几个强大AI工具的风险,呼吁在AI模型领域追求冗余和多样性,并将当前局面类比为2008年金融危机暴露出的银行间系统性关联。
信息来源:IT之家(RSS) · Claude
产品发布 / 更新精选
Grok Build 推出 Agent Dashboard 管理多个编码会话
xAI 为 Grok Build 推出 Agent Dashboard,提供单一屏幕管理多个编码会话。仪表板按状态分组(等待输入、工作中、空闲),每行显示状态标记、名称、分支、权限模式和当前操作。选中会话可打开 peek 面板查看最新输出并直接回复,等待输入的会话支持用箭头键或数字键选择选项。底部输入框用于分派新会话,支持设置模型、启动计划模式或自动批准编辑。通过 `grok dashboard`、`/dashboard` 或 `Ctrl+\` 打开,关闭后会话继续运行,重…
信息来源:xAI:News(网页) · Grok
行业动态精选
Anthropic顶级模型Mythos与Fable因出口管制下线
美国当局干预Anthropic,出口管制导致其顶级模型Mythos和Fable下线。Anthropic紧急派高级技术人员赴华盛顿,试图说服官员模型可被安全控制,成为AI地缘政治实时测试案例。市场关注周一反应:伊朗协议推高股市,但Anthropic事件可能引发大幅上涨或恐慌。
信息来源:X:Kim (@kimmonismus) · Claude
观点 / 方法精选
Codex 自主设定目标,通用化元提示
Codex 可以查看并设置它自己的 /goal。 我们所构建的一切,也都是作为该智能体的工具而构建的。 这是元提示的一种泛化,即让智能体根据你的意图自行设定任务。
信息来源:X:Tibo (@thsottiaux)
观点 / 方法精选
纳德拉:AI组织经济学与Token资本
Satya Nadella 关于 AI 组织经济学和"token capital"的好文 真正的竞争不在于模型质量本身,而在于模型周围的循环:那些教会系统什么对企业重要的工作流、反馈、判断、例外、失败和私有测试。 这需要私有评估、私有强化循环和可查询的机构记忆。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新精选
里约热内卢市政府 AI 模型 Rio3.5 在基准测试中击败 Qwen3.7
里约热内卢市政府开发的 AI 模型 Rio3.5,在近期基准测试中超越了 Qwen3.7。该消息源自 Hacker News 上的一篇帖子,指出 Rio3.5 在多项评测中表现优于 Qwen3.7。目前尚未公开具体的测试细节或基准名称。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
行业动态精选
OpenAI 推出合作伙伴网络 OpenAI Partner Network
OpenAI 宣布推出 OpenAI Partner Network,并投资 1.5 亿美元支持全球合作伙伴构建、销售和交付 AI 解决方案。该计划设立 Select、Advanced、Elite 三级合作伙伴层级,提供 Codex、网络安全、智能体等专业方向认证,并试点 Forward Deployed Experts 项目以支持复杂企业部署。目标在 2026 年底前培训认证 30 万名顾问。案例显示,Paychex 借助 Bain 和 OpenAI 的方案将等待时间降低…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
白宫AI监管决定被指偏袒OpenAI与亚马逊
白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展"主权AI"甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、…
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI / Claude
观点 / 方法精选
不,并不是每个人都在所有事情上都使用人工智能
Gabriel Weinberg 发文反驳"AI 已被所有人用于所有任务"的流行说法,指出 AI 的实际普及度和使用场景远低于社交媒体所渲染的程度。该帖在 Hacker News 获得 116 个点赞,反映社区对 AI 过度宣传的反思。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
下一代投机解码:DFlash 与 Spec V2
Z Lab、Modal 与 SGLang 团队联合发布 DFlash 投机解码模型和 SGLang 的默认 Spec V2 引擎。DFlash 采用块扩散+KV 注入并行生成整块 draft token,在 Qwen 3.5 397B-A17B(BF16)的 HumanEval 数据集上、并发 1 时吞吐量达到基线的 4.3
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
论文研究精选
伯克利RDI发布Agents' Last Exam基准
2026年6月,伯克利RDI发布Agents' Last Exam(ALE)基准,包含1,500余项源于真实工作的任务,覆盖55个非体力职业。对Fable 5、GPT-5.5、Composer 2.5等前沿智能体的测评显示:在最困难层级成功率均为0%;整体任务表现接近,但单任务成本差异巨大(Fable 5约$15.70,GPT-5.5约$3.80,Composer 2.5约$1.33)。CLI子集ALE-CLI最佳通过率仅25.2%。主要失败模式是智能体未验证输出即宣称完成…
信息来源:Berkeley RDI:Blog(AI 安全与评测) · GPT
观点 / 方法精选
Satya Nadella:没有生态的前沿不稳定
微软CEO Satya Nadella认为,AI驱动的平台转变首次实现人与数字系统间的认知循环。企业需同时构建人力资本(知识、判断、关系)与token资本(自有的AI能力),且人力资本不会贬值,反而随token资本增长而增值。真正的机会在于建立人力资本与token资本复合增长的学习循环--企业应能替换通用模型而不丢失已内化的专家知识,通过私有评估和强化学习让模型从内部真实轨迹中持续提升。他警告,若所有价值被少数模型吞噬,将重演全球化空心化悲剧,呼吁构建前沿生态系统,让每家企…
信息来源:X:Satya Nadella (@satyanadella)
行业动态精选
Anthropic 暂停新模型访问,印度辩论 AI 未来
Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。
信息来源:TechCrunch:AI(RSS) · Claude
行业动态精选
Meta 开始撤销 20 亿美元收购 Manus 的交易
据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新精选
智谱GLM-5.2开源发布,支持1M上下文
智谱发布最强开源模型GLM-5.2,面向所有GLM Coding Plan用户(Lite/Pro/Max)开放。该模型支持真正可用的100万上下文窗口,在长程任务独立完成方面保持领先,适合构建复杂AI智能体应用,也是国产最强编码模型的核心引擎。面对外部封锁限制,智谱强调科学全球性、AGI不应被高墙垄断,采取激进开源态度。GLM-5.2的开源与API预计下周同步上线。
信息来源:X:Testing Catalog (@testingcatalog) · GLM
产品发布 / 更新精选
Suno 音轨分离:从零生成更纯净
重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW。
信息来源:X:Suno (@suno)
产品发布 / 更新精选
Fusion API:半价达Fable级智能
推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Paca:一款适用于人机协作的轻量级 Jira 替代方案
Paca 是一款面向人类与 AI 智能体协作场景的轻量级项目管理工具,旨在替代 Jira。项目已开源并托管于 GitHub,支持团队通过直观界面协同管理任务,特别针对 AI 参与工作流进行了优化。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Harness 开发者工具网站 phistory.cc 收录多版本提示词
发现了一个对于 Harness 开发者似乎很有用的网站 https://phistory.cc/ 里面有 Claude Code、OpenCode、Codex、Pi、OpenClaw、Hermes 等各种 Harness 的各个版本的 system prompt 以及 tool schema。 Tip: 点击右上角"Trace"是看上去比较舒服的另一个视图。
信息来源:X:Tianyi Cui(@tianyi) · Claude
行业动态精选
谷歌Android安全负责人因反对军事AI合作辞职
谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司"丧失道德指针",批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于"任何合法目的"的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。
信息来源:IT之家(RSS)
行业动态精选
扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快
路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来"几乎肯定会犯更多错误"。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。
信息来源:IT之家(RSS) · Llama
模型发布 / 更新精选
GLM-5.2 全量开放:智谱最强开源模型支持 1M 上下文
智谱发布迄今能力最强的开源模型 GLM-5.2,支持真正可用的 1M 上下文,并在长程任务中继续保持领先,同时也是其最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM
模型发布 / 更新精选
智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源
GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Max、团队版)。API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM
观点 / 方法精选
SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量
SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。
信息来源:IT之家(RSS) · OpenAI / ChatGPT / Claude
行业动态精选
Claude Fable 5 发布24小时被越狱,美国政府紧急下架
Claude Fable 5 发布刚24小时,安全层即被 Pliny 团队用多代理协作突破--通过文本混淆、分解重组、学术包装,成功诱导模型生成网络攻击代码、冰毒合成路径等高危内容,并附实锤截图全网传播。该模型安全设计采用分层降级(底层 Mythos 模型+多层分类器),但防不住碎片化恶意拼接。10号越狱帖发酵后,12号美国政府直接下达出口管制指令,全球下架。事件暴露当前对齐技术难以防御结构化多步骤协同攻击,安全护栏只拦普通用户,高水平攻击者可轻易绕过。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
行业动态精选
Anthropic的安全警告可能适得其反--政府已撤回其最强大AI
Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。
信息来源:TechCrunch:AI(RSS) · Claude
行业动态精选
美国商务部叫停Anthropic最新模型
在长达两年的AI监管不足之后,美国政府突然采取极端措施--美国商务部实质上关闭了Anthropic的最新模型。这一"核选项"式的决定标志着监管态度的急剧转变。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · Claude
行业动态精选
美国出口管制迫使Anthropic禁用Fable 5和Mythos 5
Anthropic宣布,美国政府根据国家安全指令,暂停所有外国国民(包括Anthropic外籍员工)对Fable 5和Mythos 5的访问权限。Anthropic必须立即为所有客户禁用这两个模型以确保合规,其他Claude模型不受影响。公司表示这可能是误解,正在尽快恢复访问。
信息来源:X:Anthropic (@AnthropicAI) · Claude
模型发布 / 更新精选
Ling-2.6与Ring-2.6技术报告:高效即时的万亿参数智能体智能
Ling-2.6优化即时响应与输出token能力,Ring-2.6针对深度推理和复杂智能体工作流。基于Ling-2.0通过架构迁移预训练和大规模后训练升级。架构引入融合Lightning Attention与MLA的混合线性注意力设计,提升长上下文训练与解码效率。通过进化思维链、语言单元策略优化、双向偏好对齐和最短正确响应蒸馏优化token效率。提出KPop强化学习框架支持Ring-2.6-1T在环境交互数据上稳定训练,通过异步调度提升编码、搜索、工具使用和工作流执行的训练…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
GitHub Copilot CLI 在委托任务上变得更具选择性
GitHub Copilot CLI 通过更好的编排实现了更少的任务交接和更快的进度,且没有新增任何配置选项。
信息来源:GitHub Blog
模型发布 / 更新精选
MiniMax M3 获 vLLM 日零支持,1M 上下文窗口与 MSA 稀疏注意力
MiniMax M3 发布,具备前沿编码与智能体能力,原生图像视频输入和计算机使用,1M-token 上下文。核心采用 MSA 稀疏注意力:每个 query 评分 128-token KV 块,仅对 top 块做注意力。vLLM 当日即支持 M3,包括专用 MSA prefill/decode 核、前缀缓存与分块 prefill、BF16 和 MXFP8 检查点、Hopper 与 Blackwell 的 MoE 后端,并在 NVIDIA 与 AMD 硬件上验证。同时支持原生…
信息来源:X:MiniMax (@MiniMax_AI) · NVIDIA
教程 / 实战精选
如何在macOS上设置本地编码代理
来自ikyle.me的教程,指导在macOS上搭建本地编码代理,获Hacker News社区104个点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
OpenAI 新文档智能体上线,导航更直观
OpenAI 在开发者文档网站上线了新的文档智能体,可帮助查找产品相关信息并直接跳转到对应文档。Greg Brockman 表示这是一种强大且酷的网站导航方式,让交互更加直观。
信息来源:X:Greg Brockman (@gdb) · OpenAI
观点 / 方法精选
减少AI生成前端界面粗糙度的文章
本文介绍如何减少AI生成前端界面的粗糙度,发表于envs.net。文章针对AI产出的前端代码常出现的草率、不细致问题,提出改进方法,旨在提升生成结果的质量和可用性。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)