AI 情报文章归档
浏览 AI圈报 已保存的 5897 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5897
正式分类6
精选内容3375
全部文章
第 59 / 148 页 · 每页 40 条
行业动态普通
消息称知名 AI 研究员 Luke Metz 离开 OpenAI,加入 Meta 超级智能实验室
知情人士向 Axios 证实,知名 AI 研究员 Luke Metz 已加入 Meta 超级智能实验室,本周开始工作,向负责 AI 业务的 Alexandr Wang 汇报。Metz 于 2024 年离开 OpenAI,加入 Thinking Machines,今年早些时候重新加入 OpenAI,是最新一位在顶级 AI 实验室间跳槽的研究员。
信息来源:IT之家(RSS) · OpenAI
观点 / 方法普通
OpenAI 长期研究押注的底气何在
OpenAI 已建立起长期研究押注的能力。员工 @kundan2510 称,领导层全力支持全双工模型(gpt-live 系列),即便其成功看似渺茫;这种支持并非特例,而是 OpenAI 研究项目的普遍规则。他确信世界上很少有环境能支撑并坚持这样的赌注。
信息来源:X:Greg Brockman (@gdb) · OpenAI / GPT
模型发布 / 更新普通
阿里巴巴达摩院推出肝癌 AI 模型 DAMO LiON,可精准识别 1 厘米微小肿瘤
阿里巴巴达摩院联合中国医科大学附属盛京医院等机构研发出肝癌诊断 AI 模型 DAMO LiON,可通过 CT 影像识别微小肝脏癌变病灶。两个月真实世界前瞻临床试验中,该模型发现 15 例原本被遗漏的恶性肿瘤,绝大部分为 1 厘米左右病灶;AI 协助阅片用时减少 27%,对恶性肿瘤敏感性提高 11.5%,相关论文登上《自然·医学》。
信息来源:IT之家(RSS)
行业动态普通
《使命召唤:现代战争 4》测试版被指含 AI 生成美术素材,引发玩家争议
《使命召唤:现代战争 4》抢先体验多人测试期间,玩家发现多幅疑似由生成式 AI 创建的游戏内美术作品,引发批评。动视已披露使用生成式 AI 工具帮助制作部分游戏内资产,但尚未确认这些具体作品是否由 AI 生成。玩家反应出现分歧,批评者认为该系列应付费聘请艺术家创作环境细节,也有人担忧 AI 内容在成品资产中愈发明显。
信息来源:IT之家(RSS)
模型发布 / 更新普通
千问正式上线 Wan3.0 视频生成模型
千问今日在千问创作 Web 端(c.qianwen.com)及千问 PC&APP 端正式上线 Wan3.0 视频生成模型,该模型自 8 月 6 日首发公测,支持 30 秒视频直出、真实生动的 AI 角色和丰富镜头运镜。同步开启限时优惠,千问创作会员限时 6 折,适用于短剧、漫剧及营销广告创作。
信息来源:公众号:千问APP(阿里) · Qwen
论文研究普通
Claude 证明 S6 复结构引热议
是时候假装我精通数学了,这样我才能对这东西有多厉害发表点看法。
信息来源:X:Ethan Mollick (@emollick) · Claude
观点 / 方法普通
生数科技提出通用世界模型五级发展路线,发布世界动作模型 Motubrain
生数科技在世界机器人大会上提出通用世界模型五级发展路线,从世界生成、与世界交互、在世界中行动,迈向自主世界智能体与世界组织者。其世界动作模型 Motubrain 推理速度较 Motus 提升约 10 倍,仅需 50 至 100 条人类示范数据即可适配新机器人本体,在 RoboTwin 2.0 基准测试中以 96.1 分位居榜首。
信息来源:公众号:生数科技(Vidu·视频)
模型发布 / 更新普通
阿里云发布Kimi-K3,2.8T参数支持百万上下文
Kimi-K3 已上线,拥有 2.8T 参数,原生 1M-token 上下文。它专为仓库级工程、视觉创作和自主规划下一步的智能体而构建。现提供 1M-token 免费试用,立即探索:Model Studio:https://click.alibabacloud.com/m/20000002576/ Qwen Cloud:https://click.qwencloud.com/m/20000002584/ #KimiK3 #AlibabaCloud #QwenCloud #M…
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen / Kimi
行业动态普通
Anthropic 最强大模型 Fable 5 遇冷,企业用户转向更便宜 AI 产品
Anthropic 最贵模型 Fable 5 发布两个多月后,在 Ramp 统计的 7 万家公司支出中仅占约 11% 且趋于平稳,企业用户正转向更便宜的替代品。高价格及旧模型足以处理多数业务需求是主因,Anthropic 自家更小更便宜的 Opus 5 自 7 月底推出后业务支出已超过 Fable。该公司 7 月年化收入达 650 亿美元,较 5 月 470 亿美元增长,但低于投资者最乐观预期。
信息来源:IT之家(RSS) · Claude
行业动态普通
消息称 NVIDIA 考虑向 Perplexity AI 投资"数十亿美元"
NVIDIA 正考虑在 Perplexity AI 最新融资轮中向其投资"数十亿美元",双方还在磋商技术授权协议。Perplexity AI 计划以超 300 亿美元估值融资,较去年 7 月的 180 亿美元上涨超六成,其年化营收已从 2026 年初的不到 2.5 亿美元增至 7.5 亿美元以上。
信息来源:IT之家(RSS) · NVIDIA
模型发布 / 更新普通
阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频、文档输入
阿里云视频生成模型 Wan3.0 今日正式上线,单次可生成 30 秒视频,并首次支持 doc、xls、ppt、pdf、md 等文档格式输入。公测十余天来,模型在指令遵循、跨镜头一致性、音频质感及视频编辑等方面持续进化。480P/720P/1080P API 价格分别为 0.3/0.6/1.2 元/秒,8 月 24 日至 9 月 23 日限时 7 折。
信息来源:IT之家(RSS)
观点 / 方法普通
AI 机器人回复让小众推文失去共鸣
网站上所有 AI 机器人的一个烦人副作用是,它们全都"博览群书",因此能条理清晰地回复我那些小众领域的引用推文--这些推文原本只会吸引一小群感兴趣的人,现在却会收到大语言模型的回复。 就像你再也分不清以法莲人和基列人了一样。
信息来源:X:Ethan Mollick (@emollick)
观点 / 方法普通
世界模型与智能基建:深聊具身新浪潮,我们看见不同答案|云启 × WRC
信息来源:elsewhere:文章(RSS)
行业动态普通
智元远征 A3 夺得第二届世界人形机器人运动会"武术-太极拳"金牌
智元机器人官方宣布,远征 A3 化身"太极宗师",夺得第二届世界人形机器人运动会"武术-太极拳"金牌,奖牌总数升至 3 金 3 银 2 铜,居奖牌榜首位。远征 A3 采用新一代架构自研关节,总峰值电流 150A,瞬时功率 12kW,机身减重至 55 公斤,综合推重比 0.218 kW/kg。该机器人支持空翻、空中漫步,标称续航 10 小时,支持 10 秒快速换电,24 小时连续运行。
信息来源:IT之家(RSS)
观点 / 方法普通
阿马拉定律依旧不败
阿马拉定律依旧不败。
信息来源:X:Ethan Mollick (@emollick)
行业动态普通
市场监管总局发布酱香型白酒掺杂食用酒精筛查检验方法
市场监管总局发布《食品补充检验方法酱香型白酒中掺杂食用酒精的筛查》(BJS202603),建立覆盖全国酱酒主产区100余家企业、300多款产品的酱香型白酒数据库。该方法依托原位电离-高分辨质谱检测技术与化学计量学算法,可实现批量样品快速筛查,为打击掺杂掺假行为提供技术保障。
信息来源:IT之家(RSS)
论文研究普通
摩尔线程发布《MTT S5000 Prefill-as-a-Service 技术白皮书》,破解长上下文推理成本瓶颈
摩尔线程发布《MTT S5000 Prefill-as-a-Service 技术白皮书》,基于旗舰级AI训推一体智算卡MTT S5000构建"Prefill As a Service"新范式,面向AI Agent、代码生成、超长文档分析等长上下文推理场景。
信息来源:IT之家(RSS)
观点 / 方法普通
宇树破发背后:85%国家意志与赖子式供应链优势
赵纯想转述观点称,宇树市值含85%国家意志,作为具身智能龙头,其市值不应低于互联网公司,否则机器人产业难以为继。另15%为供应链优势:不研发世界模型,靠5个博士生百万年薪养着,待世界模型方向突破后,以快十倍的供应链速度跟进量产。
信息来源:X:赵纯想 (@chunxiangai)
观点 / 方法普通
AI应用骗钱,哦不融资指南
信息来源:elsewhere:文章(RSS)
行业动态普通
东南大学力交互腔镜手术机器人跨越 2400 公里完成 3 例手术,填补国产力感知技术空白
东南大学宋爱国团队牵头的国家重点研发计划项目取得临床突破,其力交互腔镜手术机器人协同郑州大学第一附属医院与新疆医科大学第一附属医院,跨越 2400 公里成功完成两例肾部分切除术和 1 例前列腺癌根治术。团队基于电阻应变原理自研三维力手术提拉与夹持力传感器,使机器人具备接近人手的精细力觉感知能力,填补国产腔镜机器人力感知技术空白。
信息来源:IT之家(RSS)
观点 / 方法普通
a16z 数据:律师用 Codex 增速暴涨 108 倍
a16z 最新图表显示,OpenAI Codex 在企业中的周活增长呈极端分化:律师增速高达 108 倍,销售、招聘各 41 倍,营销 26 倍,医疗 24 倍,而工程师仅 5 倍垫底。Codex 已从代码补全进化为能自主拆解任务、运行数小时的数字同事,律师正用它处理海量长文本与合同比对。这标志着知识工作"编程化",AI 爆发点正从技术圈转向高价值白领岗位。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI
产品发布 / 更新普通
香橙派预热 OrangePi Zero 4 单板计算机:基于全志 A733 处理器
香橙派宣布将推出基于全志 A733 处理器的 OrangePi Zero 4 单板计算机,尺寸 50×55×1.2mm,与 Zero 3 一致。该 12nm SoC 集成 2 个 Cortex-A76、8 个 Cortex-A55 及 1 个 RISC-V 协处理器,配备 3TOPS NPU,支持 LPDDR4(X)/LPDDR5 内存、Wi-Fi 6 与蓝牙 5.4。
信息来源:IT之家(RSS)
行业动态普通
联想集团与海尔集团签署战略合作协议,推动联想 AI PC 与海尔智慧家庭场景融合
联想集团与海尔集团签署战略合作协议,围绕算力基础设施共建、核心技术联合攻关、产业场景共创等领域展开合作。双方将推动联想 AI PC 等智能终端与海尔智慧家庭场景融合,共建数据中心与算力基础设施,并整合海尔卡奥斯工业互联网平台与联想算力基础设施,打造"算力 + 平台 + 场景"一体化方案。
信息来源:IT之家(RSS)
观点 / 方法普通
缓存命中率96%成本降3.2倍
经三天优化,缓存命中率提升至96%,输出/输入比例提升2.5倍,在请求数与输出数不变的情况下成本降低3.2倍。优化核心是采用 Observational Memory(OM)概念,参考 Mastra 文档。此举源于被梁文峰谷+大涨价倒逼出的极限优化。
信息来源:X:赵纯想 (@chunxiangai)
产品发布 / 更新普通
Claude Code 远程控制大幅节省时间
Claude Code 新增的"远程控制"功能将节省大量时间。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
行业动态普通
澜起 PCIe 6.x / CXL 3.x 重定时器列入 PCI-SIG 供应商名录
澜起科技(Montage)宣布其 PCIe 6.x / CXL 3.x 重定时器(Retimer)通过 PCI-SIG 系列认证,正式列入该组织官方供应商名录。该芯片采用自适应均衡技术补偿信道损耗,兼具业界领先的能效表现。澜起总裁 Stephen Tai 称,这一里程碑将为下一代 AI 平台大规模部署其 Retimer 芯片提供保障。
信息来源:IT之家(RSS)
行业动态普通
天骄队人形机器人跳出 7.97 米,夺世界人形机器人运动会跳远冠军
8 月 23 日晚,第二届世界人形机器人运动会跳远决赛中,天骄队机器人跳出 7.97 米,夺得金牌。
信息来源:IT之家(RSS)
论文研究普通
Netflix 如何用 LLM 评判器优化推荐解释
Netflix 每周运行数十万次节目级推荐解释的 LLM 评判器,服务数百万移动端会员,并将其视为包含诞生、训练、部署、监控四阶段的完整生命周期。训练阶段采用推理对齐的规则调优,以元评判器输出为学习信号;部署时同一评判器承担质量门控与反思生成双重角色。五周 A/B 测试显示,相比无解释对照组,浏览到播放的转化率提升,且未出现质量相关问题。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
论文研究普通
SK 海力士披露下一代 HBM 内存先进封装技术,引入英特尔 EMIB
SK 海力士在 Hot Chips 2026 大会上披露下一代 HBM 封装路线图,计划借助英特尔 EMIB 等先进封装技术,未来进入 3D 封装阶段。其 HBM4 带宽超 2TB/s,功耗效率较 HBM3E 提升 40% 以上,容量最高 48GB,并正研发混合键合与 I-HBM 局部热点缓解技术以应对散热挑战。
信息来源:IT之家(RSS)
行业动态普通
天工团队回应机器人捂脸跑夺冠:非人为模仿,是它自己迭代出来的
天工 Omni 在第二届世界人形机器人运动会 400 米(小型组)决赛中以 45.66 秒夺冠,其"捂脸跑"跑姿引发关注。研发团队负责人韩刚回应称,并未找人模仿该跑姿,而是机器人在仿真中通过数据迭代自行"思考"出来的方式。天工 Omni 身高 1.35m、整机 39kg,并开放了关节、传感器、系统及运控 API 的二次开发体系。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Codex 修复用量问题并重置所有付费订阅用量
Codex 已向所有账户推送用量重置,并修复了此前发现的多项问题,用户应能感受到明显改善。修复包括长会话多压缩场景下图片使用低效、Computer History 高 p95+ 用量,以及对话标题生成功能消耗超预期。团队还发现一种全新的效率提升方法,将于下周推进。
信息来源:X:Tibo (@thsottiaux)
行业动态普通
Marin 项目成为 AI 开放训练的典范,全程公开代码、数据与实验结果
Andrew Ng 称赞 Marin 项目是 AI 开放训练的典范,代码、数据、配方及实验结果全程公开。该项目本周启动 535B-A23B 模型训练,计划在 11 台 GB200 NVL72 上处理 18.75T tokens,预训练占 80%、中期训练占 20%,总计算量约 2.7e24 FLOPs,为期约 3 个月。
信息来源:X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)
论文研究普通
AgentX 推理基准:CUDA 护城河能否守住智能体推理
AgentX - InferenceXv3:CUDA 护城河在智能体推理中能否守住?开源 300 万美元数据集,100 万+上下文长度,多轮对话,子智能体 95%+ KVCache 命中率,GB300 NVL72,MI355,B200 https://newsletter.semianalysis.com/p/agentx-inferencexv3-does-cuda-moat
信息来源:X:SemiAnalysis (@SemiAnalysis_)
观点 / 方法普通
两个16岁高中生自建"炼丹社",共享显卡和API让全校免费用AI
北京两名16岁高中生张睿修和冯子上成立"炼丹社",将自有的RTX PRO 6000、Mac studio及从公司、高校争取的算力与API额度整合为FreeAPI项目,向全校开放共享API,提供三个对话模型及文本向量、联网搜索、视频生成能力。社团现有30多人,覆盖高一约120人年级的四分之一。两人还计划帮学校重建整合课表、成绩等信息的校园网站,并嵌入AI检索助手。
信息来源:公众号:数字生命卡兹克
行业动态普通
美国得州州长阿博特:AI 数据中心遭民众反对实属咎由自取
得克萨斯州州长阿博特在 ABC《本周》节目中表示,科技公司围绕 AI 数据中心的宣传未奏效,遭民众抵制是"咎由自取"。盖洛普调查显示,七成美国人反对在本地建设 AI 数据中心,其中 48% 强烈反对。阿博特已叫停该州约 1800 个 AI 数据中心项目,并引入新标准保护居民免受基础设施成本影响。
信息来源:IT之家(RSS)
观点 / 方法普通
OpenAI CEO 奥尔特曼:担心人工智能会被少数强势主体掌控
OpenAI CEO 萨姆·奥尔特曼在 David Senra 播客中表示,担心 AI 终有一天会被少数公司、模型或个人控制,让绝大多数消费者在技术塑造世界问题上没有发言权。他同时担心 AI 挣脱人类控制,并认为对后者的恐惧可能导致前者实现。奥尔特曼还称,美国 AI 领导者未能向公众展示技术如何赋予人们更大自主权,并预测将见证有史以来最大规模的小企业创业热潮。
信息来源:IT之家(RSS) · OpenAI
论文研究普通
Industrial-Instruction:从工业技术报告构建指令微调与基准数据集的端到端框架
Industrial-Instruction框架利用906份松下公开技术文档构建了两个开放QA数据集,各含约13.6k问答对。用该数据微调小于10B参数的开源LLM,在松下基准上将Set-Match Accuracy从28.5%提升至42.0%,F1从46.6%提升至63.5%。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
CyberFactory:用真实世界漏洞实例规模化构建网络安全能力
CyberFactory 是一个统一的开源框架,将数据构建、轨迹合成与模型训练串联起来,覆盖 PoC 生成、漏洞修补和网络安全问答(CyberQA),并把来自野外的 CVE 等漏洞产物转化为可执行、可验证的任务实例。基于该框架训练的模型 Aegis 在 CyberGym 上以一小时预算达到 52.4% Pass@1,较其 Qwen 3.5 基座模型提升 +22.8 分,且推理时无需技能提示。
信息来源:HuggingFace Daily Papers(社区热门论文) · Qwen / Hugging Face
论文研究普通
AutoSaddler:利用智能体执行轨迹实现自动化的 Harness 优化与持久更新
AutoSaddler 提出一种自动化 harness 优化框架,将 harness 改进视为离线学习问题,通过失败轨迹诊断、结构化补丁生成和基于验证的更新选择,迭代优化智能体外部控制逻辑。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
EchoWM:可进入式全模态世界模型
EchoWM 是一个面向可进入式生成媒体的全模态世界模型,能在持续导航中联合生成 720p 视频、环境音、音乐和语音。它围绕相机意图组织交互,将离散指令和连续姿态映射到共享的度量尺度相对 6-DoF 轨迹,并通过渐进训练和自回归后训练实现长时程生成。评测显示其在公开世界模型基准上轨迹跟随和视觉质量表现优异,支持第一/第三人称交互及同步环境音和语音。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face