AI 观点与方法
汇总 AI 使用技巧、实践方法、效率经验、行业观察与专业观点。
分类文章1289
当前页31 / 33
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
观点 / 方法精选
直接开搞就行
Codex 已重置所有套餐的使用限制,方便用户体验新推出的插件。现在可以无限制地使用 Codex 构建项目,尽情尝试。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
观点 / 方法精选
Codex 正式上线 Plugins 功能
Codex 正式上线 Plugins 功能,开箱即用支持 Slack、Figma、Notion、Gmail 等主流开发工具,开发者可直接在 Codex 中调用这些服务。
信息来源:X:Greg Brockman (@gdb)
观点 / 方法精选
Codex 推出插件功能
Codex 正式上线插件系统,开箱即用地支持 Slack、Figma、Notion、Gmail 等开发者常用工具。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
观点 / 方法精选
通过实时强化学习改进Composer编码模型
Cursor团队将实时强化学习技术应用于Composer编码模型,利用真实用户交互产生的推理令牌作为训练信号,以解决模拟环境与真实使用间的匹配问题。该技术使团队能够以每五小时一次的频率部署改进后的模型检查点。通过A/B测试,新版本实现了关键指标提升:代理编辑在代码库中的持久性增加2.28%,用户不满意后续减少3.13%,延迟降低10.3%。实时RL也带来了奖励黑客等新挑战,但真实用户反馈有助于识别和修正此类问题。
信息来源:Cursor Blog · Cursor
观点 / 方法精选
深入解析我们构建 Model Spec 的方法
OpenAI 公开 Model Spec 行为框架,阐述如何在安全、用户自由与问责制之间取得平衡,为 AI 系统发展提供可公开查阅的行为指导原则。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
OpenAI基金会投入10亿美元推动AI科研与风险治理
OpenAI基金会宣布未来一年将投入至少10亿美元,用于推动AI驱动的生命科学突破(如疾病治疗),同时防范新型生物威胁、经济快速转型及模型涌现效应等风险。联合创始人Wojciech Zaremba转任AI韧性负责人,主导韧性式安全体系建设;Jacob Tref、Anna Adeola分别负责生命科学及公民社会业务,Robert Kaiden与Jeff Arnold出任CFO及运营总监。
信息来源:X:Sam Altman (@sama) · OpenAI
观点 / 方法精选
利用长时运行智能体工作流革新科学计算
Anthropic 研究员展示了如何将多日智能体编码工作流应用于科学计算任务。以使用 Claude Opus 实现宇宙学玻尔兹曼求解器的可微分版本为例,该任务通常需耗费研究人员数月甚至数年时间。通过制定清晰的项目指令、利用日志文件作为智能体的持久记忆并设置测试预言,即使是非领域专家也能引导智能体在数小时内完成这类复杂项目。该方法的核心在于设定高层目标后,让智能体团队自主工作,仅需偶尔人工监督,从而显著提升了科学代码开发与移植的效率。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
观点 / 方法精选
Google 本周多项更新🧵
Google AI Studio 上线全栈 vibe coding 功能,集成 Antigravity 编程助手与 Firebase,支持将提示词直接转为生产级应用。
信息来源:X:Sundar Pichai (@sundarpichai)
观点 / 方法精选
(1/N) We're launching Dreamverse. Most AI video models take minutes to generate a 5 s 1080p clip. In…
(1/N) 我们正在推出 Dreamverse。大多数 AI 视频模型需要数分钟才能生成一段 5 秒 1080p 的片段。而在 4.5 秒内,我们就能在单张 GPU 上生成 30 秒 1080p 的片段。
信息来源:X:Sky Computing Lab (@haoailab)
观点 / 方法精选
直接动手做就行
Sam Altman 称赞 Codex 团队是硬核构建者,产品实力过硬,圈内硬核开发者已纷纷转向使用,使用量正快速增长。
信息来源:X:Greg Brockman (@gdb)
观点 / 方法精选
事物的形态
盘点当前阶段的核心现状与关键特征,基于现有趋势分析接下来可能发生的重要变化与未来走向。
信息来源:Ethan Mollick:One Useful Thing(RSS)
观点 / 方法精选
十年前,AlphaGo 在首尔的传奇对局标志着现代 AI 时代的开启
十年前的 AlphaGo 首尔对局开启现代 AI 时代,标志性的"第37手"证明 AI 已能攻克科学等现实难题,其技术理念仍是构建 AGI 的核心基础。
信息来源:X:Demis Hassabis (@demishassabis)
观点 / 方法精选
ChatGPT 推出数学与科学学习新方式
ChatGPT 新增数学与科学交互式可视化解释功能,支持实时探索公式、变量及概念,帮助学生更直观地理解理科知识。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
观点 / 方法精选
i'm joining forces with @ylecun and an incredible group of people to start AMI Labs @amilabs. AMI …
我与 @ylecun 和一群杰出人士联手创立 AMI Labs @amilabs。
信息来源:X:谢赛宁 (@sainingxie)
观点 / 方法精选
Runway 推出 Characters:单图实时生成可对话虚拟角色 API
Runway 推出 Characters API,基于 GWM-1 世界模型,支持用单张图片零微调生成实时可对话虚拟角色。支持自定义外观风格、声音、性格及知识库,具备自然表情、眼神、口型同步和手势。面向客户支持、培训教育和品牌营销等企业场景,已获 BBC 等采用。开发者可通过 API 集成,消费者也可在网页端体验预设角色。
信息来源:Runway:News(网页)
观点 / 方法精选
驱动业务重塑的五种 AI 价值模型
五种 AI 价值模型展示了领导者如何循序渐进地部署 AI,从提升员工熟练度到彻底重塑业务流程,从而构建持久的商业竞争优势。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
5.4版本将提前发布
官方暗示5.4版本发布时间将早于外界普遍预期,新版本即将到来。具体发布日期及新增功能细节有待后续正式公布,玩家可关注官方渠道获取最新动态。
信息来源:X:OpenAI (@OpenAI) · OpenAI
观点 / 方法精选
在 Project Genie 中创建新世界的 4 个技巧
Google DeepMind 分享 Project Genie 使用指南,提供 4 个提示词写作技巧,帮助用户通过自然语言描述生成可交互的虚拟世界。
信息来源:Google Blog:AI(RSS) · Gemini
观点 / 方法精选
Apple 推出搭载 M5 芯片的全新 MacBook Air
Apple 发布了搭载 M5 芯片的全新 MacBook Air,为这款全球最受欢迎的笔记本电脑带来卓越性能和扩展的 AI 能力。新款 MacBook Air 在性能上实现显著提升,并增强了人工智能相关功能,进一步巩固其在轻薄本市场的领先地位。
信息来源:Apple:Newsroom(RSS)
观点 / 方法精选
OpenAI 与 Department of War 的协议
OpenAI 披露与 Department of War 达成的协议内容,详细划定 AI 部署的安全红线,明确相关法律保障措施,并具体说明 AI 系统接入机密环境的部署方式。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
拒绝"AI 味":我们用 6 个文学维度,重新审视了模型的创意写作边界
本文通过叙事工艺、语言艺术等六个文学维度,评估百灵模型Ling-2.5-1T的创意写作能力。测试显示,该模型能驾驭莎士比亚十四行诗、七言绝句等多种体裁,并通过感官描写实现"展现而非告知"的文学技法,在微观叙事和语言质感上接近人类水平。然而,模型仍存在依赖高频文学意象、处理否定指令时语义代偿等局限。该框架为创作者提供了激发AI写作潜力的具体方法。
信息来源:蚂蚁百灵:Developer Blog(网页)
观点 / 方法精选
It's extremely good that Anthropic has not backed down, and it's siginficant that OpenAI has taken a…
Anthropic 没有退缩,这非常好,OpenAI 采取了类似立场,这也很重要。 未来会有更多此类具有挑战性的情况,相关领导人挺身而出、激烈竞争对手搁置分歧,这将至关重要。很高兴今天看到这一幕。
信息来源:X:Ilya Sutskever (@ilyasut) · OpenAI / Claude
观点 / 方法精选
OpenAI Codex 与 Figma 推出无缝代码转设计体验
OpenAI 与 Figma 推出全新 Codex 集成,打通代码与设计的双向链路。开发团队可直接在代码实现与 Figma 画布间无缝切换,加速迭代和交付流程。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
Ling 2.5 Lightning Attention+MLA 混合线性架构改造实践
为提升超长上下文下的计算效率,Ling 2.5架构将Ling 2.0的GQA改造为1:7的Lightning Attention与MLA混合线性注意力。此举旨在利用Lightning Attention提升长序列吞吐,并通过MLA极致压缩KV Cache。为确保改造后性能无损,团队设计了精细的平滑迁移训练策略,包括权重转换、QK Norm融合与Partial RoPE改造等多阶段加训。Scaling Law实验确定了1:7为最优混合比例,最终使万亿参数模型实现了更低的计算成…
信息来源:蚂蚁百灵:Developer Blog(网页)
观点 / 方法精选
22自由度灵巧手人形机器人:从2万小时人类视频学习精细操作
研究团队提出EgoScale方法,基于20,000小时第一人称人类视频预训练GR00T N1.5,仅用4小时机器人数据即可掌握组装模型车、操作注射器等高灵巧度任务,性能较从头训练提升54%。研究发现人类视频量与动作预测损失呈对数线性缩放关系(R2=0.998)。该方法利用22-DoF手部与人类的运动学相似性,无需复杂迁移算法即可重定向动作。策略可跨硬件迁移至Unitree G1(7-DoF),性能提升30%以上,且仅需单个示教即可学习新任务。
信息来源:X:Jim Fan (@DrJimFan)
观点 / 方法精选
AI 吸血鬼
AI(如 Claude Code)确实能带来 10 倍生产力提升,但创造的价值大部分被公司捕获,员工可能过度劳累却收获甚微。微软内部已自发大量采用 Claude Code。这种效率加速迫使工作节奏不断加快,导致许多早期采用者(包括作者自己)出现严重的"午睡攻击"和日常疲劳。公司作为资本机器难以放缓脚步,形成一种让从业者无论是否使用 AI 都被持续"抽血"的困境。
信息来源:Steve Yegge:Medium(RSS) · Claude
观点 / 方法精选
新里程碑:基于世界模型骨干的DreamZero实现零样本开放世界机器人控制
团队发布DreamZero,首个基于世界模型骨干的World Action Model (WAM)。该模型突破传统Vision-Language-Action范式,通过像素级世界模型实现零样本开放世界提示能力,可执行未训练过的新任务。研究发现WAM依赖多样化数据而非重复演示,并以像素作为跨具身的通用桥梁,实现robot2robot和human2robot知识迁移。仅需55条轨迹(约30分钟遥操作)即可适应全新硬件,验证世界模型作为Physical AI下一代基础的可行性。
信息来源:X:Jim Fan (@DrJimFan)
观点 / 方法精选
从"下一个词预测"到"世界建模":AI预训练的第二范式
作者指出,AI预训练正经历从"下一个词预测"到"世界建模"的根本性范式转变。世界模型的核心是预测给定行动后的下一个物理状态序列,本质上是可学习的物理模拟器,并将视觉置于首位。相比之下,当前主流的视觉语言模型本质是语言优先,视觉是次要输入。生物智能中视觉处理占据皮层计算的主导地位,是连接大脑、动作与物理世界的高带宽通道。作者以猿类为例,证明强大的物理智能可独立于高级语言存在。他预测,2026年大型世界模型将为机器人技术和多模态AI奠定真正基础,而YouTube等平台的海量视觉…
信息来源:X:Jim Fan (@DrJimFan)
观点 / 方法精选
技术的青春期:强大 AI 对国家安全、经济和民主的风险及防御
Dario Amodei 发布长文《技术的青春期》,指出强大 AI 正处于"青春期"阶段,对国家安全、经济和民主构成重大威胁,并探讨了防御这些风险的具体路径。
信息来源:X:Dario Amodei (@DarioAmodei)
观点 / 方法精选
MiniMax Speech 2.8 语音模型
MiniMax 发布新一代语音模型 MiniMax Speech 2.8,通过原生声音标签技术模拟人类口语中的"嗯"、"啊"等填充词及呼吸停顿,显著提升对话自然度。该模型支持10秒样本高保真声音克隆,精准还原音色与语速,同时消除背景噪音与数字伪影,输出录音室级纯净音质。此外,模型优化了跨语言表现,从普通话-日语对开始解决口音渗透问题,实现更接近母语者的发音效果。
信息来源:MiniMax:Blog(网页)
观点 / 方法精选
设计抗AI技术评估的实践
Anthropic性能优化团队负责人Tristan Hume分享了设计抗AI技术评估的经验。自2024年初,团队使用带回家测试评估候选人优化模拟加速器代码的能力,超1000人参与,成功招聘数十名工程师。但随着Claude模型快速迭代,Opus 4已超越多数人类申请者,Opus 4.5甚至匹配顶尖候选人,导致在时间限制下难以区分人类与AI输出。为此,作者三次重设计测试,探索抗AI评估要素,详述原始设计、模型破解方式及非常规对策。最终,团队将原始测试作为公开挑战发布,因无时间限…
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
观点 / 方法精选
Niji V7 正式发布!
Niji V7 图像模型正式上线。该版本专为亚洲及动漫场景优化,改进了动漫连贯性、提示词理解能力、文字渲染效果及 sref 性能。
信息来源:Midjourney:Updates(RSS)
观点 / 方法精选
揭秘AI智能体评估:构建可靠系统的关键
有效的评估能帮助团队更自信地发布AI智能体,避免陷入仅在生产环境被动发现问题、修复可能引发新问题的循环。智能体因其多轮操作的自主性与灵活性,评估更为复杂。一个完整的评估结构包含任务、评分器、记录、结果、评估框架与评估套件等核心组件。缺乏系统评估将导致团队无法区分真实的质量倒退与随机波动。建立评估体系能帮助团队在智能体规模化过程中持续监控质量、自动测试变更并量化改进效果,其价值在智能体整个生命周期内持续累积。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
观点 / 方法精选
Adam Marblestone - AI 缺失了关于大脑的根本认知
Adam Marblestone 指出,当前人工智能研究忽略了大脑运作的核心机制。与业界普遍关注神经网络架构不同,大脑的真正优势在于其奖励函数而非结构本身。这一观点挑战了主流 AI 研究范式,暗示未来突破可能来自对大脑激励系统的深入理解,而非单纯的架构模仿。该论断为人工智能发展提供了新的思考维度。
信息来源:Dwarkesh Patel:Podcast & Blog(RSS)
观点 / 方法精选
可蒸馏模型与合成数据管道:使用 NeMo Data Designer
介绍如何利用 NeMo Data Designer 构建许可安全的合成数据工作流,用于模型特化(model specialization)。该管道支持生成可蒸馏模型所需的高质量合成数据,确保数据来源合规,适用于下游微调与领域适配场景。
信息来源:OpenRouter:Announcements(RSS)
观点 / 方法精选
晚购特斯拉却早试FSD v14:首个通过物理图灵测试的AI体验
作者虽晚购特斯拉却率先体验FSD v14,认为这是首个通过"物理图灵测试"的AI系统:疲惫下班后只需按下按钮放松休息,已无法分辨是神经网络还是人类在驾驶。尽管深知机器人学习原理,方向盘自动转动时的流畅表现仍令人震撼。这项技术正从超现实体验转变为日常习惯,最终如智能手机般不可或缺。这种对"神级技术"的深度依赖,正在从根本上重塑人类行为模式。
信息来源:X:Jim Fan (@DrJimFan)
观点 / 方法精选
not getting into a philosophical debate, but this book really changed how I see the topic and made m…
不想陷入哲学辩论,但这本书确实改变了我对这个话题的看法,让我更加谦逊。人类智能令人印象深刻,但称其为"通用"并不太客观。我的猫会不同意。 在我看来,人类智能更应被视为社会驱动的认知适应,而且我们仍不理解、也远未用当前 AI 复现的智能领域还有巨大 WORLD。 【引用 @demishassabis】:Yann 在这里完全错了,他把通用智能和 universal intelligence 混淆了。 大脑是我们在宇宙中所知最精致、最复杂的现象(迄今为止),而且它们实际上极其通用…
信息来源:X:谢赛宁 (@sainingxie)
观点 / 方法精选
One point I made that didn't come across: - Scaling the current thing will keep leading to improveme…
我之前说的一点没被传达清楚: - 继续扩展当前的技术会持续带来进步。特别是,它不会停滞。 - 但某些重要的东西仍会继续缺失。 【引用 @haider1】:以下是今天 ilya sutskever 播客的要点: - 5-20 年内实现超级智能 - 当前的扩展将严重停滞;我们回到了真正的研究 - 超级智能 = 超快速的持续学习者,而非完成的预言机 - 模型的泛化能力比人类差 100 倍,这是最大的 AGI 阻碍 - 需要全新的 ML 范式(我有想法,现在不能分享) - AI 影…
信息来源:X:Ilya Sutskever (@ilyasut)
观点 / 方法精选
well someone has been preaching this at us for like 6+ years glad we are past the 'feel the agi' pha…
好吧,有人已经向我们宣扬这个大概6年多了 很高兴我们已经过了"感受AGI"的阶段,回到了构建人类水平智能的道路上 https://t.co/Qp8FyLPaQU 【引用 @dwarkesh_sp】:"AGI和预训练发生的事情是,在某种意义上它们过冲了目标。 你会意识到人类并不是AGI。因为人类缺乏大量的知识。相反,我们依赖持续学习。 如果我培养出一个超级聪明的15岁孩子,他们其实什么都不知道。一个优秀的学生,非常渴望学习。【你可以说,】'你去当程序员吧。你去当医生吧。去学习…
信息来源:X:谢赛宁 (@sainingxie)
观点 / 方法精选
为长时运行智能体设计有效约束方案
为解决AI智能体在跨越多上下文窗口执行长期任务时的"记忆丢失"与进展不一致问题,Anthropic为Claude Agent SDK开发了一套双重方案。该方案包含一个初始化智能体,负责在首次运行时建立基础环境并生成功能清单;以及一个编码智能体,负责在后续会话中进行增量开发并提交清晰可合并的代码。通过结构化的进度日志和Git历史等机制,引导智能体避免"试图一次性完成所有功能"或"过早宣布完成"的失败模式,从而实现跨会话的持续有效协作。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude