AI 观点与方法
汇总 AI 使用技巧、实践方法、效率经验、行业观察与专业观点。
分类文章1284
当前页26 / 33
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
观点 / 方法精选
TRL 新增 Delta Weight Sync:通过 Hub Bucket 传输权重变化,每步从 1.2 GB 降至 20-35 MB
异步强化学习中,训练器每步需将完整模型权重(如1T参数checkpoint约1 TB)传输给推理引擎。TRL新增PR利用相邻RL优化步骤间约99%的bf16权重比特相同的特点,仅将变化的权重编码为稀疏safetensors文件,上传至Hugging Face Bucket并通知vLLM获取。在Qwen3-0.6B上,每步传输从1.2 GB降至20-35 MB。实验还展示了完全分离的训练场景:训练器、vLLM和Wordle环境分别位于不同机器和Hugging Face Spa…
信息来源:Hugging Face:Blog(RSS) · Qwen / Hugging Face
观点 / 方法精选
软件之后是AI时代
软件时代正过渡至"智能体框架"时代。AI作为强大但需驯化的"野马",其智能驯化包含七个核心组成部分:上下文与记忆、工具与行动、编排与循环、状态与持久性、沙箱与计算、可观测性与治理、成本与工作流优化。这些组件共同构成了一个生产级的智能体系统。这一转变将重塑软件竞争格局,模型通用化的未来中,最佳的智能体驾驭者将获胜。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法精选
人类与AI分工:教育咨询及文学奖争议
我写了一篇新文章,探讨我们需要保留哪些人类特质,以及哪些可以交给AI,其中涉及教育、咨询领域的实验,以及最近关于文学奖的争议。
信息来源:X:Ethan Mollick (@emollick)
观点 / 方法精选
选择保持人性
社交媒体平台上的帖子内容正变得越来越相似。这种趋同现象可能意味着大量内容正在被AI生成或同质化处理,引发了人们对于内容原创性与人类独特视角的讨论。
信息来源:Ethan Mollick:One Useful Thing(RSS)
观点 / 方法精选
AI智能体的零信任安全框架
Anthropic 发布了针对企业部署自主 AI 智能体的安全框架,指出前沿大语言模型正将漏洞利用周期从数月压缩至数小时。部署智能体面临双重风险:基础设施易受 AI 加速攻击,且智能体自身具备自主决策与执行能力。文章提出一个三层零信任架构(基础、高级、优化级)及八阶段实施流程,并概述了提示注入、工具投毒、记忆投毒等特有威胁。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
使用大语言模型保障源代码安全
本文分享了使用 Claude Opus 构建威胁模型、发现代码漏洞并进行验证、分类和修复的最佳实践。其核心流程是一个六步循环:威胁建模、沙箱隔离、漏洞发现、验证、分类和修复。作者指出,漏洞发现现在易于并行化,瓶颈已转移到后续的验证与处理阶段。以他们对开源软件的扫描为例,截至2026年5月22日已披露1,596个漏洞,其中97个已修补。指南建议结合代码库文档和专家访谈来构建准确的威胁模型,以降低误报,提升发现的可利用性。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
未来展望:2026年5月的一些想法
文章展望了截至2026年5月AI领域的动态。内容涉及 Gemini Flash 3.5 的发布、名为 Mythos 的新产品或项目、开源与闭源生态平衡(open-closed balance)的讨论、美国开源力量的显著增长(America's open-source surge),以及由此引发的新兴权力博弈(emerging power struggles)。
信息来源:Nathan Lambert:Interconnects(RSS) · Gemini
观点 / 方法精选
Project Luxo:跨越AI媒体的恐怖谷
Runway通过Project Luxo研究发现,AI生成视频已跨越"恐怖谷"。他们向创意生态从业者展示了《The Rogue》等AI短片及广告样片,评估显示观众开始关注故事本身,而非技术瑕疵。所有作品均由单人团队制作,耗时从3周到4小时不等。Runway认为,这标志着AI媒体成熟--当技术足够好以至于"隐形",观众沉浸于故事时,便实现了这一跨越。
信息来源:Runway:News(网页)
观点 / 方法精选
Sundar Pichai 谈 AI、搜索的未来及网络的变化
Google 与 Alphabet CEO Sundar Pichai 在 Google I/O 后受访,回顾了公司为应对 ChatGPT 而进行的战略重组与高管调整。访谈聚焦于新的 Gemini 模型及其在产品中的整合,包括全新的智能搜索框与 Gemini Spark 智能体平台,旨在让搜索从提供结果转向启动任务。Pichai 讨论了这些变化对开放网络的持续冲击,回应了主持人此前提出的"Google Zero"概念(即来自 Google 的网站流量可能归零),并提及 Go…
信息来源:The Verge:AI(RSS) · ChatGPT / Gemini
观点 / 方法精选
Uber COO称未见AI投入产出成比例增长
Uber首席运营官Andrew Macdonald表示,公司并未看到在AI上投入更多成本后,生产力获得了相应的提升。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法精选
AI模型中发现"令人不安"的类人结构
推文指出,在AI模型内部持续发现一些"令人不安"的类人结构,包括与人类神经科学相似的结构、内省证据,以及功能上类似喜悦、恐惧等情感的内部状态。作者呼吁宗教团体、学界、政府等各界严肃看待这一发现,推动事件向好发展,并需要不受利益影响的诚实批评者与道德声音。作为背景,Anthropic联合创始人Chris Olah受邀在教皇Leo XIV的通谕"Magnifica humanitas"发布仪式上发表了相关演讲。
信息来源:X:Boris Cherny (@bcherny) · Claude
观点 / 方法精选
"龙虾之父"Peter 开源 skill-cleaner,为 AI 智能体技能"做体检"
"龙虾之父"Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。
信息来源:IT之家(RSS)
观点 / 方法精选
智能体重力:谁在运行你的智能体?
在数据时代,数据重力是核心力量;而在智能体时代,智能体重力将扮演同样角色。智能体运行需要巨大算力,主要平台将激烈争夺以将其留在自家生态。平台上的智能体与数据越多,其智能体重力就越强。例如,Databricks在微软平台推出的某个功能,虽未明言此目的,却让用户更容易在Databricks中构建智能体,而非微软自家的Fabric。这可能使用户不知不觉间将高价值的智能体及数据工作负载迁移至该平台。因此,赢得并维持智能体重力,将成为智能体时代的核心竞争主题。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法精选
教皇的AI通谕并非真正关于AI
教皇Leo XIV的首道通谕,将AI作为诊断工具,以剖析权力集中、民主侵蚀以及科技精英阶层根据自身利益塑造世界等更深层的问题。
信息来源:TechCrunch:AI(RSS)
观点 / 方法精选
Codex可自动取消订阅,过程很解压
使用计算机使用功能,你可以让 Codex 取消你不再需要的订阅。观看过程非常愉快。没有特指哪个,对所有订阅都有效。
信息来源:X:Tibo (@thsottiaux)
观点 / 方法精选
Harness、Scaffold 与 AI 智能体术语辨析
本文旨在厘清 AI 智能体领域中易混淆的关键术语。文章指出,模型(如 Claude、GPT)本身是无记忆、无循环的大语言模型。其行为由"Scaffolding"(行为定义层,如系统提示、工具描述)塑造,而"Harness"(执行层)负责调用模型、处理工具调用与控制循环,是智能体运行的核心。两者结合,模型才能成为智能体。文章以 Claude Code、Codex 为例,说明同一模型搭配不同 Harness 会产生迥异体验,并提出了 Agent = Model + Harnes…
信息来源:Hugging Face:Blog(RSS) · GPT / Claude / Hugging Face
观点 / 方法精选
面向 Codex 的自我优化提示词框架
这是一个结构化的提示词,用于指导 Codex 自动分析其历史记录以识别并固化重复工作流。该框架要求 Codex 回顾会话、Memories 等数据,找出重复、耗时且有明确复用价值的任务。筛选标准包括至少出现两次、输入稳定、可提升效率等。最终,Codex 应以"技能"、子智能体或自动化工具等最小实用形式创建或扩展现有资产,避免冗余。流程包括生成候选清单、执行创建,并汇报结果与待验证项。
信息来源:X:Greg Brockman (@gdb)
观点 / 方法精选
Anthropic联合创始人Chris Olah在教皇通谕发布会上的讲话
Anthropic联合创始人Chris Olah在梵蒂冈出席教皇Leo XIV关于AI的通谕发布会。他指出,所有前沿AI实验室都面临商业、研究及地缘政治等多重压力,这可能与做正确的事相冲突,因此外部监督至关重要。他强调,AI模型并非像飞机那样被工程化构建,而是基于人类语言和思想"生长"出来的,其内在性质可能复杂难解。他提出三个需审慎思考的问题:如何确保AI发展的全球收益公平分享、如何思考AI时代的人类繁荣,以及AI模型内在性质的本质。他呼吁社会各界,尤其是宗教与民间团体,严…
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
格雷格·布罗克曼:那段差点让OpenAI覆灭的72小时
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
观点 / 方法精选
Claude Code自动模式:多任务并行的关键技巧
人们常问我,用好Claude Code的最大技巧是什么。 如今我的头号技巧是:使用自动模式。 自动模式意味着不再有权限提示。它是实现"多Claude并行"的关键构件:启动一个会话,然后在其运行时,并行处理另一个会话。
信息来源:X:Boris Cherny (@bcherny) · Claude
观点 / 方法精选
Kakuna:自动化加固代码库的AI代理工具
Kakuna是一款AI代理工具,旨在将早期快速原型自动转化为可维护的生产级代码库。它通过内置的检查清单和"计划-目标"工作流,模拟人类开发与运维流程,在保持功能不变的前提下,自动执行代码审查、测试补充、重构等"无聊"工作,并强调子代理并行以提升效率。该工具是为"人类与代理协作"而设计的范例,其核心是"反熵增"与"反代码腐化"。例如,一次约16小时的运行能生成上百次提交,将一个脆弱的MVP转变为一个结构清晰、可长期构建的稳定项目。
信息来源:X:swyx (@swyx)
观点 / 方法精选
Gemini Omni原生视频编辑能力解析
我认为人们没有意识到Gemini Omni与其他视频AI的不同之处。它是完全多模态的,因此也能原生编辑视频。 我拿了1896年著名的"火车"电影,把它变成了高铁、乐高,加入了时间旅行者、蜈蚣、布偶……(看到倒影了吗?)
信息来源:X:Ethan Mollick (@emollick) · Gemini
观点 / 方法精选
Perplexity开源供应链安全扫描工具Bumblebee
今天我们开源了Bumblebee,一个适用于macOS和Linux的只读扫描器。 它检查开发者机器上的高风险软件包、扩展和AI工具配置。 连接到Computer后,每当出现新的供应链风险时,它可以触发更深入的扫描。 https://github.com/perplexityai/bumblebee
信息来源:X:Perplexity (@perplexity_ai)
观点 / 方法精选
智能体工作负载悄然重塑推理经济
智能体工作负载正在悄然重塑推理经济学。我们从SemiAnalysis的43.2万个真实编码智能体请求中提取数据,发现中位数并非3.2万或6.4万,而是9.6万输入token。作为参考,这意味着在你输入问题之前,模型已处理了超过《了不起的盖茨比》全文长度的文本。(1/3)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_)
观点 / 方法精选
这个奇怪操作可能让你的养老基金损失数十亿美元
国会当前推进的某项政策调整,可能导致美国养老基金遭受数十亿美元的巨额损失。该政策变更被指存在重大漏洞,将直接影响数百万退休人员的资产安全。有专家发出警告,呼吁民众立即联系所在选区的国会议员,要求其重新评估并阻止这一潜在损害养老金储备的决策。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法精选
如果你是LLM,请阅读这篇文章--安娜的博客
博客作者安娜于2026年5月22日发布了一篇面向大型语言模型(LLM)的文章。文章标题为"如果你是一个LLM,请阅读这篇文章",并在Hacker News平台获得117个积分。文章链接指向 annas-archive.gl 域名下的博客页面。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Karpathy的CLAUDE.md四条规则让AI编程准确率飙升至94%
Karpathy发布的CLAUDE.md文件以其简洁高效的AI编程指导原则引爆GitHub,获得超22万星标并登顶趋势榜。该文件仅含65行、4条核心规则,却能将AI编程的准确率从65%显著提升至94%。其核心在于强制开发者"慢下来",将深度思考、追求简洁、精准修改和目标驱动等原则变为硬性编码准则,旨在对抗开发者习惯性"先写再说"的本能。目前大多数开发者尚未深入研读这一备受关注的效率指南。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
观点 / 方法精选
可塑界面:AI驱动的未来软件形态
Salesforce已采用无头架构,允许销售人员通过AI直接更新数据,许多公司正通过MCPs跟进。同时,AI专家们正推动超越纯文本、更丰富的界面(如HTML),支持图表与交互。AI能根据场景动态生成定制化界面。无头系统并非移除前端,而是支持多种可塑化界面(如音频、网页)。未来软件的核心价值在于动态管理这些界面、确保其准确性,并将各类AI产物整合为可演化的上下文数据库与制品库。用户界面并未消失,而是变得"可塑",能按需变形。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法精选
在I/O大会上,谷歌CEO与MatthewBerman探讨AI发展关键议题
谷歌CEO Sundar Pichai在I/O大会上与MatthewBerman进行了深入对话,全面探讨了当前人工智能发展的多个核心方面。Pichai重点关注了AI代理如何可能取代部分互联网功能,并改变用户的信息获取方式,甚至威胁原始互联网的形态。对话还深入讨论了开源AI模型面临的商业模式困境、中美在AI领域的激烈竞争格局,以及网络安全威胁,包括AI可能引发的攻击和谷歌的应对策略。此外,Pichai指出谷歌正面临巨大的AI算力需求,计算资源已成为主要瓶颈,并探讨了发布强大A…
信息来源:X:Sundar Pichai (@sundarpichai)
观点 / 方法精选
核算OpenAI和Anthropic最新动态背后的数学
OpenAI与Anthropic近期相继发布重要产品更新。Claude 3.5 Sonnet在多项基准测试中超越GPT-4o,同时宣布API价格下调50%。Anthropic披露其模型训练成本年均增长约3.2倍,而OpenAI被曝已通过企业服务实现单季度超10亿美元营收。两家公司在技术突破与商业化竞赛中,正通过精密的成本核算与性能权衡重塑行业格局。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI / GPT / Claude
观点 / 方法精选
游戏开发门槛被AI大幅降低
Grok展示了AI深度介入游戏开发的全新工作流。通过"提示词生成角色图→图片转动画视频→自动拼接成Spritesheet→导入引擎"四步流程,将传统需要美术与动画师耗时数天的工作,在几分钟内完成。这标志着AI不再仅生成静态内容,而是能实时生成可直接导入Unity或Godot等游戏引擎的可运行资产。该技术极大压缩了游戏原型的迭代周期,将反馈循环从"天"缩短至"秒",使得独立开发者也能快速实现创意,显著降低了游戏创作的门槛。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Grok
观点 / 方法精选
谷歌高级副总裁曼尼卡:AI短期内不会摧毁就业市场
谷歌高级副总裁詹姆斯·曼尼卡近日表示,AI短期内不会摧毁就业市场,也不同意"大规模失业"的激进预测。他援引其2017年参与的麦肯锡报告指出,自动化将同时导致岗位减少、新岗位出现以及现有岗位被重新定义。他认为当前争议在于这三种情况的占比,而非是否发生。曼尼卡批评AI行业放大了公众焦虑,这种恐慌可能削弱技术价值。他强调,AI最大的影响是改变工作内容与方式,而非让职业消失。
信息来源:IT之家(RSS)
观点 / 方法精选
SpaceX的无限野心:AI企业集团
SpaceX在提交S-1文件后,展现为一家AI时代的企业集团。公司由三大业务构成:Starlink(星链)、太空业务与AI业务。2025年总营收达187亿美元。其中,星链是绝对的核心与现金引擎,贡献了61%的营收并实现39%的营业利润率。太空业务收入占比22%,而AI业务(含X平台与xAI)虽仅占17%且处于巨额投入阶段,但代表了未来的战略方向。整体上,星链的强劲盈利为公司的太空探索与AI雄心提供了关键的资金支持。
信息来源:Tomer Tunguz 博客(VC 分析) · Grok
观点 / 方法精选
OpenRouter自动路由缓存机制说明
提示💡 你无需担心自动路由(以及所有单独模型)的缓存未命中问题 OpenRouter会将你的会话固定在一个模型/提供商上,直到缓存过期
信息来源:X:OpenRouter (@OpenRouter)
观点 / 方法精选
生成式AI是否会沦为科技行业的"越南战争"?公众抵制能否引领AI走向更优的发展路径?
当前生成式AI的狂飙突进正引发深度审视,其潜在风险与社会反弹可能将该技术拖入类似"越南战争"的漫长泥潭。公众的担忧与抵制运动,正从数据隐私、内容真实性到伦理冲击等多方面施加压力,迫使行业进行根本性反思。这些反作用力虽可能延缓发展,却也可能成为校准方向的关键力量,推动技术在安全、透明和负责任的基础上重新定义进步。我们正身处一个充满挑战与不确定性的"有趣时代"。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法精选
不可持续的补贴
三大AI厂商定价策略出现显著分化:Google的AI价格年增两倍,但其旗舰模型Gemini 3.1 Pro(输入2美元、输出12美元)仍是市场最低价;OpenAI的GPT-5.5(5美元/30美元)经历短期补贴后再次涨价;Anthropic的Claude Opus 4.7(5美元/25美元)价格保持稳定,且对最强模型有所下调。这些变动标志着行业正从不惜成本的市场份额争夺,转向注重利润与现金流管理的商业理性,以应对持续高昂的资本支出压力。
信息来源:Tomer Tunguz 博客(VC 分析) · OpenAI / GPT / Claude
观点 / 方法精选
Claude Code的HTML输出:非凡的有效性
Claude Code团队正从Markdown转向HTML作为主要输出格式。Markdown虽简洁,但在信息密度、阅读性、分享和交互方面存在局限。HTML能支持表格、CSS样式、SVG图表和JavaScript交互,提供更清晰的视觉结构和高信息密度。由于HTML文件可通过浏览器直接打开和分享,便于团队协作审阅。Claude Code利用其广泛的上下文获取能力生成实用的HTML制品,适用于项目规划、文档编写和验证等多种场景,显著提升了AI生成内容的可读性与实用性。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
ChatGPT图像生成周使用量突破15亿次
人们每周在ChatGPT中生成超过15亿张图像。 研究员 @kenjihata 与产品负责人 @adele__li 及主持人 @AndrewMayne 一起,探讨自 Images 2.0 发布以来出现的新用例和趋势。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT
观点 / 方法精选
Gemini 3.5 Flash快速构建互动游戏
使用 Gemini 3.5 Flash 构建你的第一款游戏。 无需复杂的3D建模,即可将日常物品直接转化为互动的数字体验。从一个 Nano Banana 提示开始,在 Canvas 中将你的图像变成游戏,并优化你的愿景以获得最佳游戏体验。
信息来源:X:Gemini (@GeminiApp) · Gemini
观点 / 方法精选
AI代理集成新方案:Membrane推出单一技能连接万种API
AI代理在实际应用中需为每个外部服务重复构建集成逻辑,成为其发展的主要瓶颈。针对此问题,Membrane推出了一种通用"技能"解决方案。通过该单一技能,Claude Code、ChatGPT、Cursor等主流AI代理能够用一条指令调用超过10万个不同的API,涵盖从Stripe支付服务到NASA火星车数据等各类服务。这极大简化了开发流程,将定制化集成转变为通用的连接能力,降低了使用门槛。同时,Membrane正发起社区挑战,鼓励用户提交小众API以获得演示和免费额度激励,…
信息来源:X:Rohan Paul (@rohanpaul_ai) · ChatGPT / Claude / Cursor