AI 观点与方法
汇总 AI 使用技巧、实践方法、效率经验、行业观察与专业观点。
分类文章1297
当前页15 / 33
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
观点 / 方法普通
AI应用骗钱,哦不融资指南
信息来源:elsewhere:文章(RSS)
观点 / 方法普通
a16z 数据:律师用 Codex 增速暴涨 108 倍
a16z 最新图表显示,OpenAI Codex 在企业中的周活增长呈极端分化:律师增速高达 108 倍,销售、招聘各 41 倍,营销 26 倍,医疗 24 倍,而工程师仅 5 倍垫底。Codex 已从代码补全进化为能自主拆解任务、运行数小时的数字同事,律师正用它处理海量长文本与合同比对。这标志着知识工作"编程化",AI 爆发点正从技术圈转向高价值白领岗位。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI
观点 / 方法普通
缓存命中率96%成本降3.2倍
经三天优化,缓存命中率提升至96%,输出/输入比例提升2.5倍,在请求数与输出数不变的情况下成本降低3.2倍。优化核心是采用 Observational Memory(OM)概念,参考 Mastra 文档。此举源于被梁文峰谷+大涨价倒逼出的极限优化。
信息来源:X:赵纯想 (@chunxiangai)
观点 / 方法普通
两个16岁高中生自建"炼丹社",共享显卡和API让全校免费用AI
北京两名16岁高中生张睿修和冯子上成立"炼丹社",将自有的RTX PRO 6000、Mac studio及从公司、高校争取的算力与API额度整合为FreeAPI项目,向全校开放共享API,提供三个对话模型及文本向量、联网搜索、视频生成能力。社团现有30多人,覆盖高一约120人年级的四分之一。两人还计划帮学校重建整合课表、成绩等信息的校园网站,并嵌入AI检索助手。
信息来源:公众号:数字生命卡兹克
观点 / 方法普通
OpenAI CEO 奥尔特曼:担心人工智能会被少数强势主体掌控
OpenAI CEO 萨姆·奥尔特曼在 David Senra 播客中表示,担心 AI 终有一天会被少数公司、模型或个人控制,让绝大多数消费者在技术塑造世界问题上没有发言权。他同时担心 AI 挣脱人类控制,并认为对后者的恐惧可能导致前者实现。奥尔特曼还称,美国 AI 领导者未能向公众展示技术如何赋予人们更大自主权,并预测将见证有史以来最大规模的小企业创业热潮。
信息来源:IT之家(RSS) · OpenAI
观点 / 方法精选
AI 智能体应该活多久?
长期运行的 AI 智能体会因上下文累积而注意力衰减、临时指令残留成永久规则,并带来安全风险。建议给日常助手 24 小时生命周期,午夜重置会话,将具体任务委派给只存活 30 秒的单一用途子智能体,并在重置前将持久偏好存入磁盘。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法普通
Fable 5 仅占 Anthropic 付费 token 使用量 6%,定价为 Opus 5 两倍
Anthropic 旗舰模型 Fable 5 仅占其付费 token 使用量的 6%,API 定价为 Claude Opus 5 的两倍,价差正促使企业按任务难度匹配模型。Opus 5 成本仅为 Fable 5 一半,且最大努力模式下在 CursorBench 3.2 上仅落后 0.5%。6 月被迫下架可能永久削弱了 Fable 5 的定价权,并推动客户转向多模型采购。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法普通
Vercel AI Gateway开放权重占比升至62%
封闭模型已成为较小的一部分。 开放权重模型在Vercel AI Gateway的token占比于8月达到62%,高于6月的28.4%。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
反AI内容获利与隐秘资金引关注
对即将加入OpenAI的团队成员,有什么关于如何最好地与俄亥俄州社区互动的建议吗?@TaylorLorenz
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI
观点 / 方法普通
开源AI在Vercel的token份额两月升至62%
开源AI在Vercel平台上的token份额两个月内从28%飙升至62%,正从OpenAI和Anthropic手中夺取份额。FT报道称Fable 5因成本过高使用量下滑,而开源模型性价比持续提升。作者认为用户对本地自主控制AI的需求日益增长,开源推理成本与前沿模型相当,并非"免费"。
信息来源:X:Kim (@kimmonismus) · OpenAI / Claude
观点 / 方法普通
Grok Build 让用户用手势实时操控视觉
Grok Build 太不可思议了 🔥 我刚刚构建了这个可以用双手控制的交互式视觉画面。我的笔记本电脑摄像头追踪我的手掌动作,让我能实时改变视觉效果。 Grok Build 正在改变每个人能创造的东西。
信息来源:X:cb_doge (@cb_doge) · Grok
观点 / 方法普通
Anthropic 承认 Opus 不完美,将优先修复
Anthropic 工程师 Thariq 承认 Opus 模型存在不足,团队将优先修复,尤其关注冗长输出问题。用户可通过 `claude /config outputStyle=concise` 命令立即缓解该问题,无需等待长期修复。社区持续向 @bcherny 和 @trq212 提供建设性批评,期待 Opus 恢复 4.6 版本时的体验。
信息来源:X:Kim (@kimmonismus) · Claude
观点 / 方法普通
实测Claude与OpenAI高价套餐收益
我们测试了Anthropic每月200美元的Claude套餐,其最高可产生每月8000美元💰️💰️的收益,而OpenAI每月200美元的套餐,若在长周期任务中耗尽全部每周限额,则可产生价值高达每月14000美元的token。该测试于6月进行。
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI / Claude
观点 / 方法普通
Anthropic 最强 AI 模型 Fable 5 用户增长乏力,更便宜工具更受青睐
Anthropic 7 月年化收入达 650 亿美元,高于 5 月的 470 亿美元,并预计 Q3 实现盈利。Ramp AI 指数显示,7 月 Anthropic 模型支出中 Opus 4.8 占 28.0%,而 7 月 24 日发布的旗舰模型 Fable 5 仅占 3.5%,其高昂成本使其吸引力不及更便宜的模型。
信息来源:Simon Willison 博客 · Claude
观点 / 方法普通
AI 智能"桶"价格战:从 26 美元到 0.5 美元
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
Grok Bot 能力惊艳,三个月进步显著
Grok Bot 可以做到令人惊叹的事情! 三个月后,Grok 的进步令人惊叹,@bot 让它更强大、更易用。 这是使用相同提示词时的保真度:"解释纳维-斯托克斯方程及其如何通过实际流体动力学模拟与翼型设计相关联。"
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
观点 / 方法普通
开源模型token份额持续上升,多智能体成主因
开源AI的token份额正持续上升,近两月已从28%增至62%,正从OpenAI和Anthropic手中夺取份额。Elvis Saravia认为,监督者主导多执行子智能体的模式正被广泛采用,子智能体消耗大量token,而开源前沿模型在价格和效率上更具优势。他预测最终闭源前沿模型将占60-90%的经济价值,但仅占15-25%的token量。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · OpenAI / Claude
观点 / 方法普通
2026年企业将重视模型效率与可靠性
2026年,随着模型成为关键基础设施,企业将开始认真关注模型效率和可靠性。
信息来源:X:Tibo (@thsottiaux)
观点 / 方法普通
游戏PC本地运行大模型速度三年提升12倍
2024年:一台搭载RTX 4090的游戏PC以4-bit量化运行Llama 3 70B,速度约为2 tok/s。 2026年:一台搭载RTX 5090的游戏PC以原生mxfp4格式运行DeepSeek-V4-Flash 284B,速度约为24 tok/s。 预测:到2027年底,一台游戏PC将以可观的速度在本地运行Fable 5级别的智能。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · DeepSeek / Llama
观点 / 方法普通
OpenAI 平台战略:Sam Altman 详解定位
Sam Altman 在 David Senra 播客中表示,OpenAI 不想只做 AI 应用层,而要成为其他应用公司构建的平台。他称将提供个人或公司的 AGI 统一接口,并通过 API 支持上层开发,同时覆盖成本-性能曲线上从高端科研到廉价大规模任务的全部需求。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI
观点 / 方法普通
Booster K1 机器人轻便便携更安全
它们在那条轨道上看起来完全如鱼得水。 重量不到 20 公斤,高度适合登机箱,这些 Booster K1 非常便携。更小的体积和更轻的质量使其在人群周围更安全。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
模型评测需标准化测试框架
用特定测试框架评测模型的方式已失效,应转向Pi、Hermes Agent等最小化标准框架,并保持长期稳定。模型未来或能按任务动态生成测试框架,使框架如同系统提示词般可调,评测将愈发复杂。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
观点 / 方法普通
用旧模型做AI影响研究需谨慎
Ethan Mollick指出,用GPT-4等旧模型做AI影响研究并非不可,但需谨慎讨论。若结论是AI已具备某能力或达到人类水平,这类正面结论依然成立;但若结论是AI在某任务上表现差或有偏见,则不能断言AI不行,因为新模型可能已解决。他建议可明确限定"GPT-4不能做X"、对比多代模型趋势、论证AI固有缺陷、聚焦调节因素或人类反应等替代框架。
信息来源:X:Ethan Mollick (@emollick) · GPT
观点 / 方法普通
AI芯片架构全景:RSI或重塑算力格局
博主Elvis Saravia推荐一篇关于AI芯片架构的长文,该文覆盖NVIDIA、AMD、TPU、Trainium、Cerebras、Groq等主流芯片的架构、扩展(scale-up与scale-out)及软件栈。Saravia认为,一旦RSI(递归自我改进)出现,模型架构可能快速演变,与今天截然不同,从而带来全新的算力需求。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · NVIDIA
观点 / 方法普通
I Tried the AI Model Built to Fix AI Writing
信息来源:Every:最新文章(网页)
观点 / 方法普通
Sam Altman 访谈:AI 风险与小企业繁荣
OpenAI CEO Sam Altman 在访谈中探讨 AI 两大风险:失控与权力集中,并预测将迎来小企业繁荣。他谈及 AI 采用缓慢、模型与算力规模定律,以及 OpenAI 无客户、无产品、无剧本的创业历程。访谈还涉及迭代部署、上下文记忆与未来人机协作方式。
信息来源:X:马东锡 NLP (@dongxi_nlp) · OpenAI
观点 / 方法普通
前沿AI公司迎来更多坏消息:更便宜的工具正在崛起
更便宜的工具正在蓬勃发展,这对即将进行的IPO意味着什么?文章指出,低成本AI工具的兴起正在给前沿AI公司带来压力,可能影响其市场估值和上市前景。这一趋势表明,行业竞争格局正在向性价比方向倾斜,高价前沿模型的商业可持续性面临挑战。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法普通
Ox Alpha 在 DGX Spark 上运行的畅想
想象一下 Ox Alpha 在 DGX Spark 上运行的样子。人总得有点梦想,对吧?
信息来源:X:Kim (@kimmonismus)
观点 / 方法普通
Gemini 应用速度提升,搭配 3.7 Flash 体验佳
我喜欢 Gemini 应用现在有多快。打开、输入提示词、直接开用。搭配 Gemini 3.7 Flash 简直绝了 🔥
信息来源:X:fofr (@fofrAI) · Gemini
观点 / 方法普通
用版权书籍训练AI模型合法吗?法律现状复杂
用受版权保护的书籍训练AI模型是否合法,美国法律尚无定论。法官William Alsup裁定Anthropic因从非法影子图书馆获取书籍而需支付15亿美元和解金,但认定其AI训练本身合法,类比为"阅读"而非"复制"。现行版权法自1976年未更新,案件多围绕"合理使用"展开,Thomson Reuters诉Ross Intelligence案则因直接竞争用途被判不构成合理使用。
信息来源:TechCrunch:AI(RSS) · Claude
观点 / 方法普通
17岁少年独立预训练模型论文被ICML收录
Jonathan 在 17 岁时独立预训练了模型,他的论文已被 ICML 接收。这是一期非常可爱的短播客,打开了一扇了解高中生 AI 世界的窗户。感觉非常温暖和触动人心:) https://youtu.be/UTDalAEU274?si=4oyGf6YGoJlI1Mcr
信息来源:X:張小珺 Xiaojùn (@zhang_benita)
观点 / 方法普通
Qwen 3.8 27B 仅用 30 分钟完成一项逆向工程任务
一位开发者将一项逆向工程任务交给 Qwen 3.8 27B,模型仅用 30 分钟便完成。该案例展示了 Qwen 3.8 27B 在复杂技术任务上的处理效率,相关讨论在 Hacker News 上获得 104 个点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
观点 / 方法普通
Life After Automation
信息来源:Every:最新文章(网页)
观点 / 方法普通
编码执行工业化下程序员价值的分水岭
编码执行正被工业化,但程序员价值不会自动消失或上移。新的分水岭在于谁能定义值得解决的问题、将组织知识转化为机器可用的上下文、用独立验证约束高速执行,并对真实世界的结果负责。
信息来源:X:洪明 (@hongming731)
观点 / 方法普通
美国专家示警:学生依赖"AI 代写"会削弱思考能力
美国专家警告,学生长期依赖AI代写作业可能削弱自身思考能力。认知心理学家罗纳德·T·凯洛格指出,写作本身就是一种思考技术,机器代劳会让学生失去大脑训练。麻省理工学院研究发现,用AI写论文的人脑部活动更低,且难以回忆刚写出的内容;全美学校已开始限制学生使用AI。
信息来源:IT之家(RSS)
观点 / 方法普通
用户批评Opus 5懒惰冗长,Anthropic回应失当
Kim 批评 Anthropic 对 Opus 5 用户反馈的回应方式,称其将问题归咎于用户未理解正确用例,而非认真对待。用户普遍反映 Opus 5 懒惰、草率且冗长,与 Kim 自身体验一致。此前 Boris Cherny 曾建议用 Opus 做 hill climbing 优化任务,但 Kim 认为此类回应回避了核心问题。
信息来源:X:Kim (@kimmonismus) · Claude
观点 / 方法普通
起点收紧AI文政策,月票榜前1000涉事约100本
起点中文网近期收紧AI文政策,部分作品被撤下推荐位和榜单,月票榜前1000本书中涉事作品约100本,斩杀率约10%,包括《山河鉴》等均订破万的头部小说。这些作品并非完全AI生成,不少作者仅用AI进行部分润色。阅文2023年推出「妙笔」大模型,去年宣布接入DeepSeek,主打文章润色,但AI产能提升远超预期,引发行业争议。
信息来源:X:阑夕 (@foxshuo) · DeepSeek
观点 / 方法普通
阿易 AI Notes 按实用性重排 AI 做 PPT 的 Skill 榜单,ppt-master 居首
阿易 AI Notes 按真实可编辑性、审美上限与 GitHub 热度重排 AI 做 PPT 的 Skill 榜单,共 10 个。榜首 ppt-master(48.7k⭐)直接输出带完整图层、文字框的原生 .pptx 文件,适合正式交付;frontend-slides(28k⭐)与 guizang-ppt-skill(24.7k⭐)分列二三名。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
观点 / 方法普通
NanoGPT 速通前沿:Fable 5 以 81.7% 通过率登顶
NanoGPT 速通榜单显示,Fable 5 在 2,726 秒内以 81.7% 的通过率位居第一,超越人类基线 2,600 秒。Opus 5 和 Kimi K3 分别以 53.6% 和 52.2% 的通过率位列二、三名。榜单涵盖 GPT-5.6、Grok 4.5、Qwen3.8 Max 等 20 款模型,并开放 41 条完整智能体轨迹供探索。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GPT / Qwen / Grok
观点 / 方法普通
AI 正成为 AI 最大客户:OpenRouter 上智能体 token 用量激增 14 倍
OpenRouter 分析师 Peter Walker 称,2026 年 2 月 6 日可能是人类消耗 token 量最后一次超过 AI 智能体。此后智能体 token 用量增长 14 倍,从 0.51 万亿增至 7.3 万亿,而人类用量仅增长 2.8 倍。近 70% 的智能体 token 消耗来自缓存提示词,计费费率更低,实际成本增速低于原始数字。
信息来源:The Decoder:AI News(RSS)