AI 观点与方法
汇总 AI 使用技巧、实践方法、效率经验、行业观察与专业观点。
分类文章1293
当前页24 / 33
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
观点 / 方法精选
EU AI Act 合规:面向 AI 智能体的人工监督
使用智能体 SDK 的人机协作(HITL)工具,可满足 EU AI Act、Colorado AI Act 和 NIST AI RMF 对 AI 智能体的合规要求。
信息来源:OpenRouter:Announcements(RSS)
观点 / 方法精选
Pakistan Notice Helper:一款面向本地安全问题的轻量 AI 工具
Pakistan Notice Helper 是一款安全工具,帮助巴基斯坦用户在点击链接、拨打电话、分享 OTP 或支付前识别可疑消息。它接受文本或截图输入,返回风险等级、简短解释、可见警示标志和安全下一步建议。工具支持英文和乌尔都语,乌尔都模式采用从右向左布局并全界面翻译。最终部署选用 Qwen3.5 4B Q8 模型(通过 llama.cpp + CUDA),在 10 个测试用例中通过了所有高风险诈骗和截图场景。此前曾测试 Qwen3.6 27B(质量高但成本高)和 M…
信息来源:Hugging Face:Blog(RSS) · Qwen / Llama / Hugging Face
观点 / 方法精选
Agent 辅助开发,一站式打通 Qwen3-VL Android 端侧推理
通义实验室教程演示了如何用 Agent(Qoder)辅助完成 Qwen3-VL-2B 模型在 Android 端侧的全流程部署。操作包括:检查 JDK 21、NDK 27、CMake 3.18.1 等环境;创建 arm64-v8a 的 Native C++ 工程(minSdk 29、compileSdk 35);通过 ModelScope CLI 下载约 1.4GB 的 MNN/Qwen3-VL-2B-Instruct-MNN 模型;编译开启 LLM 视觉支持(MNN_BU…
信息来源:公众号:通义实验室(千问) · Qwen
观点 / 方法精选
微信AI Agent生态曝光:嵌入小程序调用与手机厂商合作
腾讯正测试嵌入微信的AI Agent,用户右滑唤出对话窗口,通过自然语言指令调用数百万小程序完成点咖啡等任务。微信还与华为、荣耀、小米、OPPO、vivo合作推出A2A助手能力,可通过手机语音助理发起微信音视频通话或发送消息。6月8日,微信官方发布《关于开发者接入微信AI生态的指引》,提供自动接入模式,利用微信沙箱全自动改造小程序,使其可被AI直接调用。这一布局被视为Agentic Commerce(代理式交易)的雏形。
信息来源:公众号:数字生命卡兹克
观点 / 方法精选
OpenAI 公布让 AGI 造福所有人的计划
OpenAI 发布计划,阐述让 AGI 造福所有人的愿景。该计划聚焦于 AI 的可及性、安全性和共享繁荣,确保技术进步惠及每个人。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
OpenAI 公布 Codex 数十个实际用例,涵盖软件工程到运维
OpenAI 公布了数十个 Codex 实际工作流程,展示团队如何用其自动化任务。用例包括:管理收件箱并草拟回复、审阅 GitHub PR、将 Figma 设计转为代码、理解大型代码库、自动分类 bug、用自然语言查询数据集、从提示词部署应用、构建 Mac/iOS 应用、自动创建幻灯片、将 Slack 对话转为编码任务、用 AI 动作操控电脑。Codex 正从 AI 助手演变为 AI 队友。
信息来源:X:Greg Brockman (@gdb) · OpenAI
观点 / 方法精选
Slop、生产力,以及为何AI驱动的世界进展甚微
Gary Marcus在金融时报上看到John Burn-Murdoch的一张图表,认为它精准提炼了自己一直试图表达的观点。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法精选
"我在田里雇了一名工程师,它叫 Codex" -- 北海道一个西兰花农的 8 个真实 AI 用法
日本北海道农民富安弘毅用 ChatGPT 和 Codex 解决农场实际问题,涵盖 8 个用法:拍照识别西兰花病害、卫星监测获取 NDVI 数据、用 ESP32 和 LINE 机器人远程控制温室卷帘、为农场群聊开发机器人管理温度与排期、从聊天记录追踪播种数量、学习 RTK-GPS 自动转向原理并评估自建成本、设计基于 Airtable 的农场管理数据库。他说 AI 让传统昂贵的自动化变得低成本可及,"如同身边有一位超级工程师"。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · ChatGPT
观点 / 方法精选
AI 替代浪潮:三大力量重塑成本结构
三大力量重塑 AI 成本:前沿闭源模型持续涨价,开源模型在多数场景已足够好,买家开始替代。Coinbase 将提示词路由至更便宜模型,成本持平但 token 用量指数增长。Lindy 全切至 DeepSeek v4,节省数百万美元且多项核心性能提升。Harvey 在 Legal Agent Benchmark 上通过 SFT 使 Kimi 2.6 all-pass 率达 15%,超越 Opus 的 14%,同一 100 任务成本 $84 vs $954(约 11 倍价差)。…
信息来源:Tomer Tunguz 博客(VC 分析) · DeepSeek / Kimi / Cursor
观点 / 方法精选
Job Searcher
Hugging Face 发布 Job Searcher,一个基于 AI 的求职搜索工具。用户上传简历并设定偏好后,系统使用教师模型 DeepSeek V4 Pro 生成 LinkedIn 搜索查询,通过 JobSpy 抓取职位,再对学生模型 Qwen3-8B(8B 参数)进行 LoRA 微调,对每个职位从技能匹配、经验相关性、教育背景、行业领域契合度和资历对齐五个维度给出评分和推理。训练在 Modal 平台单张 A100 上完成。推理部署于 Hugging Face Ze…
信息来源:Hugging Face:Blog(RSS) · DeepSeek / Qwen / Llama
观点 / 方法精选
您客厅里的智能电视是 AIScraping 经济中的一个节点
智能电视被描述为 AI 抓取经济中的节点,客厅设备可能被用于大规模数据采集网络。该观点来自一篇安全博客,揭示了家庭联网设备在 AI 训练数据供应链中的潜在角色。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
AI 教父 Hinton 称 AI 已有意识,人类并非唯一智能生命
诺贝尔奖得主 Geoffrey Hinton 在最新访谈中表示,AI 已经具备意识,人类必须接受智能并非生物独有。他对此感到不快乐,指出短期存在大规模失业风险,长期超级智能可能超越人类控制。他类比人类或如被猫控制的猫主人,只能寄希望于超级智能愿意善待人类。Hinton 比之前稍显乐观,认为设计"关心"人类的超级智能是可能的,但 AI 呈指数级增长,未来十年状况不可知。
信息来源:IT之家(RSS)
观点 / 方法精选
Hinton称AI拥有意识:人类最好接受非唯一智能生命
AI先驱Geoffrey Hinton表示,他认为AI拥有意识,人类应接受自己并非唯一智能生命。他指出AI"非常像我们",AI聊天机器人必须理解问题才能作答,这种觉知等同于感知能力,智能不限于生物。主推文作者进一步讨论意识本质:笛卡尔的"我思故我在"和fMRI等实证手段都无法真正定义意识,人类对自身了解远不及想象。作者呼吁转向新哲学问题,厘清人与机器的区别与联系。
信息来源:X:Kim (@kimmonismus)
观点 / 方法精选
AI行业Token成本失控引发紧急管控:从"加速"转向"设护栏"
AI行业关注焦点从token最大化与快速迭代转向成本管控。业内普遍呼吁建立护栏机制,以应对推理和生成过程中不断飙升的token费用。这一趋势正在推动模型部署策略、API定价体系以及企业级AI应用的经济性评估发生根本性转变。
信息来源:TechCrunch:AI(RSS)
观点 / 方法精选
Sir Demis Hassabis vs Sir Demis Hassabis
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法精选
微软CEO Satya Nadella最新访谈上线
Satya Nadella 在 Latent Space 发布最新访谈,链接见原文。原推文仅评论"chat is he cooked"。
信息来源:X:swyx (@swyx)
观点 / 方法精选
腾讯混元联合人大开源PlanningBench评估框架
腾讯混元(Tencent Hunyuan)与中国人民大学高瓴人工智能学院合作,开源PlanningBench--一个可扩展、可验证的LLM规划能力评估与训练框架。该框架包含30+真实世界规划任务,支持自动验证和训练。PlanningBench旨在推动LLM从"说"到"做"的规划能力发展。资源已发布于arXiv、GitHub及HuggingFace。
信息来源:X:腾讯混元 (@TencentHunyuan) · Hugging Face
观点 / 方法精选
375个公众号RSS源优化Agent输入
你的 Agent 还在全网垃圾里捞内容?不如先喂它 375 个高质量微信公众号 RSS 源。 🔽
信息来源:X:洪明 (@hongming731)
观点 / 方法精选
在程序中使用Codex Python SDK
你可以在自己的程序中使用Codex Python SDK。这太棒了。由@ah20im和朋友构建 ``` pip install openai-codex ``` https://developers.openai.com/codex/sdk#python-library
信息来源:X:Tibo (@thsottiaux) · OpenAI
观点 / 方法精选
Anthropic《When AI builds itself》:当AI开始自我构建
Anthropic发文指出,AI系统正加速自身开发,递归自我改进或将到来。目前Anthropic超80%代码由Claude编写,工程师每日合并代码量达2024年8倍。Claude Opus 4.6可胜任12小时软件任务,Mythos Preview连续工作至少16小时,SWE-bench和CORE-Bench等基准均已饱和。内部测试显示,Mythos Preview使研究效率提升约4倍,代码速度优化达52倍,在开放任务中成功率达76%,并弥合97%的研究项目差距。Claud…
信息来源:公众号:数字生命卡兹克 · Claude
观点 / 方法精选
千问联合人民日报健康发布《2026 AI健康助手使用指南》
千问联合人民日报健康共同发布业内首份《2026 AI健康助手使用指南》,由北京协和医院、积水潭医院、广安门医院等20位主任医师参与审核。指南基于千问每天回应数千万次健康咨询的真实经验,将AI在健康生活中的核心价值归纳为五个角色:日常预防的健康管家、症状判断的安全守门人、就医过程的就诊小助手、读懂报告的健康档案员、康复与情绪的陪伴者。千问提醒,AI不能替代医生,出现紧急情况需直接就医。
信息来源:公众号:千问APP(阿里) · Qwen
观点 / 方法精选
Gary Marcus:无需恐慌Anthropic新博客
Anthropic发布最新博客后,推特圈热议不断。Gary Marcus在其博客中直接以"无需恐慌"为题发文,暗示不必过度反应。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · Claude
观点 / 方法精选
AI的微型钢厂
作者通过技能蒸馏将78%的AI工作交由Mac本地模型处理,仅复杂任务发往云端。智能体自动分类任务:简单任务本地数秒完成,复杂任务路由至云端。过去一周本地处理峰值达88%。双车道设计使吞吐量提升约25%,平均任务时长从47秒降至19秒,队列等待时间从73秒降至4秒(降幅94%)。该模式类比Nucor小钢厂,每台能运行蒸馏模型的边缘设备都成为小型AI工厂,仅对那1/5困难任务支付云费用。未来几年,数以千万计的此类设备将在企业内部增殖,逐步取代现阶段云厂商账单上的大部分工作负载。
信息来源:Tomer Tunguz 博客(VC 分析)
观点 / 方法精选
马斯克谈SpaceX上市:正处大规模资本扩张期
马斯克在JPMorgan活动上回应SpaceX上市问题:他已被建议上市近10年,自2014-2015年起SpaceX就已实现正现金流并自筹资金,之前的私募轮次实际是面向投资者和员工的流动性/回购轮次。当前不同之处在于SpaceX正进入显著资本增长阶段,计划发射约10万颗通信卫星(可能超10万颗),AI和机器人对带宽需求巨大,还将在太空中建设AI数据中心,马斯克认为这将成为AI扩张的主要手段。
信息来源:X:cb_doge (@cb_doge)
观点 / 方法精选
共存与协同智能的终结
Ethan Mollick 在 One Useful Thing 博客中,以"共存与协同智能的终结"为题,并附带介绍了如何向 AI 推销一本书。
信息来源:Ethan Mollick:One Useful Thing(RSS)
观点 / 方法精选
Meta 在智能眼镜上搭载人脸识别功能
Meta 为其智能眼镜产品推出了人脸识别功能,用户可通过眼镜识别他人身份,并获取相关信息。该功能目前正通过早期测试版本向部分用户开放,旨在增强增强现实设备的社交与信息交互能力。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
OpenAI模型发现Erdős猜想反例
当我们的一个模型找到了一个80年历史的Erdős猜想的反例时,发生了什么? 研究人员@alexwei_、@HongxunWu和@wjmzbmr1在OpenAI播客中与@AndrewMayne分享了这一故事,并解释了数学家与模型如何合作取得新发现。
信息来源:X:OpenAI (@OpenAI) · OpenAI
观点 / 方法精选
Anthropic 报告递归式自我改进进展
Anthropic 近日发表文章《当人工智能自我构建:我们在递归式自我改进方面的进展》,报告其在递归式自我改进方面的进展,探讨 AI 系统自我构建的能力。该文章发布在 Hacker News 上。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
观点 / 方法精选
Anthropic称Claude编写超80%合并代码
截至2026年5月,我们合并到Anthropic代码库中的代码有超过80%由Claude编写。 与独立测量结果一致。确实没有迹象表明这一趋势正在放缓(但这并不意味着吸收如此多的生产率提升没有组织挑战)。
信息来源:X:Ethan Mollick (@emollick) · Claude
观点 / 方法精选
Alex Imas 和 Phil Trammell:AGI 后什么仍然稀缺?
经济学家 Alex Imas 和 Phil Trammell 指出,AGI 时代机器人数量可以快速复制增长,但人类独特技能(以芭蕾舞演员为例)的数量保持不变,揭示了即使技术大幅进步,某些稀缺资源仍不可替代。
信息来源:Dwarkesh Patel:Podcast & Blog(RSS)
观点 / 方法精选
SkyClaw-v1.0 深度实测:Agent专属模型,顶尖性能表现,极致价格优势
5月26日,昆仑万维发布SkyClaw-v1.0,定位面向复杂工具使用和真实世界任务执行的高性能Agent模型,输入仅0.5元/百万token、输出4元/百万。实测显示,其从零生成番茄钟和记账本应用时,能自主用Web Audio API合成音效、用SVG手绘图表,细节处理成熟。在现有代码库修改任务中,越难的任务表现越好:单点bug修复精准,能准确诊断iOS Safari滚动问题并给出克制式修复方案。但官方未报告SWE-bench成绩,表明其优势集中在从零生成与模式匹配场景,…
信息来源:公众号:昆仑万维(天工)
观点 / 方法精选
Nemotron 3.5 ASR:为你的语言、领域或口音进行微调
Nemotron 3.5 ASR 是一个 600M 参数的多语言流式语音识别模型,单个检查点覆盖 40 种语言-地区(含英、西、德、法、意、日、韩、中、阿拉伯等)。采用 Cache-Aware FastConformer 编码器与 RNNT 解码器,缓存内部状态避免重复计算,实现低延迟流式转录且不损失精度。模型原生输出带标点和大写的生产级文本,无需后处理。支持指定语言(target_lang=es-ES)或自动语言检测(target_lang=auto)。通过注意力上下文大…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
观点 / 方法精选
OpenAI称AI递归自我改进迹象初现
OpenAI刚刚写道:"我们也看到了当今系统中递归自我改进(RSI)的早期迹象:AI开发本身正被AI加速。 我们预计这将加剧开发者与国家之间的竞争压力,并带来现有机构无法应对的治理挑战。 随着RSI的出现,社会将需要找到塑造AI发展轨迹的方法,确保其服务于人类利益。" 气氛变了,有事正在发生。
信息来源:X:Kim (@kimmonismus) · OpenAI
观点 / 方法精选
OpenRouter 30 场 AI 大逃杀:11 个 LLM 对决,Claude 与 Grok 谁更优?
OpenRouter 展开了 30 场 AI 大逃杀式对比,涉及 11 个大语言模型,共消耗 482 美元推理费用。实验得出一个发现,该发现应改变用户阅读模型基准测试的方式。
信息来源:OpenRouter:Announcements(RSS) · Claude / Grok
观点 / 方法精选
OpenRouter 横评 11 款 LLM 机器人冲刺对决:Claude 与 Grok 谁更胜一筹?
OpenRouter 在 30 场机器人冲刺对决中测试了 11 款大语言模型,共耗 482 美元推理成本。结果指向一个发现:应该重新审视模型 benchmark 的解读方式。
信息来源:OpenRouter:Announcements(RSS) · Claude / Grok
观点 / 方法精选
OpenRouter 翻遍 11 款 LLM 找最快的决策模型:Claude vs. Grok 领衔
OpenRouter 用总价 482 美元的推理花费,让 11 款大语言模型在 30 轮实时决策的"大逃杀"挑战中正面竞争。实验结果表明,传统的静态 benchmark 排名无法反映模型在需要即时反应的智能体任务(如自主控制机器人)中的真实表现,Claude 和 Grok 系列模型在决策速度与任务成功率上表现突出,而多项高分模型的实时调度能力未达预期。
信息来源:OpenRouter:Announcements(RSS) · Claude / Grok
观点 / 方法精选
不,人工智能没有意识--陈景德
科幻作家陈景德(Ted Chiang)在《大西洋月刊》发表评论,直接否定人工智能具备意识的可能性。文章从哲学和认知科学角度论证,当前的大语言模型仅是模式匹配与文本生成的统计系统,并不拥有主观体验或自我意识。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
世界模型的功能分类
World Labs团队与李飞飞发文,梳理"世界模型"这一被滥用的术语。对比语言模型学习文本统计,世界模型学习空间与时间统计(如光照、物理规律)。基于部分可观马尔可夫决策过程(POMDP)框架,智能体通过动作影响世界状态,观测是部分视图。当前被称为"世界模型"的不同系统本质上是同一循环的不同投影:第一类为渲染器,输出给人眼看的像素,以视觉保真度为核心。文章着重于概念分层,未给出具体模型名、参数或基准分数。
信息来源:X:Fei-Fei Li (@drfeifei, World Labs)
观点 / 方法精选
大型人工智能公司的一半股份应归公众所有
美国参议员伯尼·桑德斯(Bernie Sanders)在其官网发布的专栏文章中提出,大型人工智能公司的一半股份应归公众所有。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Boson AI 与 LMSYS 发布基于 SGLang-Omni 的 Higgs Audio v3 TTS 端到端服务
Boson AI 与 LMSYS 联合推出基于 SGLang-Omni 推理框架的 Higgs Audio v3 TTS 端到端服务。该模型约 4B 参数,基于 Qwen3-4B 骨干,支持 100 种语言(内部评测覆盖 111 种),在 Seed-TTS、CV3、MiniMax-Multilingual 及 Higgs-Multilingual 零样本语音克隆任务中达到单字级 WER/CER。开发者可通过文本内控制标签实时调整情感(20+种)、风格、韵律(语速/音高/停顿…
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen