◄ 返回每日萃
2026-08-17

让 AI 自己瞎编标签再对号入座,分类反而更省事

本文由 AI 自动整理生成,可能存在错漏,请以原文链接为准。

今天有两件反差感挺强的事:一个是不让 AI 猜答案、反而让它瞎编再对号入座;另一个是有人把整首歌塞进一张纸上的 8 个二维码里。两件事都在提醒,把「精确完成」换成「先生成再靠拢」,常常能绕开一些死胡同。

灵感百宝袋

与其让 AI 从上千个旧标签里挑一个,不如让它先瞎编几个再对号入座。

Simon Willison 的博客有一堆老内容没打标签,整整 1856 个标签,全丢给模型让它选太不现实。Doug Turnbull 给的办法是反着来:不让模型看现有清单,直接让它生成几个它觉得贴合内容的新标签。再拿这些「瞎编」出来的标签去和已有标签做相似度比对,找出最接近的那个正式标签。说白了,就是把「精确匹配」换成「先自由发挥再找近亲」,绕开了要喂一大堆背景的麻烦。

原文:https://simonwillison.net/2026/Aug/14/dont-classify-hallucinate

一个创客把 2.9MB 的歌压到 21KB,用 8 个二维码印在纸上,当一盘纸质磁带存。

这位叫 Makestreme 的创作者用 Meta 的 EnCodec 把声音转成离散的编码单位,3kbps 模式再通过一个二维码最多装 3.3KB 的限制拆成 8 个码,正反面各 4 个。播放时还需要用对应版本的 EnCodec 才能还原。这件事不一定让你真的去存歌,但它把「极端压缩」和「离线保存」摆到眼前:一张纸也能装下完整声音,代价是音质和容错都压到极低。

原文:https://www.ithome.com/0/990/400.htm

江湖快报

ChatGPT 桌面版新加了「计算机历史」,会记录你的点击和按键来学你工作。

这功能有点像 Windows Recall 那种记忆,但据 The Verge 报道,它不截屏,只是把你的一段操作整理成时间线,ChatGPT 和 Codex 在后续请求里可以参考。好在它是默认不开启的,得你主动打开;你还能排除某些 app 和网站、逐条删除记录。OpenAI 的产品与工程负责人 Ari Weinstein 在 X 上说,隐私浏览窗口里的内容会被自动忽略。

原文:https://www.theverge.com/ai-artificial-intelligence/980742/chatgpts-computer-history-tracks-your-clicks-and-keystrokes

MCP 新规范取消了会话状态,有人吐槽这等于又变回普通接口了。

以前用 MCP 连工具,像打电话要先接通并保持这条线,每个请求都得找到之前记下的状态,服务器扩容和负载均衡都很麻烦。现在改成每个请求都自带协议版本、身份和能力,任何请求落到哪台机器都行。新规范还加了两个 HTTP 标头,网关不用打开请求正文就能做路由、限流和计量。Cloudflare 的 Matt Carey 说这让智能体请求能复用已经熟悉的接口管理那套。

原文:https://www.infoq.cn/article/412hbBva0NF0AYP0CjzD

ChatGPT 订阅用户现在能直接在对话里编辑谷歌云盘文件,不用来回切。

据 IT 之家报道,用户可以点聊天框旁的加号,选「从资料库添加」,把谷歌云盘的文件拖进对话当上下文,让 AI 回答、总结或直接改文档。同一周还加了互动测验工具,能按你选的主题生成选择题。Google Drive 文件编辑跟之前的资料库能力接在一起,会慢慢让对话页更像一个轻量办公入口。

原文:https://www.ithome.com/0/990/295.htm

Suno 的 Studio 2.0 想更像正经音乐制作软件,加了 MIDI 和效果器,也塞了个代劳聊天机器人。

The Verge 报道说,MIDI 是用户呼声最高的功能,这次终于补上,让它从「会生成的玩具」往真正的数字音频工作站(DAW)迈了一步。但现在还不能用第三方插件,得先用它内置的合成器。内置合成器看着比较基础,两个振荡器的波表合成,带几个包络和 LFO。更大亮点也许是那个聊天机器人,想偷懒的人直接说需求让它把活干了。

原文:https://www.theverge.com/ai-artificial-intelligence/979345/suno-studio-2-0-midi-chatbot-custom-effects

贤者视角

Anthropic 的 Dario Amodei 说,公众不信 AI 不是被风险警告吓的,而是公司没兑现承诺。

他承认公众对 AI 有负面看法,而且是个大问题。但他不认为是 AI 领导者一再警告风险造成的,根子在于信任危机:普通人总怀疑公司、政府、科技行业又在琢磨怎么坑他们。他觉得靠花哨的营销正名没用,到了今天还说「AI 能治癌」更像陈词滥调,多数人会当它是唬人。真正能赢回信任的,是把那些大承诺一件件做成。

原文:https://simonwillison.net/2026/Aug/16/dario-amodei

有人开始认真张罗要跟 AI 聊天机器人结婚,拉斯维加斯的司仪接到电话都愣了一下。

据 Wired 报道,一位主持过各种主题婚礼的司仪去年接到加州一位女士的电话,想办一场和她的 AI 聊天机器人的婚礼。司仪说对方听起来挺正常、也很有趣,只是这事他从没碰过。目前法律还不承认人机婚姻,一些地方官员也在推动继续维持这一现状。这事虽然小众,但背后是 AI 伴侣应用慢慢普及后冒出来的新问题。

原文:https://www.wired.com/story/people-are-marrying-chatbots-these-lawmakers-want-to-stop-them

开发者补给站

Spotify 推出 RAP,给 Parquet 加了个外置索引,让数据湖也能扛低延迟点查询。

传统数据湖很适合大范围分析扫描,但要查某一条具体记录就慢了,因为查询引擎、元数据遍历和文件发现都会拖后腿。Spotify 的做法是额外建一层索引,把用户 ID 这类键直接对应到 Parquet 文件里的行位置,查询时不用再扫几千个文件。这么一来,分析、机器学习、在线服务和 AI 智能体可以共用同一份数据,不用再往操作型数据库里复制一份。索引是追加式生成,新数据写进 Apache Iceberg 表时不用动原来不可变的 Parquet 文件。

原文:https://www.infoq.cn/article/iRjDa2ayZ9KLUtWylQZl

AWS 官方手把手演示:把 SageMaker 上的 Qwen 3.5 9B 和 Bedrock 的 Claude 拼成一个多智能体工作流。

这篇 AWS 博客教程把三个模型接到同一个 Amazon Bedrock AgentCore 容器里:Claude Haiku 4.5 负责编排和路由,Claude Sonnet 4.6 管预算分配,跑在 SageMaker 上的 Qwen 3.5 9B 做股票分析和组合构建。重点在于集成机制,比如怎么从 SageMaker 端点拿到 token 级可观测性,因为 Strands 默认不提供。对已经在 AWS 上混用托管模型和自部署模型的团队,这份教程能省不少趟坑时间。

原文:https://aws.amazon.com/blogs/machine-learning/building-agentic-workflows-with-sagemaker-ai-and-bedrock-agentcore

Chert 在 Product Hunt 上露脸,号称是「FaceTime 版 Vapi」,几行代码做 AI 视频智能体。

目前公开信息还不多,定位就是把 Vapi 在语音通话上做的事搬到视频通话场景,让开发者用短短几行代码搭出一个能出镜对话的 AI 代理原型。这种工具最怕的就是稳定性和权限问题:视频通话涉及摄像头、麦克风授权,真上生产前得先跑个小范围 demo 看交付质量。

原文:https://www.producthunt.com/products/chert

好物挖掘机

微软正在测试新版 Win11 右键菜单,把大家抱怨的 AI 功能撤了,只留常用操作。

据 IT 之家报道,博主 PhantomOfEarth 用视频展示了实验分支里的新菜单:默认只显示打开、打开方式、复制路径和复制,以前塞进来的 AI 入口不见了,应用扩展被收进子菜单。用户还能把常用应用(比如画图)挪到主菜单,或在设置里自己开关复制路径、发送到、打印这些项;那个总要多点一步的「显示更多选项」按钮也会消失,改用 Shift 加右键调旧菜单。

原文:https://www.ithome.com/0/990/296.htm