把3天的事压缩到30分钟,他们是怎么做到的
本文由 AI 自动整理生成,可能存在错漏,请以原文链接为准。
今天最让我愣住的一条:一个需要五个工程师干三天的活,AI 半小时就搞定了。另外还有两个挺酷的个人作品,看完你也能动动手。
灵感百宝袋
一个需要五个工程师分析三天的系统事件,ChatGPT Enterprise 配合 Codex 半小时就搞定了。
NTT DATA 集团是一家日本 IT 服务巨头。他们给大约 9000 名员工(不光是技术岗)开通了 ChatGPT Enterprise 和 Codex。有个很实际的例子:以前某个系统事件分析,要五个工程师花三天时间;现在交给 Codex,三十分钟出结果,完成度还高达 99.3%。这么快,不是因为 AI 神奇,是因为他们把判断流程和工具链都接好了。你公司如果也有重复性很高的排查、总结类任务,可以挑一个最花时间的来试一圈。别一上来就想全员铺开,先用一个具体活验证 AI 能不能帮上忙。
原文:https://openai.com/index/ntt-data
「稍后读」等于「永不读」?这个姑娘做了个扩展,硬是把读不动的文章塞进你的日历里。
ZaraZhangg 自己动手写了个 Chrome 扩展。逻辑不复杂:把你收藏的文章变成一个日历上的阅读时段,每隔五篇文章就自动预留一小时。说白了,就是用日历的强制力来对抗「收藏即读完」的拖延。你手机上「稍后读」里攒了多少东西?可以试试这个思路:不用写扩展,手动在当前日历里划出两次 25 分钟的阅读块,把三篇攒得最久的文章塞进去。看看能消灭几篇。
原文:https://www.youtube.com/watch?v=Q8g1hod552g
谷歌的 Gemini Spark 是个常驻 AI 助手,不用你一步步问,它能自己观察、自己行动。
Jeff Su 录了个入门指南。Spark 不像你熟悉的聊天机器人,它更像一个蹲在你身边的小管家:能帮你盯消息、主动提醒、甚至动手处理一些流程。Jeff 在视频里从头到尾演示了一遍,从设置到实际用起来。如果你一直觉得 AI 工具太「被动」、用完还得盯着,可以先看看这个视频了解下「常驻智能体」到底能干到什么程度。看完不用马上换工具,至少心里有个底:接下来半年,AI 和人的关系会从「问答」慢慢变成「托管」。
原文:https://www.youtube.com/watch?v=7GkIWPPC9i0
江湖快报
Claude Opus 5 昨天上了 Amazon Bedrock,号称在编码和长任务上接近 Fable 5 的水平,但用的是 Opus 档的定价。
这是 Anthropic 第五代 Opus 模型。按官方的说法,它在智能体编码、知识工作和长流程任务上都有提升,而且在很多领域和 Fable 5 旗鼓相当。对企业来说,好消息是它在 Bedrock 上默认不留存数据,符合很多地区的数据监管要求。如果你在 AWS 上跑 AI 工作流,可以先拿一个你目前在把的复杂任务去测一轮:旧模型和新模型各跑一次,看看完成质量和耗时。不在 AWS 上的话,知道有这个选项就行,等什么时候迁移再评估。
OpenAI 最新 GPT-5.6 系列(Sol、Terra、Luna)也上线了 Amazon Bedrock,可以用同一个接口调用三种不同定位的模型。
简单说,Sol 是擅长推理的旗舰,Terra 是日常生产里性价比平衡的那个,Luna 则主打快速和低成本。定价和 OpenAI 自己的一模一样,而且调用量还能计入你在 AWS 的现有承诺消费额。如果你本来就在 Bedrock 上用 GPT,上手很简单:改一下模型名称就能切过去。先用一个标准任务分别跑一下 Sol 和 Terra,感受一下成本和效果差异,再决定哪个场景用哪个。还支持提示缓存来省钱,跑量大的话别忘了打开试试。
蚂蚁用 124B 参数做出了对标去年 1T 级旗舰的模型,而且免费期结束就开源。
蚂蚁集团旗下的百灵大模型昨天发布了 Ling-3.0-flash。一个 124B 总参数、激活参数才 5.1B 的小个头,官方说在传统推理、指令遵循、长文本这些方面,直接对标了上一代 1T 参数的旗舰 Ring-2.6-1T。目前 OpenRouter 和百灵官方平台开放了限时免费 API 调用,到 8 月 3 日截止,之后模型权重会开源。如果你在做 Agent 相关的开发,或者经常要处理长上下文,可以趁免费期跑几个测试场景,看看这个小模型能不能帮你降低推理成本。国内开发者可以重点关注一下。
原文:https://www.ithome.com/0/981/382.htm
OpenAI 推出了一个叫 Presence 的企业级智能体平台,专门用来部署能接替部分客服和内部工单的语音、聊天机器人。
这不是让你自己调 API 搭一个聊天框,而是一整套经过企业验证的平台。它自带安全策略、护栏和升级规则,出错了能自动转人工。企业先给智能体定好明确的职责——比如处理账单问题、保险理赔或者员工的 IT 报修——它才能干活。OpenAI 强调,这不是一个扔进去就能跑的黑盒子:部署前要测试,上线后还要持续优化。如果你所在的公司也在考虑用 AI 接手一些重复性高的客服或内部请求,别急着买方案,可以先拿 Presence 的设计思路当镜子,照一下自己现有的流程哪些地方需要定规则、设护栏。
原文:https://openai.com/index/introducing-openai-presence
贤者视角
Anthropic 官方的选模型指南出了,核心建议反直觉:别一上来就省那点单次费用,先上最聪明的模型再说。
他们给的理由很实在:更强的模型往往用更少的回合、更短的思考时间就能把事干对,所以即使每百万 token 贵一点,实际每个任务的总花费反而可能更低。如果你一上来就用便宜的、能力弱的模型,万一出错,你很难分清是模型不行还是自己的设置有问题。原文里还给了双向思路:可以从最强开始往下切,也可以从最省开始往上加,直到质量达标。下次你为某个任务选模型的时候,不妨多算一步总成本,别只盯着每次调用的单价。
原文:https://claude.com/blog/claude-models-explained-choosing-the-best-model-for-your-use-case
谷歌和网站之间那笔「你给我数据,我送你流量」的老交易,差不多崩了。
The Verge 的播客讨论了现在很扎心的现实:谷歌搜索结果里 AI 直接给答案,点进网站的人越来越少。Reddit 已经在考虑退出 AI 训练协议,一些出版商甚至在讨论要不要直接禁止谷歌抓取他们的内容。这对做内容的人意味着什么?以前写文章能被谷歌推荐是条主路,现在可能得想想怎么在 AI 聊天里被提到、怎么建立自己的直接用户渠道。不是让你立刻放弃 SEO,但至少心里得装一件事:内容分发正在从「搜索排名」向「被 AI 引用的概率」转移。
原文:https://www.theverge.com/podcast/970735/google-zero-reddit-ai-publishers-vergecast
Patreon 裁掉了两成员工,CEO 说不是因为 AI 替代人,但承认 AI 已经从根本上改变了整个科技行业的运作方式。
据 The Verge 报道,这次裁员约 93 人。Patreon 的 CEO Jack Conte 在内部信里强调,裁员不是因为「AI 取代人类」,但 AI 改变了产品怎么建、工作怎么沟通、公司怎么组织。Conte 上个月还公开说过,如果不全力拥抱 AI,就无法继续服务创作者。对一个帮助创作者谋生的平台来说,这种调整挺残酷的。它提醒我们:AI 带来的不一定是裁员,但它一定在推着每个人、每个组织重新找效率的缝。与其焦虑,不如主动去了解自己岗位里那些重复的部分,想想如果 AI 可以分担,你该把省下的精力用在哪儿。
原文:https://www.theverge.com/tech/970211/patreon-layoffs-ai
开发者补给站
一个 Reddit 用户花四个月做的自托管视频 CMS,带 HLS 转码、多镜像分发和防盗链,正在征求反馈。
这是个比较硬的项目。核心功能包括自动把视频转成 HLS 流、支持创作者角色权限、热链保护,还能把视频文件分发到多个镜像站减轻负载。如果你一直想搭一个自有品牌的视频站,又不想把内容放在 YouTube 或 Vimeo 上,这个项目思路可以跟一下。不过目前还在开发阶段,还没放出可部署的版本。建议先收藏原帖,等作者放出 GitHub 仓库的时候去 star 一下,看看代码结构。它的 HLS 和镜像分发部分,即便不直接用整个 CMS,也可能对你的其他项目有参考价值。
谷歌的 Conductor 不再只是 Gemini 命令行扩展,现在成了可移植插件,能在 Antigravity CLI 和 Claude 里用对话的方式搞规范驱动开发。
以前用 Conductor 要记一长串命令来生成 spec 和 plan。升级成插件后,你可以直接用自然语言和 AI 聊需求,它会自动判断什么时候生成或更新 spec.md、plan.md,不用再手动敲指令。如果你在团队里推「先写清楚再写代码」的规范驱动开发,这个更新让门槛降了一大截。它支持把技能、规则、MCP 服务器和钩子打包成一个插件,跨多个 AI 编码环境复用。已经在用 Gemini CLI 或 Claude Code 的,可以试一下把 Conductor 插件挂上去,跑一个小需求看看生成的 spec 质量。
Chimlo 是个开源 Mac 小工具,把 Codex 和 Claude Code 的运行状态塞进了 MacBook 的刘海,再也不用翻终端找日志了。
它会直接在屏幕顶部的 notch 区域显示每个智能体是在工作、等待、完成还是失败。Claude Code 弹权限请求的时候,你也能直接在那回答,不用找终端窗口。还能顺便管媒体键、亮度和音量,附带动画小像素人提示状态。对开发中用习惯终端来回切的人来说,这个小工具能帮你省掉不少 context switch。macOS 免费开源,可以直接从 Product Hunt 链接跳过去下。装上之后跑一次完整任务,感受一下用视觉提示替代命令行提醒到底爽不爽。
原文:https://www.producthunt.com/products/chimlo-agents-in-your-macbook-notch
好物挖掘机
PromptScout 帮你查看你的品牌在 AI 聊天里有没有被提到,以及怎么让 ChatGPT、Gemini 这些更愿意说起你。
这个工具的玩法是:连接你的 Google Search Console 和 Bing Webmaster Tools,监控五个主流 AI 平台(ChatGPT、Gemini、Perplexity、Google AI Overviews、Bing Copilot)是不是提到了你的品牌。然后它会给你每周任务,告诉你怎么提高在 AI 里的曝光度。目前基础版免费,执行任务走 MCP 服务器,你可以选自己喜欢的智能体来干活。如果你在管一个网站或者小品牌,一直担心 AI 搜索抢走流量,可以先用免费版跑一周看看自己的品牌现在处于什么位置,再做后续打算。