◄ 返回每日萃
2026-07-14

10分钟用开源模型做Chrome扩展,真的跑通了

本文由 AI 自动整理生成,可能存在错漏,请以原文链接为准。

今天最过瘾的一件事:有人拿开源模型 10 分钟就做了个能在浏览器里跑的扩展,连代码都拉起来了。另外 Anthropic 给科学家发了个新工作台,Meta 的新模型也杀进了编程市场。

灵感百宝袋

Matt Wolfe 用 GLM 5.2 这个开源模型,10 分钟搭出了一个能正常工作的 Chrome 扩展。

他对着模型说了几句需求,模型就生成了插件所需的全部文件,点按加载就能用。开源、便宜,全程几乎没写代码。拿来试试:挑一个你在浏览器里反复做的机械动作(比如一键存图、页面去广告),把你的要求用大白话写下来,丢给对话型 AI 让它生成扩展代码,到 Chrome 里加载看看能不能跑通。

原文:https://www.youtube.com/watch?v=BDWdp_fIOHk

OpenAI 出了一份 ChatGPT 官方入门指南,手把手教你从第一句话入手。

指南里把 ChatGPT 拆成聊天和「工作」两种模式,分别用来快速答疑和完成复杂任务。最实在的部分是一句现成的提示词范例,你填上自己的身份就能直接试。如果你是刚开始用 AI,可以把那句模板改成自己的场景,问一句「告诉我 5 个我现在就能用 ChatGPT 做的事」,看看它给你的思路值不值得继续聊。

原文:https://openai.com/academy/getting-started

有人用 445 字节的数据和压缩算法,画出了一张 ASCII 世界地图。

程序员 Iwo Kadziela 让 AI 帮忙,把 deflate 压缩和一点 JavaScript 拼起来,用极小的空间生成了可辨认的各大洲轮廓。这个思路不限于地图——你那些要反复传的图片、动画小素材,也可以试着让 AI 帮你想办法用代码加压缩技巧,把体积缩到最小,省带宽也省流量。

原文:https://simonwillison.net/2026/Jul/4/building-a-world-map-with-only-500-bytes

Jeff Su 用 15 分钟讲透 Google Gemini Spark,一个常驻你桌面的 AI 助手。

Gemini Spark 不像传统的聊天窗口,它会一直待在系统里,你随时可以叫它处理跨应用的任务。视频里展示了从设想到操作的全过程,适合想体验「桌面副驾驶」的人。如果你手头有支持这类 AI 助手的设备,可以跟着视频里的一两个例子走一遍,看看它能帮你整理日程、抓资料、甚至代填表格,感受一下不用来回切窗口的体验。

原文:https://www.youtube.com/watch?v=7GkIWPPC9i0

江湖快报

Anthropic 推出 Claude Science,把上百种科研工具塞进一个 AI 工作台。

做实验、查文献、处理数据、画图,这些原本要在四五个软件之间切换的活,现在可以统一在 Claude Science 里完成,并且每一步都留下可追溯的记录。如果你在科研领域,可以拿手头一项需要串多个工具的常规流程试一试,看它能不能把碎片环节接起来,减少来回搬运数据的功夫。

原文:https://www.anthropic.com/news/claude-science-ai-workbench

Cloudflare 和 AWS 相继在边缘网络接入 x402 微支付,今后 API 和网页可以直接收稳定币。

x402 复活了 HTTP 402 状态码,开发者不用加结算页、不用发 API 密钥,一次请求就能完成付费。两大云厂商在几周内先后支持,意味着代理程序自动付款、调用付费服务的基础设施开始成形。如果你有对外开放数据接口或者内容页的想法,可以留意这个趋势:以后可能不需要复杂的账户系统,机器人和人类访问同一个 URL 就能各付各的钱。不过目前税务、发票等配套规则还没有完全理顺,可以先观望。

原文:https://www.infoq.cn/article/BTh2ixDj3uo98Q1hHYhk

Meta 发布 Muse Spark 1.1,一款面向智能体编程的多模态推理模型,价格很有竞争力。

这个模型在工具调用、计算机操作和代码生成上都下了功夫,Meta 内部已经在用它做研发。连扎克伯格都时隔三年冒出来发帖,提了一句「很快还会有更多东西」。现在 OpenAI、Anthropic 和 Meta 三家都在智能体编程这条路上卷,对做自动编程、代码迁移的人来说,以后可选的模型会越来越多、越来越便宜。如果你最近有项目要试,不妨关注它的 API 开放时间和定价。

原文:https://www.infoq.cn/article/Fg7xEo3RGENyoefojZVD

阶跃终端亮出了第一款「智能体手机」STEPX Neo,背面多了一块交互副屏。

这台机器搭载了智能体原生系统 Step AOS,合作方涵盖美团、WPS、导航等日常应用。据业内人士称,它是阶跃自主设计的,并非外界猜测的与魅族相关。AI 手机能不能带来和现有旗舰机不一样的工作流,现在还不明朗。如果你对物理 AI 终端好奇,可以等真机上市后看看它对多步骤任务的衔接做得怎么样,再决定要不要尝试。

原文:https://www.ithome.com/0/976/226.htm

贤者视角

Greg Isenberg 聊了一个概念叫「循环工程」,把精益创业里的快速循环搬到 AI 业务上。

他和 Elie Steinbock 对谈时反复强调:不要一次就想做出完美方案,而是先建一个最简版本,上线、看反馈、立刻改,让每个小循环里既有人的判断又有 AI 的效率。说白了,很多人在用 AI 时总觉得要详细规划好所有步骤再动手,但循环工程的精髓是先用最笨的办法跑通,再一点点让 AI 帮你加速。下次你搞新项目时,可以问自己一句:我能先做哪个最小的版本,今天就放出去让人试?

原文:https://www.youtube.com/watch?v=5p_BBdfvzgQ

据 The Verge 报道,微软 2025 年的碳排放涨了 25%,主要因为数据中心疯狂扩建。

微软的 2026 年可持续发展报告里写了,AI 需求拉动着基础设施膨胀,导致排放量一下子多了数百万公吨。这意味着 AI 的算力扩张正在实实在在给环境带来压力。这不算什么好消息,但它提醒我们一件事:选择 AI 工具时,除了比性能、比价格,也许将来还得看一眼它背后的能耗和可持续承诺。毕竟跑得再快,也要有地方能呼吸。

原文:https://www.theverge.com/tech/963728/microsoft-sustainability-report-2026

开发者补给站

OmniSight:一个轻量自托管监控仪表盘,把 Proxmox、Docker、K8s 等状态收在一页里。

纯 Node.js 后端加上原生 HTML、CSS 前端,没有额外框架包袱,适合自己搭家庭实验室或小团队内网监控。支持推送代理,部署门槛不高。如果你在维护一堆服务器和容器,可以拿来接一下试试,一眼就能看到各机器的负载和健康状况,比来回切各种面板省心。对于想定制监控界面的人,也可以基于它的代码继续改。

原文:https://www.reddit.com/r/selfhosted/comments/1uvmv3n/omnisight_a_lightweight_singleglance_homelab

IBM 发布 ScarfBench,专门测试 AI 智能体在做企业级 Java 框架迁移时的表现。

很多团队在考虑用 AI 辅助迁移老旧的 Java 系统,但模型到底靠不靠谱、会不会埋坑,之前没标准可衡量。ScarfBench 就是一套公开评测,看智能体在处理真实迁移任务时的准确性和稳定性。如果你正在或打算做框架升级,可以用这个基准先跑一遍候选模型,心里有个底,再决定让 AI 介入到什么程度。对做相关研究或工具开发的工程师,也是一个不错的参考标准。

原文:https://huggingface.co/blog/ibm-research/scarfbench

好物挖掘机

Just Ask by SEORCE 让你在 WhatsApp 上直接用大白话查 SEO 和 AI 可见性数据。

不用打开复杂的后台、不用拉各种报表,你就像聊天一样问「这周哪个关键词流量涨了」「我在 ChatGPT 回答里被提到几次」,它直接从你接入的数据里给出答案。如果你每天需要盯网站流量又反感繁复的仪表盘,可以把它接进日常用的 WhatsApp,上班路上问几句就能知道情况。免安装,拿来就能聊。

原文:https://www.producthunt.com/products/seorce

Miora 不是又一个 AI 出图工具,它带记忆、会学你的口味,持续产出多模态创意素材。

你在它上面做设计、生成图片、调色板,它会慢慢记住你的偏好,把这种风格固化成一个可重复使用的「技能」。下次做相似的项目,就不用再从零开始描述画面了。适合经常需要同一调性视觉输出的人,比如自媒体创作者、活动设计师。上手后,可以先花几分钟教它一套你常用的品牌色和构图习惯,之后再生成海报、封面就会省力不少。

原文:https://www.producthunt.com/products/miora-2