AI 变现案例

AI提示库整理真实可落地的 AI 变现案例与方法,覆盖内容创作、程序开发、AI 工具运营、自动化工单等方向,拆解收入来源与实操路径,助你找到适合自己的 AI 赚钱方式。

全部 💼 副业实战 🤖 AIGC变现 🚀 流量与内容 🌍 出海淘金 🌐 其他
AIGC变现 · 共 50

Cloudflare Computer 发布:让 AI 智能体拥有持久化运行环境

Cloudflare 推出了 Cloudflare Computer。这是一个新的开源运行时,旨在为 AI 智能体提供更接近真实“计算机”的环境,而不只是临时容器。据该公司称,它利用 Cloudflare isolates 实现快速的无服务器执行,使智能体成本更低、速度更快,也更容易扩展。Cloudflare Comp…
🤖 AIGC变现 InfoQ 中文 · 2026-08-16 05:52:31

美版豆包G3.7Flash,快到飞起,超3分钟算我输!

美版豆包又更新了! 还有人记得谷歌的 Gemini 系列么?好像被极度边缘化了!上次 Flash 更新的时候,我其实专门写过一系列文章,介绍 Antigravity 这个智能体,以及测试了 3.5 F
🤖 AIGC变现 掘金 · 2026-08-15 21:50:27

教你用Workbuddy生成好看的封面图

AI生图的两个重点 有小伙伴一直在催更这期的教程,原本老马是真没想写的。因为确实没啥技术含量,而且是老生常谈的东西。 首先声明,本文的标题是有点标题党的意思。因为要介绍的工具和模型,并非只有WorkBuddy和内置模型,还有其它的。 AI生图,无非两个重点,一个是提示词,一个是生图模型。随着生图模型的发展,现在提示词已经不那么关键了。 假设按二八法则划分,现在提示词只占20%,生图模型占80%。也就是说,你用了很强的模型,哪怕你提示词写得再烂,也能生成好看的图片。 搁以前的话,提示词还是很关键的,尤其你用什么Midjourney进行生图。还有一点就是,AI生成图片的提示词,是可以反推的。 比如小伙伴就是看到了老马的封面图,觉得挺不错的,挺好看的,也想生成这样的图片: 从图片反推提示词 那你就可以把图片保存下来,使用WorkBuddy上的多模态模型(多模态就是能看懂图片视频)进行反推,从而得到差不多的生成提示词。 反推的操作也很简单,把目标图片上传到WorkBuddy,选择好多模态模型,老马这里选择的多模态模型是MiniMax M3,加上一句话反推这张封面图的生成提示词,发送过去即可: 反推出来的AI生图提示词准不准确,其实也跟你选择的多模态模型能力有关系,下面是MiniMax M3反推出来的: 虽然是英文的,但你可以继续让它改成中文的提示词给你。英文提示词以前是很有必要的,因为很多生图模型对中文支持并不好,现在好多了。 老马怎样生成封面 介绍完图片的生成提示词反推,话锋一转,讲讲老马是怎样去生成自己的公众号文章封面图的。是不是也拿了别人好看的图片,去反推出来生成提示词,再进行图片生成的呢? 其实都不是,老马仅仅是写了一段大白话的提示词,甚至连一些提示词中经常用到的专业词语都没有写,不信你看: 上图中红框圈出来的,就是老马随意写的生图提示词。是不是没有任何专业词语,比如什么构图、配色、风格啥的,就很普通的自然语言。 那为什么生成的图片还能有这样的效果?答案太简单了,因为老马用的是GPT的Image2模型,目前可以说全球第一的AI生图模型。 就这么简单,没啥所谓的奥秘和技巧。image2已经超越了谷歌的NanoBanana2,成为当今的小甜甜。 模型好是好,唯一的缺点就是,使用门槛高,国内绝大部分的小伙伴也用不上。所以,老马只能把自己生成的封面图,丢给GPT,反推出专业一点的提示词模板,给到小伙伴们,用国内可以用的生图模型去生成。 一套可复用的封面提示词 是的,下面这段提示词模板,是用GPT反推原来老马生成的封面图,整理出来的。为什么说是提示词模板,就是你复制了之后,修改替换掉里面的一些关键词语,就可以生成各种自己需要的好看封面了。 PROMPT提示词 请生成一张16:9横版封面图,采用分层贴纸拼贴、立体纸艺海报、撕纸拼贴的设计风格。封面标题为“【标题】”,标题必须完整准确显示,除了标题之外不要出现任何其他文字。标题要超大、醒目、有创意字体设计,具有强烈视觉冲击力,适合短视频封面阅读。 画面中加入明显的【IP形象】,并让它以【IP动作/表情】的方式与主题互动。围绕主题加入【主题元素】,所有元素都采用贴纸、纸片、卡片、剪贴模块的方式呈现,具有明显前后层次和立体阴影。整体构图强调标题为第一视觉中心,IP为第二视觉中心,背景采用【背景风格】,配色使用【主色】、【辅助色】、【强调色】,并加入撕纸边缘、贴纸白边、纸张纹理、胶带、手绘箭头、半调网点、笔刷痕迹等细节。 整体效果要具有高点击率、商业感、潮流杂志感和强封面感。 你只需把上面提示词中【】的文字,替换成自己要的词语或者描述的句子就行了。额外说明一下,这种封面图的风格是固定的, 采用分层贴纸拼贴、立体纸艺海报、撕纸拼贴的设计风格。 因为小伙伴们是看到老马的公众号文章封面图是这样的风格,觉得这种风格好看,想要知道这种风格的图片怎么生成,所以老马就固定下来这种风格。 如果你要修改成自己喜欢的风格,那就去改动对应的提示词就行。废话有点多啰嗦了,接下来最重要的是去选择生图模型。 国内模型效果对比 就国内来说,可以直接使用免费AI生图,且效果还不错的,主要就是字节(豆包)的Seedream5.0,以及千问的Qwen-image3.0了。 当然,千问还有其它的开源模型,比如Z-image啥的,这里就不一一介绍了,只选择目前最新最强的image3.0。 那有小伙伴就会问了,WorkBuddy生成图片的效果咋样?只能说,比上面两个差点,因为WorkBuddy内置的生图模型是腾讯混元的hunyuan-image-v3.0-art。 老马使用上面的提示词,用WorkBuddy生成了一张封面图,大家看看效果就知道了,跟老马用GPT的image2生成的,差距有多少: 所以还是算了吧,你可以优先考虑选择用豆包和千
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 21:23:09

谷歌安卓负责人萨米尔 · 萨马特畅想未来:只要说清想做什么,系统就能替你完成

IT之家 8 月 15 日消息,据美国 CNN 当地时间 12 日报道,谷歌安卓生态系统总裁萨米尔 · 萨马特称,谷歌规划新版安卓时,通常会提前大约三年考虑消费者未来如何使用手机。“目前我们对安卓的设想是,你只需要说清自己的目标、意图或者想完成什么,系统就足够聪明,可以替你把事情完成。”公众越来越担忧 AI 对社会和经济造成的影响,也让 AI 未来发展面临的风险更加突出。目前的技术距离真正实现萨马特描述的场景仍有很大差距。不过,谷歌仍然押注这一方向。萨马特说:“我看到很多人,包括我自己,都低着头盯着手机,忙着完成各种事情。如果每天能把 5 分钟、10 分钟甚至 30 分钟还给用户,想想这些时间还可以用来做些什么。”为了完成一件事而在多个应用之间反复切换的使用方式,未来可能不再常见。IT之家从报道中获悉,萨马特举例称,AI 智能体将来有望可以读取用户看医生时留下的记录,向保险公司确认核磁共振检查是否在承保范围内,再直接完成预约。安卓目前还做不到这些。但即便如此,萨马特希望推动安卓朝这一方向发展,让用户不再需要对手机进行“事无巨细的操控”。以本周发布的 Pixel 11 Pro 为例,该机背面的新指示灯会在 Gemini 处理指令或回答用户时亮起。谷歌希望借此让用户不用拿起手机确认 AI 智能体有没有听见,就能直接通过语音与虚拟助理交流。
🤖 AIGC变现 IT之家 · 2026-08-15 21:08:13

新兴多智能体系统的模式与问题

Anthropic 研究指出,随着 AI 智能体在共享代码库、市场等社会系统中承担更多任务,智能体间交互量或将超过人机交互。实验显示,45 个协调智能体在 2700 万 token 运行中发现 266
🤖 AIGC变现 掘金 · 2026-08-15 20:45:49

AI智能体能力调度微服务

AI智能体能力调度微服务技术文档 1. 服务概述 AI智能体能力调度微服务是面向多智能体集群的轻量化调度核心服务,旨在解决多AI智能体能力冗余、资源浪费、任务分配混乱、执行效率低下等问题。服务基于微服
🤖 AIGC变现 掘金 · 2026-08-15 19:06:03

面向多模态推理的高效长上下文建模|AICon深圳

大模型能力持续演进,但 AI 的下一阶段竞争正在发生变化。模型能力之外,如何构建可靠的智能体、完善 AI 工程体系,并让 AI 在复杂业务环境中稳定运行,正在成为产业探索的新重点。8 月 21 日-22 日,AICon 全球人工智能开发与应用大会将在深圳举办。大会全日程现已 100%上线,来自产业一线的技术专家将围绕…
🤖 AIGC变现 InfoQ 中文 · 2026-08-15 18:00:00

智能体成“逃课神器”?部分美国学生用 AI 代替自己完成整门网络课程

IT之家 8 月 15 日消息,据《纽约时报》8 月 10 日报道,随着智能体模型越来越普及,部分美国学生已经不满足于让聊天机器人帮忙查答案,而是直接把整门网络课程交给 AI 智能体。AI 可以在后台替学生完成课程任务,学生本人则把时间拿去刷手机、玩游戏。AI 作弊从代写作业发展到几乎“代上课”的程度,暴露出网络教育相较实体课堂更难防范作弊的问题。线下课程可以通过考试、口头展示等方式确认学生是否真正掌握知识,网课却很难采用同样的手段。网课的大部分活动都在屏幕上完成,学生因此可以让 AI 智能体登录 Canvas、Blackboard 等学习平台,替自己做测验、观看课程视频、写论文,甚至冒充学生本人参加讨论。IT之家获悉,AI 公司几乎没有采取措施阻止这种行为。学生最常使用的 ChatGPT、Gemini 和 Grammarly 都不会拒绝替学生完成整篇论文的请求。这些公司也没有阻止 AI 模型登录 Canvas、Blackboard 等学习平台,也未理会教育工作者关于“模型在这些平台上使用时应自我标识”的请求。其中,部分公司的理由听起来相当牵强。开发 AI 浏览器的 Perplexity 在给《纽约时报》的声明中称,要求 AI 智能体在学习平台上表明身份会让学生的隐私和安全面临风险。从事网络课程教学已有 20 年的凯伦 · 科斯塔回忆,自己曾问:“我现在只是在和机器人互动吗?”加州州立大学系统的卡罗尔 · 休厄尔称:“我没有得到任何关于如何劝阻学生使用 AI 的指导。我得到的却是更多学习如何使用 AI 的机会。”值得一提的是,加州州立大学系统去年与 OpenAI 签署了一项价值数百万美元的协议。许多大学仍不愿全面禁止 AI,但已经有学校开始寻找应对办法。芝加哥大学法学院最近把禁止在课堂上使用手机、平板电脑和笔记本电脑纳入新的“AI 战略”,规定适用于一年级课程。普林斯顿大学则在一起 AI 作弊丑闻后,取消了延续一个多世纪的“荣誉守则”传统。按照过去的做法,学生可以在无人监考的情况下参加考试。
🤖 AIGC变现 IT之家 · 2026-08-15 17:05:10

实测GLM 5.3|重回开源国模一哥

长程调度,Agent Loop,这两个词,圈里喊了大半年,你随便刷个技术社区都能看到 乍一听挺唬人。翻译过来其实就一句话:让 AI 自己把一件大事,拆成很多步,一步一步做完,中途还记得自己为啥在干 这几个月,DeepSeek、Kimi、Qwen 都在验证这条路线。今天智谱也发了GLM-5.3 官方说,通过通过极致的后训练 Scaling:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间,大大提高了模型的智能上界 借着这一次GLM-5.3发布,那我们也来拆一拆,看看长程调度究竟又是用,如何自己上手写一个「长程调度」提示词 话不多说,直接开测 01 先翻译成人话 BASIC CONCEPT / AGENT LOOP Agent Loop就是 AI 自己「干活 → 看结果 → 再决定下一步」,循环很多轮,直到把事做完。通俗点就是 AI 学会”自己干活”,不用每走一步都等你指挥 而长程调度(Long-Horizon)指的就是为了完成这个目标,AI要自己能分成很多步、跨很多轮、还得一直记得自己干到哪了 它的难点很在于: 第 1 步错了,第 10 步就废,错误会一路滚雪球(漂移 shift) 中间经常没人告诉它对不对,走很远才发现方向错了 干到第 20 轮,还得记得第 3 轮说过的话 所以长程任务一直是模型的软肋:上下文有限,历史越滚越长,模型要么”失忆”,要么忘了自己为什么在干。 以前比”谁答得聪明”,现在比”谁能把事做完”。能把几十步的活稳稳干完、干砸了能自己恢复的模型,才配碰真实业务。 02 实测:让 GLM-5.3 自己循环跑 FIELD TEST / GLM-5.3 CASE 01 从 0 到 1 复刻传奇 第一个 case,我让它从 0 到 1 复刻经典游戏《传奇》,不过主题换成了《摸鱼小李》。第一轮跑出来还挺糙的,就是个能动的demo。 但整整 循环了7 轮之后,我拿到了下面这个能真正玩下去的《摸鱼传奇》:沉浸感拉满,设定完整,等级、天赋、装备、BOSS 一个不少。 更带劲的是过程。每一轮它都会回头看原版《传奇》是怎么做的,再接着往下打磨,一轮比一轮完整。 CASE 02 像素消灭怪物 本来以为《摸鱼传奇》已经够好玩了,结果 GLM-5.3 又给我整了一个闯关游戏,「地图、打怪、爆装备、升级、装备强化、Boss」一个不落全凑齐了。说实话,有点上头。 而这只是GLM-5.3跑了六个循环的结果,整个游戏系统机制非常详实完善。整个游戏系统机制详实又完善。 说实话,我水群的时候看到有人复刻了一版《泰拉瑞亚》,再回头看它六个循环做出来的东西,这个效率是真的有点夸张。 CASE 03 模拟经验放置游戏 这个游戏很唯美,模仿的是小时候玩的放置经验类游戏。可以看到 GLM-5.3 的审美也是很好的。 可以放置大本营,点击单元格进行建设(农田、工厂、电站…),这类游戏最大的问题是,玩到后期有点手忙脚乱😂 每一个单元格太多点不过来。 CASE 04 红蓝网络攻防 除了编程,官方这次还提了一嘴网络安全。GLM-5.3 在漏洞识别上已经追平第一梯队(CyberGym 84.5%,跟 Mythos 5 基本持平) 既然 GLM-5.3 这么牛,那我有点好奇,如果让他们俩分别进行网络攻防,会怎么样? 于是我让 GLM-5.3 分别扮演红蓝两队进行攻防,这是最终的记录可视化: 除此之外,我还做了侦探推理游戏、探险迷宫游戏: 03 没有视觉,但底层是真强 MODEL LIMIT / VISUAL 现阶段 GLM-5.3 最大的痛点。它目前是纯文本模型(单模态),没有视觉模型,看不了图也造不出图。唐总 6 月公开征集意见时,评论区刷屏最多的就是”视觉”,说的正是这件事。 别的 AI 模型在 Agent Loop 的时候,还可以截图一下,查看状态,根据截图修正下一步。(注:还有一个原因是我用的Claude Code,在官方 ZCode Harness 中,会调用 GLM 4.6V 充当 5.3 的「眼睛」) 但视觉之外,它的编程能力和系统架构能力是真的强。而且这一次即便没有视觉,很多前端都做的很好看。 做仿《传奇》那个 case:它会自己去找《传奇》的相关网站、分析它的游戏引擎是怎样的,然后基于这个引擎帮我做。它真去研究了参考对象再动手,没瞎写。 这活儿放在人身上,得叫”系统架构师”。 04 设计loop提示词 PROMPT DESIGN / LOOP 我翻了 Anthropic 的《Building Effective Agents》、LangChain 的《The Art of Loop Engineering》和 Steve Kinney 的《Anatomy of an Agent Loop》,又看了看社区里大家踩坑的讨论,总结了五条建议:
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 17:02:21

猿辅导前妙多研发负责人,想把 AI 变成能独立干活的同事

数字员工逐渐走进团队。 6月下旬的时候,Anthropic发布了Claude Tag。 它并不是第一款强调AI同事概念的产品,但它的出现却让这种产品形态变得更加具体。Claude可以直接加入公司的公共频道,持续获得团队讨论里产生的Context。 成员交代一件事以后,它会调用已经获得授权的工具继续处理,也能给自己安排之后需要继续完成的工作。 更重要的是,它不再完全等待人来发起任务。一些长期没有处理的问题,或者团队讨论里出现的异常情况,也可以由Claude主动发现并介入。 而一个AI如果要进入团队,核心价值不只在于回复质量,它还需要理解组织持续产生的上下文内容,也需要获得外部工具和相应权限,并在没有人持续盯着的时候继续推进任务。 最后交回来的最好是一份已经完成的结果,减少人类成员继续搬运信息和补齐步骤的时间。 国内今年早些时候也陆续出现了一些思路很接近的产品。 比如像Helio,它给自己的定位是AI Workforce。团队希望让AI以同事身份待在一个组织里,每位数字成员都有名字、角色和独立记忆,并且可以读取共享频道里的历史内容。 该团队此前做的是Sheet0,那是一款面向数据收集和分析的Agent,去年获得500万美元融资,核心能力是将网页、文件和API里的信息整理成结构化数据。 王文锋当时将它描述成面向Agent的实时数据基础设施,今年1月,团队开始探索新的产品形态,随后做出Helio,同时继续为Sheet0现有用户提供服务。 一次产品调整,也让这支团队由数据Agent逐渐走向参与组织工作的数字成员。 类似的产品变化,也出现在另一支国内团队VM0身上。它推出了一位名叫Zero的AI teammate,Zero拥有持续记忆,能够调用外部软件,并允许用户设定周期任务。 其创始人张宇辰毕业于上海交通大学,职业早期曾在网易有道工作,此前在猿辅导工作了13年。 数个月前,VM0开放公开测试时,产品仍然是一套面向开发者的Agent基础设施,测试期间积累的反馈推动团队快速调整,Zero由此成为新的产品核心:AI开始以团队成员的身份进入日常工作。 它强调交付完整工作,用户只需要说明最终想拿到什么,Zero会自己判断需要调用哪些服务,再把中间步骤串起来。 官网当前列出的第一方连接器已经超过290个,常见邮箱、文档、代码仓库和项目管理工具都在其中。公司内部有自己的系统时,也可以继续配置自定义连接器。 这种设计让Zero更像一个可以跨软件工作的执行者,一个请求可能涉及几处不同的信息源,用户不必自己来回切换并复制内容。 它会读取必要资料,再按任务要求继续处理,结果可以是一份报告,也可以是演示文稿、网页、图片或者视频。 整个执行过程都会留下记录,用户能够查看它调用了哪些服务,调整相应权限,外部系统也能通过Webhook启动工作。 这和Claude Tag存在一个比较重要的差异,Claude Tag更强调让AI进入团队产生Context的地方。 Claude常驻在公共频道里,成员讨论项目时产生的背景信息会持续成为它理解工作的依据。它不需要等待某个人先把事情整理成一份完整Prompt,再交给AI处理。 Zero更接近一个有自己工作台的执行成员,同一位用户可以在不同入口继续交代工作,已有连接器和记忆依然保留。 一次聊天如果效果稳定,还可以保存成Workflow,之后由Automation自行触发,对于重复出现的工作,这一步很重要。 工作不会完全围绕聊天发生,现实里的某个变化出现以后,Agent就可以进入执行状态,对于持续重复的任务,这种产品结构更接近自动运转的岗位职责。 同时,VM0并没有要求每个用户都组建一整套多Agent团队。 Zero就是默认的通用成员,很多工作由它直接处理。当需要更加稳定的专业职责时,用户再创建新的Agent,并分别配置角色、Workflow和连接器权限。 每个Agent拥有独立访问范围,也不会自动共享记忆。除此之外,安全也因此占了很大比重。 每次任务会在独立的Firecracker微型虚拟机里执行,运行结束以后环境随即销毁。账号凭证由网络层处理,Agent代码无法直接读取原始令牌。 用户还可以限制某个数字成员访问哪些服务,并进一步约束具体操作。每次外部调用都会留下记录,方便团队追查执行过程。 这套工程取向和创始人过去十多年的经历有很强联系。 2012年猿辅导成立后的第一个月,他以第9号员工身份加入,也是团队第一位全栈工程师。十多年里,他参与过猿辅导和斑马多个业务的早期建设,其中一些产品后来做到数亿元年收入规模。 张宇辰后来承担的职责已经远远超过个人开发。在斑马时期,他带过130多人的研发团队。负责公司基础设施平台期间,他管理过100多人团队,为数千名开发者提供底层工程支持。 猿辅导快速扩张的几年里,他还完成过1000多场技术面试,
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 15:32:45

没有用户数据时,我怎样验证一个 RAG 知识库 MVP

一个没有真实用户数据的个人AI产品MVP,基于倪海厦学习资料构建。本文从产品假设、内容加工到问答路线,详细拆解了从资料结构化到Hybrid RAG的完整决策过程,并坦诚展示了当前测试结果与用户验证之间的差距,为知识类AI产品设计提供了可参考的实现样例。 这是一个没有真实用户数据的个人 AI 产品 MVP。 项目基于倪海厦相关学习资料整理,和官方没有关联,只供学习研究。本文使用了项目过程文件、Git 提交和我以前的记录。AI 协助资料核对、提纲梳理和部分文字整理;产品取舍、事实边界、截图与最终删改由我确认。 我能说明项目做了哪些选择,当前代码通过了哪些检查。真实用户是否觉得入口清楚、回答是否有帮助、使用以后会不会再来,这些问题还没有数据支持。 第一个假设先让资料可以进入 项目开始时,我手里有 231 项资料,大约 1GB。格式包括 PDF、Markdown、Word、JSON 和少量其他文件。原有目录已经做过分类,日常使用仍然会卡在几个很具体的地方。看到一个概念以后,我不知道它和哪些内容相连;想系统地看,又要重新判断先后顺序。 我当时的产品假设很简单。对于这类学习资料,用户需要先知道有哪些内容、从哪里开始,随后才会形成具体问题。 这个假设没有经过用户研究验证。它来自我整理和使用这批资料时遇到的麻烦。为了尽快检查方向,我先做了 12 个样例节点,用它们验证卡片模板和链接格式,随后扩成人纪、天纪学习路径和可交互图谱。 6 月 7 日上线的第一版网站有总览、学习路径、知识图谱、节点卡片、天纪提示词和全局搜索。当时没有 AI 问答。发布记录留下的选择很清楚,第一阶段先验证资料能否变成可以浏览的结构。 这个选择也决定了首页的分工。刚接触内容时可以先看路径;知道一个概念后,可以从图谱找到上下游,节点卡片负责给出较完整的解释。问答后来加入,用来处理已经能够说清楚的问题。 四种入口目前只是产品设计和可操作 Demo,还没有证据说明用户会按这个顺序使用。现阶段可以检查导航、跳转和内容是否成立,入口假设仍需要真实行为数据验证。 同一批资料要支持三种任务 页面结构确定以后,我开始处理背后的内容。 资料清点先暴露了基础问题。旧清单数字和实际目录不完全一致,其中还有一个 0B 文件。部分内容有 OCR 噪声,来源也并非全都明确。中医医案和处方剂量又涉及公开边界。于是我先记录格式、大小和来源,再标记空文件、缺项和风险内容。 随后,这批内容沿着不同用途继续加工。当前站点包含 64 个图谱节点和 5 篇主题文章,共 69 个内容项,节点间有 338 条有向关系。问答侧归并为 11 组语料,生成 4,852 个检索块。 这几个数字的口径不同。231 项是本地资料审计结果,不等于全部进入公开网站。69 个内容项面向阅读和关系浏览,4,852 个检索块面向机器召回,二者也不能互相替代。 实际处理时,我需要同时照顾三种任务。资料来源和版本要能回查,概念之间要能建立关系,用户提问以后还要拿到足够完整的证据。原始文档适合连续阅读,直接按固定长度切开容易混入相邻主题;图谱节点能表达关系,内容长度又未必足够回答问题。 我对这一阶段的判断是,知识结构和检索结构应分别加工,来源信息贯穿其中。这样做增加了维护成本,却能在回答出错时继续追到原始资料,而不必只盯着最后一段生成文字。 问答路线没有一次定型 AI 问答在 7 月 9 日才进入项目。第一版把腾讯元器公开页嵌进网站,同一天又换成站内原生输入框,加入代理和多个后端地址。7 月 10 日接入 CloudBase AI SDK,统一问答路由和最初的 Router 测试也在这时加入,小程序随后上线问答。 7 月 18 日,小程序改为直接调用 CloudBase Agent,之后为了绕开 Agent 计费限制,又迁移到直接调用大模型。第二天,项目接入完整语料、BM25 检索、医疗拦截和限流,形成 Hybrid RAG。 这段 Git 历史对我有两个提醒。技术方案会受费用、部署环境和回答依据影响,能跑通的方案未必适合继续用。产品复盘也不能只画最终架构,方案更换时暴露的约束往往更有价值。 一个 Badcase 让我回到检索结果 问答跑起来后,我用“紫微星、天府星有啥用”做过一次对照。系统返回了天纪相关内容,答案却缺少官带星、三台八座等直接信息。高位结果里出现了学习路径、文件清单、三才框架和排盘表格,真正解释紫微星的块只有 38.72 分,排在第 10 位。 这个现象说明相关性还不够。用户点名了两个实体,系统应该优先拿到对应章节。目录和表格虽然也含关键词,却不该挤掉专项内容。 我先检查分块和排序,没有先改回答语气。固定长度分块把几个星曜混到同一块里,同一来源组最多返回两条,专项章节因此少了一次进入上下文的机会。 后续修改落在检索侧。返回数量从
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 15:12:19

真正成熟的 AI 产品,都能在设计什么时候交还给人

当AI Agent开始执行真实业务操作时,产品设计的核心不再是让AI做得更多,而是决定它何时必须停下来。本文深入剖析人工接管机制的设计逻辑,从风险分层到动态权限系统,揭示AI产品从“帮我想”到“替我做”的关键转变。 过去两年,AI 产品最明显的变化,是从“帮我想”逐渐走向“替我做”。 聊天模型可以回答问题,Agent 则开始浏览网页、读取文件、调用工具、修改表格、发送信息,并尝试把一个多步骤任务从头推进到尾。对用户来说,这种变化很直观:以前需要把每一步讲清楚,现在只要说出目标,AI 就会自己规划中间过程。 有意思的是,Agent 越能干,产品里的暂停、确认和接管机制反而越多。 OpenAI 在 2025 年 7 月发布 ChatGPT Agent 时,除了介绍它如何使用虚拟计算机和多种工具完成复杂任务,也反复强调几项控制措施:具有重要影响的操作需要用户确认;部分关键任务需要主动监督;用户可以中断任务、修改指令、接管浏览器或者直接停止任务。 如果只从自动化率看,这些步骤像是在给 Agent “踩刹车”。但从产品角度看,它们恰好揭示了 Agent 与普通聊天机器人的区别。 聊天机器人答错一个问题,用户通常可以忽略、重问或者修改。Agent 一旦拥有外部执行能力,错误就可能变成一封已经发出的邮件、一条已经更新的客户记录、一个被取消的预约,或者一次对外作出的承诺。此时,模型输出不再停留在对话框里,而是进入了真实业务和真实关系。 产品要解决的问题也随之改变:不只是怎样让 AI 做得更多,还要决定它可以在什么范围内自主行动,什么时候必须停下来,以及停下来以后怎样把任务完整地交还给人。 我更愿意把这件事理解成一套动态权限系统。 真正成熟的 AI 产品,设计的不是一个孤立的“转人工”按钮,而是一套能够根据任务风险调整权限,并将目标、过程、状态和责任完整交还给人的协作机制。 本文看点 01 何时必须把控制权交还给人 02 人工接管如何转移任务上下文 03 产品经理怎样设计接管机制 一、人工接管为什么不再只是“兜底” 早期智能客服已经有“转人工”。机器人无法识别问题时,把对话分配给客服坐席;用户不满意时,也可以输入“人工客服”退出机器人流程。 在这个模型里,机器和人的边界相对清楚:机器人处理标准问题,人处理复杂问题。转人工往往发生在机器人已经失败以后,因此它天然被理解为兜底方案。 Agent 改变了这个前提。 它不只是生成一句回答,而是在一个任务里连续作出多次判断。它可能先读取用户需求,再选择工具、检索资料、比较方案、填写表单,最后执行一个会影响外部状态的动作。任务越长,AI 的每一步就越可能改变下一步能做什么。 这时,人工介入至少会出现在三个位置。 执行前:人负责授权 假设用户对一个邮件 Agent 说:“整理今天需要回复的客户邮件,并帮我处理。” 读取邮件、识别主题、归纳问题,通常属于低风险动作。生成回复草稿会提高风险,但结果仍然没有离开系统。真正发送邮件时,风险突然变化:它开始代表用户对外表达,还可能包含时间承诺、报价信息或责任判断。 因此,人不是在 AI 失败以后才出现,而是在动作产生现实后果之前完成授权。 执行中:人负责纠偏 多步骤任务经常遇到模型事先无法判断的情况。用户让 Agent 安排出差,它可能在查找航班后发现预算不足,也可能发现两个会议时间互相冲突。继续执行不是单纯的技术问题,因为如何取舍取决于用户没有说出的偏好。 此时最合适的动作不是猜,也不是宣布任务失败,而是暂停、说明冲突,并请求用户补充判断。 执行后:人负责审阅和承担结果 有些任务可以先执行,再由人复核。例如整理内部文档、给客户线索打标签、生成一组候选方案。这类任务的结果可以批量检查,也容易撤回。 但“可以事后检查”不等于责任消失。产品仍然要告诉用户 AI 改了哪些内容、依据是什么,以及怎样撤销。 三个位置对应三种不同的人类角色:授权者、协作者和审阅者。它们已经超出了传统“机器人不会了,找个人来”的逻辑。 NIST 在《AI 风险管理框架》的人机交互附录中,把人机组合描述为一条从自主执行延伸到人工处理的连续谱。AI 可以自主决策,也可以把判断延迟给专家,或者仅向人类决策者提供额外意见。不同系统是否需要人工监督,取决于具体场景,而不是由“是否使用 AI”统一决定。 这条原则看起来抽象,落到产品里却非常具体:人不能只作为异常队列末端的一个接收者,而应该在任务设计阶段就拥有明确角色。 「换句话说,人工接管不是 Agent 能力不足时留下的临时补丁。只要产品允许 AI 进入真实流程,它就需要回答谁有权决定、谁能够暂停、谁来检查结果,以及最后由谁承担后果。」 二、什么时候必须停下来,不能只看模型置信度 确定需要人工介入以后,下一个问题是:什么时候介入? 一个很容易想到的方案,是给
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 12:25:20

AI互联网日报:Apple联手阿里训练中国AI、DeepSeek上线国家超算互联网、百度库库AI推出独立端

Apple和阿里把AI本地化推进系统,百度把办公智能体做成独立端。美团红灯停表和Apple Maps广告,又把搜索、收费、履约拉进同一条工作流。这不是功能列表更新,而是系统、办公和本地生活入口都在接手原本需要人判断的动作;我会把焦点放在选择权上,入口替用户省一步时,也要交代数据、收费和规则边界。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互联网大事件速览 1,Apple联合阿里训练中国专属AI模型,Apple Intelligence本地化继续推进 2,DeepSeek V4 Pro和Harness上线国家超算互联网,国产模型进入一站式部署通道 3,荣耀YOYO Claw接入智谱GLM-5.3,PC智能体补上更强模型底座 4,商汤大装置提出TPW指标,AI数据中心开始按Token产出算效率 5,百度文库网盘GenFlow更名库库AI,AI办公独立端正式推出 6,NVIDIA全面投产Spectrum-X CPO交换机,AI数据中心网络继续升级 7,Google Gemini允许关闭可见水印,AI生成内容标识权交回用户侧 8,Meta发布开源权重模型Glimmer,开放路线与API闭源路线并行 9,中国医生借GPT-5.6证明22年数学猜想,AI科研协作走出样板 10,Microsoft Copilot Notebooks支持Markdown,资料型AI工作区继续补格式 11,Suno Studio 2.0加入MIDI,AI音乐工具向专业DAW靠拢 12,美国天然气价格预期上行,AI数据中心能源账本再被重估 13,Aurora与Kodiak获准在加州测试自动驾驶卡车,Robotruck进入公开道路验证 14,阿里千问开放AI眼镜生态,导游、教练和巡检Skill可由开发者自建 15,Google Pixel 11相机新功能只限新机,端侧AI继续绑定硬件换代 16,美团红灯停表计划年内覆盖百万骑手,外卖履约继续改写安全规则 17,小米三款迭代平板曝光,Pad 9系列或与新旗舰同台发布 18,Apple提议对App Store外链购买收取最高15%佣金 19,PayPal出售谈判升温,Stripe和Advent被曝仍在磋商 20,Google和Meta回应澳大利亚未成年人社媒禁令,平台合规压力继续上升 21,法国宪法委员会否决15岁以下社媒禁令,未成年人保护规则继续拉扯 22,北京首趟京东号电商班列发车,京津冀货物直通粤港澳大湾区 23,Apple Maps广告位在美国和加拿大招商,地图搜索开始补商业化入口 24,Tesla买断瑞典罢工员工,近三年劳资拉锯暂告一段落 25,Uber和小马智行计划在欧洲投放2000辆Robotaxi AI赛道观察 1. Apple联合阿里训练中国专属AI模型,Apple Intelligence本地化继续推进 核心内容:Apple被曝与阿里巴巴共同为中国市场训练定制大语言模型,用于推进Apple Intelligence在中国落地。这个合作罕见地把美国消费电子巨头、中国云与模型能力、本地监管要求放到同一条路径上。对Apple来说,中国版AI不能只翻译海外功能,还要解决模型备案、数据处理、内容安全和服务伙伴选择;对阿里来说,进入iPhone系统级入口意味着通义体系有机会触达更高频的端侧场景。苹果AI在中国的关键不只是“有没有”,而是能否在隐私、合规和体验之间找到足够稳的本地化方案。 2. DeepSeek V4 Pro和Harness上线国家超算互联网,国产模型进入一站式部署通道 核心内容:国家超算互联网宣布上线DeepSeek V4 Pro正式版DeepSeek-V4-Pro-0813,以及智能体框架DeepSeek Harness。平台依托全国首个十万卡级超智融合算力资源池,面向科研院所、科创企业和开发者提供大模型训练、微调、评测、部署等全生命周期支持,并强调可在国产算力底座上一站式完成DeepSeek系列模型与源码下载、私有化部署和开发调试。DeepSeek能力从模型接口扩展到超算平台,说明国产AI竞争正在补齐工程化交付和算力入口。 3. 荣耀YOYO Claw接入智谱GLM-5.3,PC智能体补上更强模型底座 核心内容:荣耀全场景软件主理人宣布,荣耀YOYO Claw正式接入智谱最新发布的GLM-5.3大模型,“虾虾大脑”完成升级。GLM-5.3通过更大规模、更长周期和更多样任务环境的后训练,编程能力较上一代提升50%,并在公开基准中取得开源模型第一,同时提升代码审查、漏洞发现等网络安全任务表现。YOYO Claw此前作为荣耀PC侧智能体入口,承担跨应用操作和任务辅助,接入更强模型后,PC助手竞争会从“能不能唤起”走向“能不能处理复杂任务”。 4. 商汤大装置提出TPW指标,A
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 11:41:48

教你用Workbuddy开发部署上线业务AI应用(二)

从本地走向云端 书接上文:教你用Workbuddy开发部署上线业务AI应用(一) 在本地使用WorkBuddy开发完AI应用,如果是自己本机或者公司内部使用,那基本上是不需要部署到云服务器上,实现公网访问的。 公司内网的话,找一台电脑当成服务器,开启内网访问即可。这个你不会操作,可以把电脑系统的情况,网络情况描述给WorkBuddy,根据指导去设置也行。 接下来要继续讲的是如何部署到云服务器的问题,对于没有接触过网站开发,或者做过站长的人,即便现在有了AI的解答辅助。 对于云服务器的细节,域名的细节问题,很多人还是一知半解的,毕竟有些坑,是要在实际操作中才会遇到的。 想当年老马还是个初中生的时候,那时候当站长学搞网站,光一个域名解析就折腾了一个星期,不过当时条件也不好,每天只能攒点零花钱。 放学了马上跑黑网吧,最多上一个小时,而且虽然有搜索引擎,但是可查到的参考学习资料比现在少多了,也不像现在有那么多自媒体分享各种入门教程。 因此,老马会从简单上手的角度,去介绍基本的知识和细节。不会面面俱到,如果要说得非常详细,那这篇文章光讲云服务器跟域名就够了。 云服务器与备案 说到云服务器,现在的成本比以前低多了,而且软硬件也升级了不少。对于大部分小伙伴们来说,我们选择云服务器,可以优先选择国内的线路。 国内的机器经常搞活动促销,价格也低,比如阿里云的新人注册,可以抢38块一年的云服务器。常规促销的,也有99一年的。 只是国内的云服务器就得申请备案,备案的话是看你的云服务器所在国家的,就中国国内需要。香港、台湾这些不需要,澳门的服务器比较少见少卖。 备案跟域名没关系,不管你注册的是com还是cn域名。如果是国外云服务器,那都是不需要备案的,加上前面说的三个中国地区。 备案其实现在没那么复杂了,以前还得邮寄背景幕布拍照啥的,如今是一条龙直接线上搞定,你下载好文件打印填写好,扫描拍照上传,再补充其它资料即可。 一般备案时间是7-15天,现在管局的审核也加快了不少,以前起码都得15天。然后备案完了,最好是你一直用该服务商的云服务器。 比如你是在阿里云上面购买的云服务器,线路是北京的,那你备案的云服务器的服务商就是阿里云,一般来说就会一直用阿里云的。 但是你哪天换成了腾讯云,因为服务商换了,备案资料就得改,就得走一遍腾讯云的备案流程。假设你不改,有可能服务商或者管局在定期检查的时候发现问题,就会取消你的备案。 可以说,你的网站是面向国内用户的,包括什么小程序APP之类的备案,其实都是一个道理。那么关键问题来了,我买的是国内线路的云服务器,不备案会怎样? 不备案导致的最直接结果,就是你没法绑定域名。网站是可以访问的,只能用IP地址的形式。理论上,云服务器服务商不会去关掉你的服务器,你可以一直用下去。 但不排除有时候搞搞整顿活动,服务商就会催你,阿里云备案中心的小姐姐就会经常打电话慰问你。所以,有必要就去备案,不懂的就问服务商。 现在服务商已经把备案服务做得很完善了,不用担心备案问题,除非你的网站内容是有问题的。备案问题就说到这里,所以国外云服务器就简单多了,直接买直接绑定域名。 但国外云服务器的线路都是在海外,比如什么美国、日本、韩国等,在国内的访问速度就会相对国内线路的云服务器,慢一些。 不过这也不是绝对,现在很多国外云服务器都会有线路速度的优化。总而言之,如果你面向的用户是海外的,你是做出海生意的,那可以选国外的云服务器。 服务商与域名选择 其它的就没什么重点要说明,云服务器服务商的话,国内我们基本会选择大厂,比如阿里云、腾讯云、百度云。 其它的中小厂,甚至个人搭的就数不胜数太多了。怎么讲,这里面鱼龙混杂,水太深,切记不要为了贪小便宜而选择杂牌服务商。 你得想清楚一个问题,你把AI应用的源代码和数据都托管在人家那边。哪天提桶跑路了,或者因为服务器安全做得不好导致被攻击,数据丢失了。 这些损失可比一台同样配置的服务器,便宜个几十几百来得大。正所谓一分钱一分货,遇到离谱的价格,没有正规公司运营主体的,都得小心。 其它的应该就没啥要说明的了,继续讲域名,什么com、cn、net这类顶级域名,是我们比较常见,也经常输入的。 但现在还有各种奇葩的国家域名,这类小众域名不是说不能注册,你得看符不符合我们用户的使用习惯。还有一点就是,注册价格,跟续费价格,你得看清楚。 域名注册代理商有时候为了推广一个小众顶级域名,会用极低的价格诱惑你注册,比如首年注册费用只有一块几块十几块,一旦你掉坑了,来年续费价格可能就得上百几百。 正常来说,注册费用跟续费费用,一年几十块钱到上百是合理的,毕竟现在域名也普遍涨价了。域名相当于品牌,不然古往今来都有人在抢注和炒价格。 使用上了就一般不会更换,所以注册的时候注意一下就行。注册域名的代理商,你还是选择老马上面说的国内三大服务商
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 11:15:46

教你用Workbuddy开发部署上线业务AI应用(一)

从今天开始,老马会把 WorkBuddy 这款 Agent 工具的使用,与各行各业真实存在的问题结合起来,直接分享可以落地的解决方案。 每个行业、每家公司在真实业务中遇到的问题肯定不完全相同,但其中也存在共性。老马要分享的,就是这些共性问题的解决思路。 这次拿到的是一位旅游平台粉丝提供的业务需求。需求点比较多,因此先挑其中一个业务卡点,具体讲讲如何结合 AI 完善它。 如果你也在旅游行业,这篇文章会更对口。如果不是也没关系,只要你的业务环节存在类似问题,同样可以借鉴。 本文脉络 理清业务需求 用大白话写 PRD 开发与本地预览 从需求到上线,完整走一遍 老马还没有完整写过一套 AI 应用从开发、部署到上线的全流程。对于以前完全不懂技术、没有相关经验的小伙伴来说,这个过程很有必要了解。 随着 Vibe Coding,也就是“歪脖扣腚”的发展,现在人人都可以开发应用,解决实际问题。不像以前,做个网站还得花钱请人。 但开发门槛降低,并不代表完全没有门槛。做得出来和做得好,仍然是两码事。做好以后如何部署到云服务器、如何绑定域名并开放给客户访问,也是一条完整链路。 现在有了 AI,这些环节的门槛也降低了。你不需要先学会复杂的部署细节,只要把需求描述清楚,交给 WorkBuddy,基本就能帮你完成。 本系列分为两篇:本篇完成需求梳理、PRD 对齐和本地开发。下一篇继续部署云服务器并绑定域名。 一句话,也足够成为应用需求 先看这位旅游平台李总写下的需求。为避免广告嫌疑,平台名称已经隐藏: 供应商账号的开通是手动形式。一般先建立服务群,由工作人员审核供应商提供的资料,再在管理后台开通供应商账号。 短短一句话,其实已经足够成为一个 AI 应用的需求。最简单的需求描述方式,就是复述业务流程,再补充卡点。 李总的卡点是:供应商开通账号仍要人工操作,还得先建服务群。工作人员审核资料这一步很难完全省掉,但可以让 AI 先做初审,人工只审核重点。 「需求不必写得专业,但业务过程必须说清楚。」 小白不用先研究技术栈 明确需求以后,大部分小白用户不需要先研究编程语言、数据库和各种技术栈。 简单的 AI 应用,可以只是一个前端网页。复杂一些的应用才需要后端。李总的案例涉及账号注册和数据保存,因此需要数据库,而数据库属于后端的一部分。 前端和后端到底怎么选,是否两者都要,AI 会帮你判断。你真正需要先确定的是技术载体:要做网站、小程序、App,还是电脑端软件。 01 网站:实现难度和成本相对较低,本案例采用这种形式。 02 小程序:开发和发布流程比网站更复杂。 03 App 与电脑端软件:整体实现难度和成本更高。 把需求和载体写进提示词 确定网站作为载体后,就可以把业务需求和载体选型合在一起,写成下面这段提示词: Prompt 供应商账号的开通是手动形式。一般先建服务群,由工作人员审核供应商提供的资料,再在管理后台开通供应商账号。 我想做一个网站,让供应商直接注册账号、提交资料,并实时查看审核进度。我们也可以在管理后台直接审核。 请先帮我梳理需求,用大白话写出 PRD 需求文档。等我确认后,再开始项目开发。 这个网站涉及供应商账号注册,实际还需要与李总原来的管理后台打通。具体情况不同,需要李总结合原系统修改提示词。 最简单的打通方式通常是 API 接口。还是那句话,把原系统情况介绍清楚,给 AI 足够的上下文,剩下的交给 AI 解决。 准备模型、目录和 Ponytail 进入开发阶段后,打开 WorkBuddy。有积分的小伙伴尽量使用 GLM-5.2、Kimi K3、MiniMax M3,或者 Deepseek-V4-Pro。 腾讯 Hy3 虽然免费,但能力有限。同一个任务换不同模型,最终效果可能天差地别。 先在电脑桌面新建一个文件夹,作为 Vibe Coding 项目目录。老马这里创建的文件夹名叫“WorkBuddy”。 发送需求提示词之前,先安装一个辅助 AI 编程的 Skill: Ponytail(马尾辫)。 Prompt 安装这个 Skill:https://github.com/DietrichGebert/ponytail NOTE 如果安装失败,通常是网络无法访问 GitHub。可以给老马的公众号发送“github访问”,也可以询问 WorkBuddy 如何通过系统 Hosts 设置恢复访问。 安装好 Ponytail 后,就可以把前面的需求提示词发送给 WorkBuddy。老马这次选择的是 Deepseek-V4-Pro。 看不懂,就继续追问 WorkBuddy 会先写出一份大白话 PRD。你要先确认文档内容,并回答其中需要你拍板的问题。 比如 WorkBuddy 问:“供应商注册方式用哪种?”小白看不懂什么叫注册方式,没关系,继续问它什么是注册
🤖 AIGC变现 人人都是产品经理 · 2026-08-15 11:15:09
共 50 篇 · 第 1/4 页2下一页 »