使用指南
AI 工作台
对话式智能体操作工程,以及文生图 / 文生视频生成素材。
「AI 工作台」有两个模式,输入框左下角切换:对话 与 生成。
对话:智能体操作工程#

智能体通过 Mosael 的 MCP 工具直接看你的工程、提改动:检索素材、编排时间线、发起生成、乃至发布。
右栏「最近工具」旁的计数是当前可用的工具总数(截图里是 54 个)。它不是写死的:装了插件、 插件里勾了工具,这个数就跟着涨。工作流画布能做的事智能体都能做 —— 这一条由测试钉着, 不是一句愿望(见 MCP 文档)。
- 确认卡:任何会改动工程 / 外部状态的操作,都会先弹确认卡,由你批准后才落地。
- 选择卡:遇到岔路口——两三条路都说得通、而选哪条取决于你想要什么(发到哪个平台、 要哪种风格)——它会把选项摊开让你点,单选多选都有,也可以「自己写一个」或者跳过。 跳过时它按自己的判断继续,不会再问一遍。 确认卡可以设成「本会话始终允许」,选择卡没有这个 —— 它问就是因为不知道答案, 自动回答等于让它自己编一个。
- 技能(skills):composer 左下角可调用预置技能(opencode 式)。
- 附件:当前消息里的图片直接交给所选模型;导入素材库后的图片 / 视频由
analyze_asset使用 当前会话模型分析,不会另选一套隐藏的视觉模型。 - 左栏是对话记录,每条会话独立;支持重命名 / 删除。
剪辑、工作流画布和创意画板里的紧凑助手复用同一个会话池。面板左上角直接显示当前会话标题, 点击即可搜索或切换;长标题自动省略,控件保持扁平,不再额外套一个选择框。
底层是托管的外部 coding-agent CLI(opencode 式),不是自研聊天循环。需先配置模型服务商。
输入框:每轮都要看的留在外面#
输入框那一行只有每次都会用到的东西:对话 / 生成切换、附件、模型、发送。其余进右边那个滑块图标的 会话设置——它们是「配好就不再动」的东西:
- 思考:关闭 / 低 / 中 / 高。开启后,模型的思考过程会流式显示在一个折叠块里,想看就展开,结束后自动收起。 「关闭」只表示不主动要求它思考:k3、DeepSeek reasoner 这类模型无论如何都会思考,它们的思考照常显示。
- 视频分析方式:
- 自动:API Key 连接且当前模型有原生视频 Adapter 时直读整段,否则抽帧并附上已有语音转写; 订阅/OAuth 模型通过无工具 Gateway 分析采样帧,不要求填写服务地址。
- 原生视频:强制整段输入;当前 OAuth Gateway 没有 video block,因此会明确提示改用抽帧, 不会静默换模型或模式。
- 抽帧 + 转写:始终按时间采样画面,并把素材已有转写一并交给当前视觉模型。
- 上下文:一条水位条 + 「还剩百分之多少」,以及「立即整理上下文」。
上下文快满了会怎样#
聊得够久时,应用会把早期对话交给模型摘要、保留最近几轮,腾出空间继续聊。这件事不是悄悄发生的—— 对话里会留下一条记录,写明移出了多少条、腾出了大约多少 token,展开能看到摘要本身。
- 触发点是所选模型上下文窗口的 80%。每个模型的窗口不一样,在模型设置里可以改。
- 不想等它自己到线,可以随时点「立即整理上下文」——它要花一次模型调用,所以是个明确的按钮而不是自动行为。
- 水位读的是供应商回报的真实用量(最后一次调用的 input + output),此后的新消息才是估算,不是纯猜。
轨迹:它做了什么、时间花在哪#


对话回答「它说了什么」,顶部的「轨迹」标签回答另一个问题:它做了什么、时间花在哪。
一屏三条泳道(输入 / 模型 / 工具)把整个会话压成色块,两种投影可切:顺序每条记录等宽(不依赖 时间戳,永远画得出来),时长按真实耗时排布并把中间的空闲挤掉。下面是逐步的执行流,点开某一步 能看到它的入参、返回、耗时。
轨迹里还有对话看不到的那一半:
- 系统提示只在变化的那一轮记一份。它不是常量——跨会话记忆和当前任务计划都拼在里面,每轮都 可能不一样,而排查「它为什么突然改了做法」时,这恰恰是第一现场。
- 上下文注入单独成条。发给模型的是「你打的字 + 这一段上下文」,所以你在轨迹里看到的提问,才是 模型真正收到的那一份。
- 每一轮的 token 明细(输入 / 输出 / 缓存读)标在轮头。没有用量记录时显示为空,而不是 0——「没记」 和「没花」是两件事。
子智能体:把一段调查派出去#
智能体可以把一件独立的活派给子智能体 —— 只读工具、自己的上下文,回来的只有结论。省的是 上下文,不是算力:一次翻四十轮文件的检索照样要翻,只是翻在别处,你的主对话收到的是答案而 不是翻找过程。
- 派发不阻塞。 立即拿到回执接着干别的,要不要等、什么时候等由它自己决定。同一条消息里 派多个就并发跑。
- 一份也不丢。 没等的报告会在收尾时自动送达。
- 每个子智能体都是一段能点进去的会话,界面和主对话一模一样,右侧面板和头部入口都能进。 运行中每一步都看得见。
不同会话的智能体之间还能相互 @ 通知。对方空闲就立即开跑,忙就排队、闲下来再接。这样来的 消息带「来自其他智能体」徽章,所以一段对话不会看起来像在自言自语。
生成:文生图 / 文生视频#

对话 / 生成一键切换——底部输入框直接描述画面,右栏调引擎参数;生成结果可一键入素材库:

「生成」模式左栏是生成模型目录,中间是生成结果流,底部输入框写提示词:
- 选模型 → 写提示词 → 发送,任务进队列,完成后结果进素材库。
- 能不能跑取决于该模型对应服务商的密钥是否配好;没有可用模型时顶部会提示去配置。
右栏的控件跟着模型走#
不是所有模型都认同样的参数:万相收 832*480 这样的像素对,Seedance 收 720p 这样的档位;
有的能选时长,有的只有一档。所以右栏只出现这个模型真的支持的那几项 —— 换个模型,
控件跟着换。
手动输入、尚未收录能力描述符的模型仍可提交提示词,但 Mosael 不会从同供应商另一型号猜出
时长、分辨率或素材输入规则。
首帧、尾帧、参考图#
图生视频不止「给一张图」这一种:
| 意思 | |
|---|---|
| 首帧 | 从这张画面开始动 |
| 尾帧 | 和首帧一起给,模型会从第一张画面动到最后一张 |
| 参考图 | 不作为画面起点,只作为风格 / 主体的参考 |
同样只有支持的模型才出这些控件。每一项都可以选素材库里的图,也可以粘一条外链。
想让智能体来做也一样:让它「用这两张图做首尾帧生成一段 5 秒的视频」,它会先查这个模型 支持什么,再照着发 —— 传了模型不认的参数会被当场挡下,而不是默默跑出一个别的东西。
飞书绑定#
设置 → 飞书机器人可把智能体接到飞书,直接在飞书里对话。
需要确认的改动会以卡片发到同一个飞书会话,在飞书里点「同意 / 拒绝」即可,不用切回 Mosael。
谁能批准取决于账号绑定:点按钮的人必须已经把飞书账号绑到 Mosael 账号,并且此刻仍是该 工作区的成员。卡片在群里谁都看得见,但看得见不等于能批。
要用这个功能,还需在飞书开发者后台为该应用做两件事(没有接口可代劳,一键创建也配不了):
事件订阅里添加 card.action.trigger、应用功能里打开「交互卡片」,然后重新发布应用。
没配好时机器人会退回纯文本提示,并告诉你要开哪两个开关。




