今天,AIGEO.GURU 官网顶部多了一个很短的词:Agent。点击它,不会进入一页关于智能体的概念说明,而会直接抵达一个可以继续对话的工作界面——「AI 漫剧导演 · 流程预览」。这是 AIGEO.GURU 第一次把 Agent 从研究方向变成官网上可以直接进入的实践入口。本文也把它当作一份首版使用说明:先说明工作方式,再说明当前边界。

这次开放需要先把边界说清楚。2026 年 9 月 20 日完成的是官网统一导航对 Agent 入口的接入,公开页面已经在线;登录后的首版工作区已经真实跑通过从故事、分镜、用户确认、角色与环境参考图,到多参考图视频的闭环,但它仍是自用首版,不等于已经向所有人开放注册,也不等于所有模型、所有故事和每次生成都能得到相同效果。页面标题仍然写着“流程预览”,聊天和创作目前需要登录。我们愿意把真实可用的部分和仍需继续测试的部分一起公开,而不是用一句更响亮、但超出事实的口号替代它。

从研究 AI 如何理解信息,到尝试让 Agent 参与创作

AIGEO.GURU 一直研究的是同一个基础问题:信息怎样被智能系统理解、引用和发现。Agent 把问题往前推了一步——当系统不只需要回答一个问题,而要在更长的任务里持续理解材料、保留上下文、组织步骤并交付结果时,人与 AI 应该怎样共同工作?

漫剧创作会把这个问题放大。一段故事走向可观看的作品,本身就包含连续的判断:人物是否一致,场景如何衔接,画面和叙事是否服务于同一目标,前一步的选择怎样约束后一步。当前首版已经能够把这些步骤接进一场对话,也正因为任务足够长,“导演”这个名字表达的目标才不是多放一个生成按钮,而是把一次次零散操作组织成可以继续推进的创作过程。

现在打开页面,能看到什么

公开页面把对话放在起点。中央提示写着:“想聊什么,或开始创作?”下一句是:“从一个问题、一个想法,或一段故事开始。”这意味着入口没有要求使用者先学习一套复杂表单,而是允许从手头已有的材料出发。

AI 漫剧导演的空白对话入口:从故事、问题或想法开始
图 1|访客首先看到的是一个简洁的对话入口。真正开始聊天和创作前需要登录;这张图只用于说明界面位置,不代表一次生成结果。

围绕这个对话入口,页面已经形成一组工作台结构:新对话、历史对话、高级画布、添加图片或文档、引用图片、发送消息和选择对话模型。左侧项目栏可以展开,输入区也为图片与文档留出了位置。登录后,分镜脚本、图片、视频、执行过程和同一素材的不同版本会在真正产生结果时进入右侧作品面板,而不是一开始就用大量栏目占满界面。

当前关键操作会先要求登录。页面给出的原文是:“登录后即可聊天和创作。刚才输入的内容会保留,不会自动发送。”未登录页面目前没有公开注册或申请入口。因此,“流程预览已经开放”指的是页面与工作台结构已经可以访问,不等于任何访问者都能绕过账号直接使用完整功能。

登录后,使用者看到的重点不是一串需要记忆的专家名称,而是一场连续的对话:左侧保留对话与项目入口,中间继续讨论,右侧在真正有产出时展开图片、视频和版本。模型选择、参考资产、执行过程和结果版本都服务于当前创作意图。本文会展示这些登录后的真实功能位置与产出细节,但不会公开账号、密码、Token 或其他凭据。

从对话推进,而不是填写一张长表

第一步不是选择一排“专家”,也不是先填写一套复杂表单。使用者可以直接说故事、提出目标、上传图片或文档,和 Agent 讨论方向;只有当任务确实需要时,Agent 才会调用分镜、角色、环境、首帧或视频生成能力。故事默认保持原样,只有使用者明确要求改编、压缩、扩写或改变气质时,才进入改编分支。

当进入创作阶段,右侧才展开相应产出。这样做的好处是:聊天仍然可以讨论任何相关问题,生成工具只接收当前阶段真正需要的内容,不会把旧镜头、失败版本或过期链接混进下一次调用。

参考图怎么进入镜头

已有素材可以在对话中用 @ 引用。角色图、环境图、首帧图和从视频提取的尾帧/关键帧都可以作为后续镜头的参考;它们不是被锁在某一个“框”里,而是按本轮意图自由组合。当前镜头由使用者决定采用首帧生成,还是多参考图生成;Agent 负责把这个选择、画面、动作、运镜、对白和声音要求编译成对应模型能执行的请求。

在对话中引用已有图片,并把角色与环境带入同一镜头
图 2|@ 引用让已有素材回到对话里。截图来自工作台的实际界面片段,具体模型和参数会随本轮创作意图与已接通能力适配。

右侧只展示当前真正的产出

当分镜或视频任务提交后,右侧作品面板会展开,按图片、视频和版本显示结果;聊天区仍然保留,方便继续追问或修改。生成结果不由 Agent 自动评审“好不好”,使用者可以保留、重新生成、换参考方式或直接跳过。视频镜头必须建立在参考图之上,不用纯文生视频冒充图生视频。

右侧作品面板展示镜头视频与参考素材
图 3|登录后的工作台把对话、参考素材、执行状态和右侧产出放在同一视野里。实际输出仍以用户选择和模型返回为准;截图已去除账号等凭据。

一次镜头通常怎样往下走

可以把首版流程理解成下面几步:

  1. 说清楚故事和方向。 Agent 先和使用者讨论,不擅自改写原故事。
  2. 形成分镜。 使用者确认镜头数量、节奏、人物、环境、动作、运镜、对白和声音要求;单镜时长在 5–15 秒范围内。
  3. 准备参考资产。 生成或引用角色图、环境图、首帧图,也可以上传自己的图片和文档。
  4. 选择本镜方式。 由使用者决定首帧或多参考图,Agent 据此生成真实图生视频请求。
  5. 看结果再决定。 右侧展示结果;保留、修改、重生成、提取尾帧/关键帧或跳过,都由使用者决定。

这套流程不是“按一下就自动做完整片”,而是把需要判断的节点留在对话里,把重复的整理和调用交给 Agent。

为什么先公开流程预览

对 Agent 来说,一个对话框很容易展示,真正值得验证的是长流程能不能成立。历史对话能否帮助任务继续推进,项目材料怎样进入上下文,图片引用和高级画布怎样分工,模型选择会不会改变工作方式,结果能否稳定地回到同一创作目标——这些问题决定了它最终是一个看起来像产品的界面,还是一个能够被反复使用的工作台。

所以我们把当前阶段如实标为“流程预览”。它已经不只是一个静态界面:登录后的真实对话、素材引用、图片与视频任务、版本和执行过程都可以工作;但生成质量、稳定性、速度、费用和不同模型之间的效果仍需在更多真实项目中继续验证。AIGEO.GURU 不会把一次跑通写成已经稳定量产,也不会把界面入口写成未经验证的能力承诺。

它为什么出现在 AIGEO.GURU

官网仍然是 AIGEO.GURU 的公开事实母体。Research 负责保存可以回看的研究和项目记录,Agent 则成为一条新的应用实践路径:前者说明我们为什么做、做到了哪里、边界是什么,后者让访问者直接进入正在形成的工作界面。

因此,这篇公告收录在 Research 的「录其实」中,而不是另建一个只负责制造声量的新闻栏目。网站顶部的 Agent 会继续直达流程预览;这篇文章则保留本次接入的时间、已确认事实与未验证部分。对人来说,这是一次产品入口的公开;对搜索与智能系统来说,它也是一条可检索、可引用、不会把预览误写成成熟产品的正式记录。

现在,从一个问题、想法或故事开始

你现在可以从 AIGEO.GURU 官网顶部点击 Agent,也可以直接访问 AI 漫剧导演流程预览。未登录时可以先查看工作台结构;继续聊天和创作需要登录。

这还不是最终答案,但它已经不再只是一句“以后会做 Agent”。一个真实入口已经出现,一套创作工作流开始拥有可见的坐标。接下来重要的不是把它描述得更强,而是让每一次真实使用逐步回答:这个“导演”,究竟能不能把一个想法带得更远。

本文依据 2026 年 9 月 20 日至 21 日的实际工作区、官网导航、正式发布记录与首轮真实闭环整理。文中登录后截图已去除账号等凭据;示例用于说明当前工作方式,不构成对每次生成质量、速度、费用或模型效果的保证。当前版本仅开放指定账号使用,新生成图片和视频暂保留 24 小时。