环境
- v0.2.3,macOS 桌面端(Apple Silicon),内置 Agent(gpt-5.6-sol)
场景
纪录片剪辑流程:我有一份执行稿(含 In/Out 点、对白顺序、画面结构),希望把稿子交给 Agent、再让它按稿从外接素材盘导入素材直接开剪。实际被两处能力缺口卡住,只能回到手动操作。
Feature A:Agent 对话框支持文档类附件
现状:聊天附件仅支持 视频 / 图片 / 音频 / GIF / SVG,拖入 Word / Markdown 等文档时提示:
已忽略不支持的文件(仅支持 视频 / 图片 / 音频 / GIF / SVG...)
希望:支持常见文档格式作为对话上下文——md / txt / srt / docx / pdf / csv。对 Agent 剪辑来说文档是高频输入:执行稿、采访提纲、字幕稿、分镜表。纯文本类可直接读入;docx / pdf 需要解析层(或先只做纯文本格式也行)。
Feature B:Agent 按本地路径直接导入素材到媒体池
现状:让 Agent 处理 /Volumes/.../素材目录 下的文件时,它自己报告了阻塞(trigger 了 report_user_friction·blocked):
这个会话不能直接读取你电脑上的 /Volumes/.../20260101 路径,也没有本地文件字节上传通道,所以不能凭路径自行导入素材。
结果是它列出 15 个 MP4 文件名,让我在媒体库里手动批量导入,导入完成后它才能继续——一次对话被切成两半。
希望:给内置 Agent 增加按路径导入的工具,例如 import_asset(path) / import_folder(path),行为对齐现有导入链路(探针、SHA-256 内容寻址、可选转写)。桌面端应用本来就跑在本机,读本地路径技术上可行;可以做成用户可见的授权(首次使用弹目录授权,或设置里配置允许的素材根目录白名单)。v0.2.0 已有可监控文件夹(watched folders),但那是"被动等待文件出现",和"Agent 在对话中按需导入指定路径"是不同的使用方式。
影响
这两个能力补上后,"执行稿 → Agent 粗剪"就能在对话里闭环完成;现在必须在对话外手工搬运文件,长稿多素材时摩擦很大。愿意配合测试。
环境
场景
纪录片剪辑流程:我有一份执行稿(含 In/Out 点、对白顺序、画面结构),希望把稿子交给 Agent、再让它按稿从外接素材盘导入素材直接开剪。实际被两处能力缺口卡住,只能回到手动操作。
Feature A:Agent 对话框支持文档类附件
现状:聊天附件仅支持 视频 / 图片 / 音频 / GIF / SVG,拖入 Word / Markdown 等文档时提示:
希望:支持常见文档格式作为对话上下文——md / txt / srt / docx / pdf / csv。对 Agent 剪辑来说文档是高频输入:执行稿、采访提纲、字幕稿、分镜表。纯文本类可直接读入;docx / pdf 需要解析层(或先只做纯文本格式也行)。
Feature B:Agent 按本地路径直接导入素材到媒体池
现状:让 Agent 处理
/Volumes/.../素材目录下的文件时,它自己报告了阻塞(trigger 了report_user_friction·blocked):结果是它列出 15 个 MP4 文件名,让我在媒体库里手动批量导入,导入完成后它才能继续——一次对话被切成两半。
希望:给内置 Agent 增加按路径导入的工具,例如
import_asset(path)/import_folder(path),行为对齐现有导入链路(探针、SHA-256 内容寻址、可选转写)。桌面端应用本来就跑在本机,读本地路径技术上可行;可以做成用户可见的授权(首次使用弹目录授权,或设置里配置允许的素材根目录白名单)。v0.2.0 已有可监控文件夹(watched folders),但那是"被动等待文件出现",和"Agent 在对话中按需导入指定路径"是不同的使用方式。影响
这两个能力补上后,"执行稿 → Agent 粗剪"就能在对话里闭环完成;现在必须在对话外手工搬运文件,长稿多素材时摩擦很大。愿意配合测试。