维尔迪 AI 记录 · 一次录音如何成为可调用的知识

维尔迪 AI 记录 · 一次录音如何成为可调用的知识 由 Archify 生成的时序图。 录制 / 导入录音 上传音频与元数据 写入原始音频 返回存储引用 已接收 · 转写排队中 提交转写 · 含说话人分离 文本 + 时间轴 触发蒸馏管道 实体 · 主题 · 关联抽取 结构化结果 写入向量索引与元数据 向 AI 助手提问 发起问答请求 语义检索 Top-K 命中片段 + 来源 组装上下文并生成 回答 + 引用来源 答案 + 原始记录回链 展示答案与出处 ① 采集与上传 ② 转写与知识蒸馏 ③ 检索与 Agent 调用 用户 · APP / PC Web · 时序参与者 用户 APP / PC Web 用户端 · 录制与问答界面 · 时序参与者 用户端 录制与问答界面 应用服务 · 鉴权 · 编排 · 时序参与者 应用服务 鉴权 · 编排 对象存储 · 原始音视频 · 时序参与者 对象存储 原始音视频 语音识别 · 含说话人分离 · 时序参与者 语音识别 含说话人分离 AI 蒸馏管道 · 清洗 · 抽取 · 关联 · 时序参与者 AI 蒸馏管道 清洗 · 抽取 · 关联 向量库 · 语义索引 · 时序参与者 向量库 语义索引 大模型 · 抽取 · 生成 · 时序参与者 大模型 抽取 · 生成 图例 请求 返回 异步追踪 默认消息

① 采集与上传

  • • 录音与元数据先落对象存储,原始文件保留
  • • 转写异步排队,不阻塞用户操作

② 转写与知识蒸馏

  • • 识别结果经抽取与关联后写入向量索引
  • • 每条知识保留来源,可回链原始录音

③ 检索与 Agent 调用

  • • 先检索命中片段,再交由大模型生成
  • • 回答附出处回链,事实与推演分开呈现