Skip to content

V5|Agentic 数据分析师

实现状态:待开发。此页是本期学习路线;真实代码与实测报告在完成故事后填写。

这一期学会什么:Agent 的自主性必须建立在受控工具和可停止状态上。

打开本期 5 个故事 / 15 个任务 · 查看总进度

为什么有这一期

复用 V4 受控能力,支持多步分析、多轮上下文与有预算的工具编排。 进入条件:V4 验收完成,统一执行入口和策略不可绕过。

本期链路

text
分析任务 → LangGraph 状态 → 子任务计划 → V4 受控工具 → 证据集合 → 综合回答

跟读顺序

  1. 从工具契约进入,确认每个工具都复用已有服务。
  2. 看 State 中哪些字段是模型可写,哪些身份与预算是服务端注入。
  3. 跟一个分解任务的依赖边、循环出口和 checkpoint。
  4. 对照多轮槽位合并规则观察过滤与时间继承。
  5. 读多候选触发条件、评分和共享预算,再看部分失败如何呈现。

必做学习实验

运行城市排名→华东→同比→杭州品类的四轮会话;中断后撤销权限再恢复,确认旧 checkpoint 不授予旧权限;让工具循环选择达到预算后停止。

记录输入、预测、实际输出、代码入口和失败原因;实验通过后再勾选相应任务。只有文档或 fake 运行不能替代真实集成与质量验收。

规模与验收门槛

复杂分析具有状态、证据、预算与停止条件;此阶段才引入 LangGraph。

完整功能与错误场景以本期计划为准。没有实测时所有指标保持“待测”;阶段完成还需要 通用 DoD

设计取舍

Agent 能处理更多步骤,也增加不可控路径和成本。因此简单问题继续单步,复杂/低置信度才启用多候选;原因分析必须区分贡献线索与因果证明。

两分钟复述骨架

“V5 用 LangGraph 编排已经经过治理的能力。模型可以选步骤,不能改变身份或资源预算;每个结论关联子查询证据,失败和停止都是显式状态。”

这段是练习骨架;当前未实现,不能直接当作已完成的面试经历。开发后补入你真正做过的失败实验、测试与数据。

实现后维护的代码导读

内容当前记录
已验收任务及证据暂无;以根目录 plan 为准
真实入口与关键函数待实现后登记
上游/下游与数据契约参考本期链路,完成后对照真实代码
正常与失败场景的命令待实现后登记
实测指标与环境待测
本期新决策与限制完成后更新架构决策

延伸阅读

需求 → 代码 → 验证 → 复盘