V5|Agentic 数据分析师
实现状态:待开发。此页是本期学习路线;真实代码与实测报告在完成故事后填写。
这一期学会什么:Agent 的自主性必须建立在受控工具和可停止状态上。
为什么有这一期
复用 V4 受控能力,支持多步分析、多轮上下文与有预算的工具编排。 进入条件:V4 验收完成,统一执行入口和策略不可绕过。
本期链路
text
分析任务 → LangGraph 状态 → 子任务计划 → V4 受控工具 → 证据集合 → 综合回答跟读顺序
- 从工具契约进入,确认每个工具都复用已有服务。
- 看 State 中哪些字段是模型可写,哪些身份与预算是服务端注入。
- 跟一个分解任务的依赖边、循环出口和 checkpoint。
- 对照多轮槽位合并规则观察过滤与时间继承。
- 读多候选触发条件、评分和共享预算,再看部分失败如何呈现。
必做学习实验
运行城市排名→华东→同比→杭州品类的四轮会话;中断后撤销权限再恢复,确认旧 checkpoint 不授予旧权限;让工具循环选择达到预算后停止。
记录输入、预测、实际输出、代码入口和失败原因;实验通过后再勾选相应任务。只有文档或 fake 运行不能替代真实集成与质量验收。
规模与验收门槛
复杂分析具有状态、证据、预算与停止条件;此阶段才引入 LangGraph。
完整功能与错误场景以本期计划为准。没有实测时所有指标保持“待测”;阶段完成还需要 通用 DoD。
设计取舍
Agent 能处理更多步骤,也增加不可控路径和成本。因此简单问题继续单步,复杂/低置信度才启用多候选;原因分析必须区分贡献线索与因果证明。
两分钟复述骨架
“V5 用 LangGraph 编排已经经过治理的能力。模型可以选步骤,不能改变身份或资源预算;每个结论关联子查询证据,失败和停止都是显式状态。”
这段是练习骨架;当前未实现,不能直接当作已完成的面试经历。开发后补入你真正做过的失败实验、测试与数据。
实现后维护的代码导读
| 内容 | 当前记录 |
|---|---|
| 已验收任务及证据 | 暂无;以根目录 plan 为准 |
| 真实入口与关键函数 | 待实现后登记 |
| 上游/下游与数据契约 | 参考本期链路,完成后对照真实代码 |
| 正常与失败场景的命令 | 待实现后登记 |
| 实测指标与环境 | 待测 |
| 本期新决策与限制 | 完成后更新架构决策 |