Portfolio details
项目介绍与验证方式
这里按项目概括业务任务、负责内容、工程实现、技术方案与验证结果。
Primary case · Paid delivery
企业年报文本情感分析交付
有偿外部委托|2025.05–08|独立设计与交付- 业务问题
- 客户需要从若干上市公司年报中筛选指定主题语句并识别情感态度。原流程依赖人工逐份查阅,非技术用户也无法直接运行模型脚本。
- 需求与迭代
- 我将模糊需求拆成文本处理、主题语句筛选、句级情感分类、结果校验和结构化导出;先完成单企业版本,再按实际使用需求扩展多企业批处理和 XLSX 字段。
- 交付形态
- 将基于 BERT 的句级情感分析流程封装为 Windows GUI,支持拖拽上传年报或 ZIP 批量处理,并导出 Excel / CSV。
- 运行与交接
- 针对客户环境缺少依赖、GUI 无法启动、批量运行慢和网络等问题重新封装环境,并补充演示与操作指南。
- 完成结果
- 客户能够按指南独立完成批量处理和结构化导出,项目随后完成验收并付款。
- 项目定位
- 工具用于投研信息整理与辅助判断,最终投资判断由使用者完成。
客户资料按保密要求管理;项目说明聚焦需求拆解、运行适配与验收过程。
Java Agent implementation
Spring Boot Agent Gateway
个人工程实践|JDK 21 + Maven|6/6 测试通过- 项目内容
- 我用 Java 21 / Spring Boot 3 实现 Agent Chat API、有界 Agent Loop、白名单 Tool Registry、JSON Schema 参数校验、工具 trace、会话存储和最小 RAG。
- 工具管理
- 注册
knowledge_search与结构化read_only_query;通过白名单、JSON Schema、超时与有限重试控制执行。 - 验证结果
- 在 JDK 21.0.12 与 Maven 3.9.16 环境完成编译,4 个测试类共 6 项测试通过;测试覆盖工具执行、RAG 切分/召回和应用层 Agent Loop。
- 运行方式
mvn test;默认使用 H2 与 memory adapter,MySQL / Redis / OpenAI-compatible 模型通过环境变量切换。- 扩展接口
- 默认 HashEmbeddingPort 完成服务链路验证;EmbeddingPort 保留替换接口,便于结合具体数据评估召回质量。
这个项目重点展示 Java / Spring Boot 服务端表达、工具管理、异常处理和可测试的 Agent 执行链路。
Primary implementation
协作雷达
公开 Skill|中文 v0.4.3 · 英文 v0.1.1- 项目内容
- 我实现了七模块协作状态卡片和确定性处理层:来源记录、PII 脱敏、跨轮聚合、Schema 校验、冲突检测,以及 CSV、飞书多维表格和 Notion 字段映射导出。
- 自测范围
- 代码中包含 CSV 公式注入 E4、SVG XSS T5、Markdown 表格注入 M1–M5,以及坏 JSON、类型不符和缺文件的对抗输入处理。
- 实现方式
- 通过固定 Schema、确定性处理和
selftest,将会议纪要、群聊记录等材料整理为结构化状态卡片。 - 适用范围
- 适合协作材料整理、状态汇总和结构化导出场景。
热度榜第 1 · Top 1/1851 · 待公示
协作雷达 Skill|科大讯飞 Skill 比赛(智能办公协同助理方向);最终结果以官方公示为准。
协作雷达 Skill|科大讯飞 Skill 比赛(智能办公协同助理方向);最终结果以官方公示为准。
Open source repository
WeRead AI Brain
GitHub 开源|用户自行配置 API Key- 项目内容
- 项目整合微信读书相关数据、可视化看板、AI 分析与 Markdown 知识导出;Skill 文档包含依赖、命令和环境变量说明。
- 使用前提
- 使用者需自行提供 API Key 并在本地配置环境变量;公开仓库不包含个人密钥。
- 使用方式
- 项目以开源仓库和 Skill 配置为主要交付形式,用户可按文档在本地运行。
ClawHub 下载量采用平台公开累计下载量口径;查看 Skill 与当前数据。
External task records
模型任务评测
模型任务评测|覆盖 5 个代号模型、3 类任务- 项目内容
- 我在两个执行环境下,记录 5 个代号模型完成 3 类复合任务的工具调用、文件处理、代码执行、数据分析与产物保存表现。
- 评测维度
- 覆盖任务理解、工具调用、文件处理、代码执行、数据分析、产物保存与结果稳定性。
- 输出结果
- 将上下文丢失、工具链路中断、产物格式不一致和结论缺少数据支撑等问题整理为可复盘的失败模式。
Controlled workflow
Text2SQL 工作流
个人工程项目|Text2SQL Agent- 项目内容
- 我实现了意图澄清、Schema 检索、SQL 生成、预校验、人工审批、执行、失败重试与审计记录的状态机。
- 技术重点
- 使用 SQLGlot AST 进行只读查询约束,并在 SQLite 沙箱中完成可执行性检查、结果限制和风险控制。
- 项目定位
- 适合展示自然语言查询、结构化校验、人工审批和可恢复工作流的设计能力。
Implementation record
RAG 与 MCP 工具协议验证
双框架 RAG|MCP 协议与工具调用已测试- 项目内容
- 我用 LangChain 与 LlamaIndex 分别实现一套 RAG 管线,对照切分、Dense + BM25 多路召回与 RRF 重排,并以 Chroma 持久化检索数据。
- MCP 验证
- 使用 Python 标准库实现 JSON-RPC 2.0 over stdio 的最小 MCP server,注册 2 个工具;自建 client 已完成
initialize、tools/list与两个tools/call冒烟测试。 - 工程判断
- 双框架对照用于验证“框架负责管线封装,检索质量取决于切分、召回与重排策略”;MCP 验证工具协议,权限、审计和人工确认由应用层负责。
- 测试记录
- 覆盖协议握手、工具发现,以及自建 client 对 2 个工具的调用链路。
AI workflow decision
费用审核预检:流程节点 AI 化与人机协同
证据预检|30 条样本评测|人工复核- 问题范围
- 聚焦报销材料在进入费用规则审核前的证据完整性检查。附件缺失、票面与字段冲突或特批证据不足时转
FLAG并给出人工补证 / 核实建议;最终审批仍由人工负责。 - 一次纠偏
- 规则复核发现,早期规则曾把“附件缺失”与已证实制度违规一起归入
REJECT。修正后,证据不足统一保留为待核验信号;T10 验证“附件缺失不自动驳回”。 - 验证范围
- 12/12 条分流测试通过;30 条标注样本的决策准确率为 63.33%,低于预设 80% 门槛,当前范围保留人工复核。
- 可证明能力
- 主动收窄高风险范围、区分证据缺失与制度违规、用评测门槛决定是否扩围,并为人工复核保留可执行的下一步。
完成内容包括证据完整性检查、
FLAG 分流、12/12 条测试与 30 条样本评测。Public release
科学营养顾问
公开发布|平台数据可点击核验- 下载量统计
- 作品集首页读取 ClawHub 公开累计下载量,分别展示中文、英文及两版合计。
- 使用范围
- 产品说明中保留特殊人群、疾病与医疗建议的转介机制,定位为健康管理辅助工具。