Joe

做了 12 年测试开发的工程师,现在用 AI 干活,也研究怎么验证 AI 干得对不对

现在在做什么

在 X 上公开记录 AI 实测:模型对比、Agent 上手、用下来的成本和权限

抖音:借助 AI 搭了一套 agent 工作流,做英语学习和 AI 科普视频

用 Obsidian 加 AI agent 管自己的知识库:原始记录只增不改;经历写成笔记,三个方向的简历按配方一键生成 PDF

项目

2025–2026

AI 算力云平台的测试自动化

给容器集群、CPU/GPU 容器、分布式训练和存储搭功能、性能、稳定性的测试体系;接口自动化框架做了两代,从 pytest 驱动演进到低代码用例设计,接进 CI/CD,适配 7 个数据中心的迭代上线

  • PyTorch
  • TensorFlow
  • DeepSpeed
  • pytest
  • CI/CD

2025

自然语言驱动的 UI 自动化

用 RobotGo、OCR 和图像识别从零搭桌面 UI 自动化框架,再把操作能力封装成 MCP 服务,让大模型看懂界面后自己调度执行,做出了 MVP;覆盖 30 个以上核心 UI 用例

  • RobotGo
  • OCR
  • MCP

2023–2024

大模型辅助应答效果评测

负责三类知识库的应答效果评测,建立准确度评测方法,推动标注优化,准确率从不到 10% 提到 50% 以上,推广到 5 条以上业务线

  • 大模型效果评测

2023–2024

质量测试平台从 0 到 1

用 Go 和 Vue3 独立开发自动化回归、日志定位、指令测试三个模块,研发自测后的 BUG 从 10 个以上降到个位数

  • Go
  • Vue3

工作经历

2025.04–2026.04

测试架构师

AI 基础设施

半年内推动 5 个项目交付投产,线上 0 事故

2019.05–2024.06

资深测试开发,后任测试开发专家

在线教育

线上问题从每年 100 多个降到 20 个以内

2014.04–2019.05

测试开发,后任高级测试工程师

互联网

2016 年起负责视觉算法模型的端上质量验证(人脸关键点、OCR、图像分割等),参与模型训练

  • OCR
  • 图像分割

2010.12–2014.03

Android 开发