LLM Application Backend · Backend Engineering

你好 👋

Hi, I'm Xushuo,2026 届北京大学计算机科学与技术本科毕业生,正在寻找工作机会。

主投 LLM 应用后端与后端开发,近期项目集中在 RAG 检索、模型评测和可靠的 Agent 工作流;同时保留 CUDA 推理优化作为系统能力补充。

Selected work

重点项目

查看全部
检索与数据隔离

多租户 RAG 知识库后端

FastAPI · PostgreSQL/pgvector · Redis · MinIO

将租户、角色和文档 ACL 下推到混合检索;在 SciFact 上取得 Recall@5 0.865,并通过跨租户隔离测试。

评测治理

LLM 评测与 Prompt 回归平台

FastAPI · SQLAlchemy · Vue 3 · GitHub Actions

用不可变版本保存数据集、Prompt、模型参数和评测器,支持任务断点续跑、基线对比与分离的质量、成本、延迟门禁。

工作流可靠性

安全业务工作流 Agent

FastAPI · PostgreSQL · Redis · MCP

由服务端执行 RBAC 与租户策略,高风险操作需要独立审批;以检查点、outbox 和幂等键处理超时、取消与请求重放。

推理性能

TinyLlama CUDA 推理引擎

C++20 · CUDA · CMake · cuBLAS

实现 CPU FP32、CUDA FP16 与 Hybrid W8A16 路径;RTX 3080 Laptop 上 Batch 4 吞吐为 Batch 1 的 2.905 倍,峰值显存降低 40.4%。