AI AGENT · BACKEND · LLM SYSTEMS

Xi Zhang

我做 Agent、后端系统和 AI 产品,会花很多时间把自己想法做落地。

最近主要关注Agent,以及Agent在游戏、内容生产和真实业务中的新用法。用Agent提升生产力和生活体验,是我的目标。

最近在做

Agent Kernel

迭代自己用Python手写的Agent Kernel,把不同的业务做成插件化注入。

Stardew Valley Agent

把AI伙伴放进游戏环境,让它像真实玩家一样,陪伴游戏。

长期记录

把做项目、读源码和排查问题时的经历持续整理到公开学习文档,方便自己复盘,也作为技术工作的长期记录。

我做过的一些东西

Stardew Valley Agent

一个真正参与游戏的AI伙伴

公开项目 · 持续开发

我看社交平台上总有人找搭子,自己玩的时候也希望有人帮忙干干活,所以我把Agent接入星露谷,陪玩家游戏、对话,现在它可以照料农场、整理物品、采购、照顾动物,并和玩家一起安排每天的事情。

伙伴会记住名字、偏好、约定和共同经历,也能自己规划任务做。

Agent · SMAPI · MCP · Memory

查看开源仓库 ↗

AI Drama Platform

把生成模型放进完整的内容生产流程

产品原型

做AI短剧时,我发现团队中的文件和版本管理是一个很散乱的工作,并且制作的整个流程也比较固定,所以我希望有个平台,可以从剧本开始,一直负责到视频生成。

因此我做了一个面向小型团队的生产管理原型,把剧本处理、角色、场景、分镜、图片生成、视频生成、候选素材、审核和导出放进同一个工作流,提升创作效率。

FastAPI · React · Workflow · Human-in-the-loop · AI Creation

技大校园e站

从一个自己每天会用的校园工具开始

微信小程序

这是我比较早开始长期维护的一个产品。最初围绕课表和成绩查询解决校园里的高频需求,后来逐渐加入校园社区和其他服务,并持续根据真实使用情况调整重点。

这个项目让我在技术初学者阶段学到了很多,包括如何团队合作,如何从零搭建项目,如何实现想做的业务,如何上线和维护。

Mini Program · Go · Campus Service · Product Iteration

LLM-NAS

让大语言模型生成并优化神经网络架构

硕士论文

技术栈:Python、PyTorch、DeepSeek-Coder、SFT、GRPO

研究使用大语言模型生成神经网络架构代码,通过监督微调和基于实际执行结果的强化学习,改善代码可执行性与候选架构表现。

代码生成与后训练:基于既有LLM-NAS工程,将成功运行并完成训练的架构代码整理为SFT数据,开展DeepSeek-Coder监督微调与GRPO实验;以候选网络实际训练后的评估结果作为奖励,优化模型的架构生成能力。

对照实验与结果分析:在统一候选评测配置下比较提示生成、SFT、SFT+RL和规则约束采样,分析可执行性、候选准确率及结构多样性;观察到强化学习改善可执行性及有效候选平均准确率,同时生成结构更趋集中。

LLM Training · SFT · GRPO · Neural Architecture Search

查看相关开源仓库 ↗

Agent Kernel

自己从底层实现一次Agent Runtime

GoAgent / estation_agent

为了学习Agent开发,我用Python手搓了一个Agent Kernel,并在不同的业务上验证实际运行的效果,目前已有一个上线产品,内测用户500人左右。

Python · Model / Tool Loop · Responses API · Session · Capability

我的目标

做点真正有用的东西

我想做点提高效率的,能改善工作体验的,或是能让别人做出作品的工具。

Notes

我会把学习开源项目和基础知识、自己做项目和排查问题时出现的重要内容记录下来,写成学习文档,给自己,也许也能给有需要的人看。

study.xxdez.uk ↗

Elsewhere