<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>About Me :: Ay Docs</title><link>https://aaronyang0628.github.io/docs/_about/index.html</link><description>DevOps Resume Engineering Resume</description><generator>Hugo</generator><language>en</language><lastBuildDate>Thu, 04 Jun 2026 15:00:59 +0800</lastBuildDate><atom:link href="https://aaronyang0628.github.io/docs/_about/index.xml" rel="self" type="application/rss+xml"/><item><title>DevOps Resume</title><link>https://aaronyang0628.github.io/docs/_about/devops/index.html</link><pubDate>Thu, 04 Jun 2026 15:00:59 +0800</pubDate><guid>https://aaronyang0628.github.io/docs/_about/devops/index.html</guid><description>杨博 (Aaron) 🎯求职意向 云原生平台工程师 / AI基础设施工程师 — 用工程化能力把复杂系统从0跑到生产级
💪核心技术能力 1. 云原生 &amp; Kubernetes 生态（专家级）
精通 K8s 集群全生命周期管理：从裸金属部署到生产级运维，熟悉 RBAC、CRD、Operator 模式 掌握 GitOps 工作流（ ArgoCD）、Helm Chart 编写与发布、多集群架构设计 熟练使用 Go 开发 K8s Controller/Operator，完成自定义资源状态管理及 Prometheus 指标暴露 2. AI 工程化 &amp; LLM 工具链（前沿实践）
深度使用 Coding Agent（Opencode / Codex / Claude Code），可独立完成 Skills、Plugins、MCP Server 的定制开发 理解 MCP（Model Context Protocol）协议生态，具备从数据获取到模型推理的全链路 AI 工具开发经验 掌握 Knative + KServe 的弹性推理服务架构，能完成自定义模型的上线、灰度发布与自动扩缩容 3. 数据工程 &amp; 大规模数据处理
熟练使用 Apache Flink 进行实时流计算，曾扩展 Flink S3 插件以支持跨多对象存储的 Join/Union 熟悉 Apache Calcite SQL 解析引擎，具备多源异构数据联邦查询经验 掌握 MinIO / S3 兼容对象存储的架构设计与运维 4. 研发效能 &amp; 平台工程</description></item><item><title>Engineering Resume</title><link>https://aaronyang0628.github.io/docs/_about/engineering/index.html</link><pubDate>Sun, 14 Sep 2025 15:00:59 +0800</pubDate><guid>https://aaronyang0628.github.io/docs/_about/engineering/index.html</guid><description>杨博 (Aaron) 🎯求职意向 希望作为AI Infra开发工程师 为团队做出贡献
💪擅长技能 1. 熟悉CICD流程，能编写从 Image、Helm Chart 到 Operator不同资源， 并在k8s上对常见资源进行开发运维部署, 掌握 Argo-CD, Argo-Workflow 以及 Git-Action的开发和使用
2. 能够使用 Go 和 Java 完成 k8s CRD开发 以及 相关资源状态，指标监控上报
3. 理解业界发布上线规则，能够使用 Knative 以及 Kserve 完成 常见AI模型+自定义业务模型，弹性推理服务搭建，发布，上线
4. 理解Agent, MCP工作原理（智能体有深入了解，对MCP生态有实践经验）
5. vLLM、SGLang、RouteLLM等技术的学习或实践经验者优先:参与过开源项目更佳;
6. 理解常用数据挖掘算法和机器学习算法，如聚类，推荐系统等
熟悉CPU/GPU异构减速瓶颈分析方法，有服务器AI芯片、GPU加速经验:
👔工作经验 之江实验室-天文计算研究中心, 杭州, 中国 2024.01 - Present
高级研究专员
主要负责天文中心PB级数据存储和千核计算调度能力的基础设施保障；完成包括资源上云，开发改造数据平台及中间件，提高软件易用性。
完成项目:
CSST科研工作台-元数据管理系统: 开发天文元数据管理系统，为中国空间站工程巡天望远镜，提供PB级数据存储索引服务和实时计算处理支持。 Slurm On K8s: 开发云化HPC超算集群，在k8s上，提供了helm chart 或 operator方式一键部署规格可配置的slurm集群。 相场望远镜（宇宙触角）: 为新一代宇宙射频探测装置，完成软件DEMO部分，接受处理224个FPGA单元发送的UDP包，实时处理相关业务数据，分流调用不同天文学算法，推进科学发现，设计流量80Gb/s Arcyl Datahub: 作为贡献者向此开源元数据管理系统社区贡献包括grafana-dashboard，自定义数据扫描扩展 等相关代码内容 Link.. SchedMD Slurm: 曾维护改造开源超算集群，累计向开源社区及北大超算SCOW项目贡献包括helm chart包及虚拟机安装文档优化等内容 Link.. flink-s3-fs-multiple: 扩展flink-filesystem下插件flink-s3-fs-hadoop功能，支持在同一job内，同时操作多个对象存储中的文件完成join/union 熟练掌握以下工具:</description></item></channel></rss>