GPU 高性能计算工程师 / 算子开发工程师(CUDA/Triton 方向)
C++/Qt 开发工程师 / 桌面端应用开发工程师
工程实验室 | QTC++组组长 ?目前已更名为:全栈引擎工作坊
2024.05 - 2026.05
校 ACM 队 | 队员
2023.09 - 2024.05
校大学生记者团 | 团长
2025.05 - 2026.05
校大学生记者团平面设计部 | 部长
2024.09 - 2025.05
本人为郑州轻工业大学智能物联专业 2027 届应届生,技术栈横跨算子开发与优化与 C++/Qt 工程开发两大方向,持有 4 项软件著作权。
算子开发与优化方面,熟悉 CUDA 编程模型与 GPU 体系架构,掌握 Triton 块级编程与算子优化方法论。实习期间基于 Triton 实现的 GEMM 算子经多阶段递进优化,规则大矩阵峰值达 68.57 TFLOPS,反超 cuBLAS 基线 3%;针对长尾场景设计 Split-K 并行累加方案,性能达基线 3.47 倍。独立撰写《大模型算子开发与优化》相关章节,累计约 3.9 万字、60 页,具备将复杂底层原理转化为高质量技术文档的能力。
工程开发方面,深耕 C++/Qt 领域,具备扎实的算法基础与跨平台工程化能力。熟练掌握 C/S 架构设计、多线程并发、TCP/IP 网络通信及 SQLite/MySQL 数据库应用。作为工程实验室 Qt/C++ 组组长,主导 7 人团队从零开发多模态智能档案管理系统,个人代码贡献 90%+,累计 6w+ 行,已部署上线稳定运行。系统集成大模型接口,构建 RAG 知识库与 Embedding 语义检索,实现 AI 全链路赋能闭环。
兼具校大学生记者团团长任职经历,具备出色的团队管理与跨部门协作能力;精通 Photoshop、Illustrator、Figma 等设计工具,熟悉 UI 设计与交互规范,形成"技术 + 设计 + 产品"的复合能力结构,能快速对接需求与开发,兼顾功能落地与用户体验。做事严谨踏实、钻研意识强,学习迭代速度快,能快速适配岗位需求,愿意主动承担挑战性工作,用扎实的技术能力为团队创造价值。