染念的笔记

你好,我是染念

TUST 本科、XDU 研究生,目前从事大规模分布式训练研究前后端都写过,现在还是个不太专业的全干开发者祝你马到成功,心想事成。

染念

职业轨迹

Baidu,全职,2026-现在,目前探索LLM/VLM的优化...那个,我们的LoongForge训练框架请star一下。QingCheng-AI,实习,2024年10月-2025年8月,参与**-image训练搭建 & chitu推理引擎的维护。MindSpore,实习(远程),2024.04 - 2024.10,mindnlp & mindspore相关打水

  1. Baidu
    全职
    2026-现在
    目前探索LLM/VLM的优化...那个,我们的LoongForge训练框架请star一下
  2. QingCheng-AI
    实习
    2024年10月-2025年8月
    参与**-image训练搭建 & chitu推理引擎的维护
  3. MindSpore
    实习(远程)
    2024.04 - 2024.10
    mindnlp & mindspore相关打水

GitHub 贡献

主页
GitHub 贡献图

技术栈

  • Python
  • CUDA
  • C++
  • JavaScript
  • HTML5
  • Vue
  • PHP
  • Docker
  • Slurm
  • Ubuntu

文章

  1. 解读 TAOT:MoE 动态副本调度优化 EP 负载的新思路

    我常说自己现在是研究训练 infra 的,但回顾自己在个人博客等平台发表的文章,一直没有在这个方向有所产出。所以,借着这次契机来分享和学习一下我们团队最近发表的一篇关于专家并行不均衡问题的文章吧。

    · ai infra

  2. lens|打造最强的个人LLM聚合网关系统

    事实上,为个人打造的LLM聚合网关系统已经有很多,例如octopus,metapi等,究竟要不要重复造一个轮子让我思考了很久。

    · llm

  3. conda base 环境还原,不用重装法

    最近,偶然发现很多包都被安装到了base环境,我是有一个“洁癖”的人,这样我肯定受不了,何况 base 包越多,初始化的时候就要加载很多时间。

  4. 2025 年终总结

    又到了一年总结季,想着去年的文章实属发得太迟了,所以临近新年的今天 12.29 15:11 开始起草了!

  5. Claude Code 教程

    最近在研究怎么更好地用 Claude Code,顺手写了个系列。

    · Claude

  1. LoongForge

    百度百舸团队开源的高性能大模型、多模态及具身智能分布式训练框架,贡献支持 GLM-5.3-flash 等多模态与大语言模型训练流程与算子适配。

  2. SD3.5-large-fp8

    Stable Diffusion 3.5 Large 模型的 FP8 量化权重(包含 fp8_e4m3fn 与 fp8_e5m2),降低显存占用并适配 Diffusers 快速推理流程。