Noah's Blog
HomeArchivesCategoriesTagsAbout

2026

2026-08-06

Python SDK里两个隐蔽的生命周期Bug

tech / AI Infra

2026-08-06

RL每步到底慢在哪里:实测rollout占了81.5%

tech / AI Infra

2026-07-30

用GitHub Release触发SDK文档自动更新

tech / AI Infra

2026-07-29

BatchLoRA合批为什么会让四张80G显卡同时OOM

tech / AI Infra

2026-07-29

一个越界Token如何让CUDA错误出现在无关代码上

tech / AI Infra

2026-07-28

Triton地址索引跨过int32边界导致CUDA error

tech / AI Infra

2026-07-24

多模态图片到底该传Base64还是File URI

tech / AI Infra

2026-07-22

记一次Triton-Ascend融合算子把variance算成0的排查

tech / AI Infra

2026-07-21

从2167到6079TPS的一次vLLM 950单卡压测

tech / AI Infra

2026-07-14

把大Batch拆开后如何保证梯度等效

tech / AI Infra

上一页
下一页
  • 1
  • 2
  • 3
Noah Shen

Noah Shen

CS/EE Student

UESTC ChengDu

文章

21

分类

9

标签

35

关注我

链接

  • Hexohexo.io
  • Bulmabulma.io

分类

  • academic1
    • 课程1
      • 大学物理1
  • clutter2
  • commentary2
  • journal2
  • tech14
    • AI Infra11
    • 环境配置3

最新文章

2026-08-06

Python SDK里两个隐蔽的生命周期Bug

tech / AI Infra

2026-08-06

RL每步到底慢在哪里:实测rollout占了81.5%

tech / AI Infra

2026-07-30

用GitHub Release触发SDK文档自动更新

tech / AI Infra

2026-07-29

BatchLoRA合批为什么会让四张80G显卡同时OOM

tech / AI Infra

2026-07-29

一个越界Token如何让CUDA错误出现在无关代码上

tech / AI Infra

归档

  • 八月 20262
  • 七月 20269
  • 一月 20261
  • 十二月 20252
  • 十月 20251
  • 四月 20251
  • 八月 20234
  • 三月 20161

标签

Ascend2
BatchLoRA2
CUDA3
Codex1
DDP1
DevOps1
Docker1
GitHub1
Go1
Linux3
LoRA2
NCCL1
PyTorch1
Python2
RL1
SDK1
Triton2
vLLM4
vllm1
分布式系统1
分布式训练1
多模态1
大学物理1
大模型训练1
安全1
并发1
性能优化1
性能测试1
显存优化1
梯度累加1
深度学习1
生命周期1
缓存1
自动化1
输入校验1
Noah's Blog

© 2026 Noah Shen  Powered by Hexo & Icarus

© 2026 Noah Shen
桂ICP备2023007254号-1   川公网安备51019002007929号

×