Current issue state, recent activity, and per-issue timelines from the indexed issue data.
| Date | Opened | Closed | Comments | Events | Open Backlog |
|---|---|---|---|---|---|
| 2026-09-12 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-11 | 0 | 0 | 0 | 0 | 6 |
| 2026-09-10 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-09 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-08 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-07 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-06 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-05 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-04 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-03 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-02 | 0 | 0 | 0 | 0 | 0 |
| 2026-09-01 | 0 | 0 | 0 | 0 | 0 |
| 2026-08-31 | 0 | 0 | 0 | 0 | 0 |
| 2026-08-30 | 0 | 0 | 0 | 0 | 0 |
Opened: 0
Closed: 0
Comments: 0
Events: 0
| Issue | Author | State | Labels | Comments | Reactions | Updated |
|---|---|---|---|---|---|---|
#494 DPO/OPD 训练入口可复现性修复:seed/revision 传递、参数去重、冻结验证 Opened 2 months ago | Alidadei | open | No labels | 1 | 0 | 2 months ago |
#492 请问sft训练几个epoch比较好呢 Opened 4 months ago | 223556cy | open | question | 5 | 0 | 4 months ago |
#330 单机多卡sft deepspeed zero3 训练一直卡在训练阶段 Opened 3 years ago | lainxx | closed - completed | question | 1 | 0 | 4 months ago |
#374 ppo训练时出现问题:UserWarning: KL divergence is starting to become negative: -233.50 Opened 2 years ago | user2311717757 | closed - completed | question | 3 | 0 | 4 months ago |
#383 大佬,DPO可以改成inputIds和attention_mask 输入吗 Opened 2 years ago | Faded1022 | closed - completed | question | 1 | 0 | 4 months ago |
#386 增量预训练PT与有监督微调SFT的疑问 Opened 2 years ago | VirgilG72 | closed - completed | question | 1 | 0 | 4 months ago |
#415 sharegpt_gpt4的看了数据跟医疗没有关系,为什么也可以用于医疗多轮对话的微调呢? Opened 2 years ago | cqray1990 | closed - completed | question | 1 | 0 | 4 months ago |
#418 请教下数据处理部分,tokenizer分词后的position_ids字段是怎么生成的 Opened 2 years ago | XiaozhuLove | closed - completed | question | 4 | 0 | 4 months ago |
#430 增量预训练时,加载chat模型的问题 Opened 2 years ago | luckmoon | closed - completed | question | 1 | 0 | 4 months ago |
#248 有没有支持mistral 7b的计划 Opened 3 years ago | xbeark | closed - completed | enhancement | 3 | 0 | 4 months ago |
#357 使用deepspeed 全参数sft后,inference 回答的都为空,有解决办法吗 Opened 2 years ago | Yian320 | closed - completed | question | 2 | 0 | 4 months ago |
#409 关于奖励模型训练数据的构成 Opened 2 years ago | Eren139 | closed - completed | question | 6 | 0 | 4 months ago |
#428 baichuan2词表扩充后进行pt所遇问题 Opened 2 years ago | tuqingwen | closed - completed | question | 2 | 0 | 4 months ago |
#461 您好,对Deepseek-R1进行增量预训练,输出重复,而且也不思考了 Opened 1 year ago | GEHAH | closed - completed | question | 3 | 0 | 4 months ago |
#281 关于GLM3微调细节 Opened 3 years ago | DeMoth-1 | closed - completed | question | 3 | 0 | 4 months ago |
#453 先增强预训练后SFT,grad_norm为0 Opened 1 year ago | dakongss123 | closed - completed | question | 1 | 0 | 4 months ago |
#392 请问是否支持最新的InternLM 2.5? Opened 2 years ago | hao203 | closed - completed | enhancement | 1 | 0 | 4 months ago |
#421 耗时过长 Opened 2 years ago | ucaslei | closed - completed | question | 1 | 0 | 4 months ago |
#489 老师您好,请问双卡使用run_sft_accelerate.sh进行sft,数据使用200万medical,max_train_samples=400000 ,per_device_train_batch_size=2, gradient_accumulation_steps=8,学习率=2e-5。为什么训练时候最大进度显示100000,但是训练到12500teps时候学习率就降到0不变了?第二次使用tochrun 使用run_sft.sh脚本,同样的设置,最大进度显示12500。 Opened 5 months ago | xrc666 | closed - completed | question | 1 | 0 | 4 months ago |
#488 老师您好,请问双卡使用run_sft_accelerate.sh进行sft,数据使用200万medical,max_train_samples=400000 ,per_device_train_batch_size=2, gradient_accumulation_steps=8,学习率=2e-5。为什么训练时候最大进度显示100000,但是训练到12500teps时候学习率就降到0不变了?第二次使用tochrun 使用run_sft.sh脚本,同样的设置,最大进度显示12500。 Opened 5 months ago | xrc666 | closed - completed | bug | 1 | 0 | 5 months ago |
#487 佬,后面打算往多模态靠吗?或者有什么类似多模态项目推荐吗 Opened 5 months ago | Luious-LYH | closed - completed | question | 2 | 0 | 5 months ago |
#462 老师您好,请问本项目是否支持多机多卡的分布式训练,是否有SFT的多机多卡Demo Opened 1 year ago | luckyzcw | open | question | 1 | 0 | 5 months ago |
#439 reward model 训练数据量的问题 Opened 2 years ago | chloeHXY | open | question | 2 | 0 | 5 months ago |
#445 CPT阶段,采用36w条医疗数据集,训练一轮后loss从23.1-17.5左右正常吗 Opened 2 years ago | ygyang11 | open | question | 5 | 0 | 5 months ago |
#413 请问支持llama 3.1 微调? Opened 2 years ago | cqray1990 | closed - completed | bug | 3 | 0 | 5 months ago |