Repository Issue Activity (beta)

shibing624/medicalgpt

Current issue state, recent activity, and per-issue timelines from the indexed issue data.

Open Issues
6
New in 7 Days
0
Closed in 7 Days
0
Average Open Age
390 days
Stale 30+ Days
6
Stale 90+ Days
5
Last 2 Weeks
DateOpenedClosedCommentsEventsOpen Backlog
2026-09-1200000
2026-09-1100006
2026-09-1000000
2026-09-0900000
2026-09-0800000
2026-09-0700000
2026-09-0600000
2026-09-0500000
2026-09-0400000
2026-09-0300000
2026-09-0200000
2026-09-0100000
2026-08-3100000
2026-08-3000000
This Week

Opened: 0

Closed: 0

Comments: 0

Events: 0

Top Labels
question (50)
bug (32)
enhancement (10)
Issue Explorer
IssueAuthorStateLabelsCommentsReactionsUpdated

#494 DPO/OPD 训练入口可复现性修复:seed/revision 传递、参数去重、冻结验证

Opened 2 months ago
Alidadei
open
No labels
102 months ago

#492 请问sft训练几个epoch比较好呢

Opened 4 months ago
223556cy
open
question
504 months ago

#330 单机多卡sft deepspeed zero3 训练一直卡在训练阶段

Opened 3 years ago
lainxx
closed - completed
question
104 months ago

#374 ppo训练时出现问题:UserWarning: KL divergence is starting to become negative: -233.50

Opened 2 years ago
user2311717757
closed - completed
question
304 months ago

#383 大佬,DPO可以改成inputIds和attention_mask 输入吗

Opened 2 years ago
Faded1022
closed - completed
question
104 months ago

#386 增量预训练PT与有监督微调SFT的疑问

Opened 2 years ago
VirgilG72
closed - completed
question
104 months ago

#415 sharegpt_gpt4的看了数据跟医疗没有关系,为什么也可以用于医疗多轮对话的微调呢?

Opened 2 years ago
cqray1990
closed - completed
question
104 months ago

#418 请教下数据处理部分,tokenizer分词后的position_ids字段是怎么生成的

Opened 2 years ago
XiaozhuLove
closed - completed
question
404 months ago

#430 增量预训练时,加载chat模型的问题

Opened 2 years ago
luckmoon
closed - completed
question
104 months ago

#248 有没有支持mistral 7b的计划

Opened 3 years ago
xbeark
closed - completed
enhancement
304 months ago

#357 使用deepspeed 全参数sft后,inference 回答的都为空,有解决办法吗

Opened 2 years ago
Yian320
closed - completed
question
204 months ago

#409 关于奖励模型训练数据的构成

Opened 2 years ago
Eren139
closed - completed
question
604 months ago

#428 baichuan2词表扩充后进行pt所遇问题

Opened 2 years ago
tuqingwen
closed - completed
question
204 months ago

#461 您好,对Deepseek-R1进行增量预训练,输出重复,而且也不思考了

Opened 1 year ago
GEHAH
closed - completed
question
304 months ago

#281 关于GLM3微调细节

Opened 3 years ago
DeMoth-1
closed - completed
question
304 months ago

#453 先增强预训练后SFT,grad_norm为0

Opened 1 year ago
dakongss123
closed - completed
question
104 months ago

#392 请问是否支持最新的InternLM 2.5?

Opened 2 years ago
hao203
closed - completed
enhancement
104 months ago

#421 耗时过长

Opened 2 years ago
ucaslei
closed - completed
question
104 months ago

#489 老师您好,请问双卡使用run_sft_accelerate.sh进行sft,数据使用200万medical,max_train_samples=400000 ,per_device_train_batch_size=2, gradient_accumulation_steps=8,学习率=2e-5。为什么训练时候最大进度显示100000,但是训练到12500teps时候学习率就降到0不变了?第二次使用tochrun 使用run_sft.sh脚本,同样的设置,最大进度显示12500。

Opened 5 months ago
xrc666
closed - completed
question
104 months ago

#488 老师您好,请问双卡使用run_sft_accelerate.sh进行sft,数据使用200万medical,max_train_samples=400000 ,per_device_train_batch_size=2, gradient_accumulation_steps=8,学习率=2e-5。为什么训练时候最大进度显示100000,但是训练到12500teps时候学习率就降到0不变了?第二次使用tochrun 使用run_sft.sh脚本,同样的设置,最大进度显示12500。

Opened 5 months ago
xrc666
closed - completed
bug
105 months ago

#487 佬,后面打算往多模态靠吗?或者有什么类似多模态项目推荐吗

Opened 5 months ago
Luious-LYH
closed - completed
question
205 months ago

#462 老师您好,请问本项目是否支持多机多卡的分布式训练,是否有SFT的多机多卡Demo

Opened 1 year ago
luckyzcw
open
question
105 months ago

#439 reward model 训练数据量的问题

Opened 2 years ago
chloeHXY
open
question
205 months ago

#445 CPT阶段,采用36w条医疗数据集,训练一轮后loss从23.1-17.5左右正常吗

Opened 2 years ago
ygyang11
open
question
505 months ago

#413 请问支持llama 3.1 微调?

Opened 2 years ago
cqray1990
closed - completed
bug
305 months ago

Rows per page:

1–25 of 96