Tags: jehlum11/training
Tags
Merge pull request instructlab#350 from instructlab/deepspeed-move Update Dependencies to Move DeepSpeed to CUDA Extras
Merge pull request instructlab#320 from JamesKunstle/hpu-config deps: change hf accelerate bound, add requirements-hpu.txt
Merge pull request instructlab#324 from jaideepr97/move-tokens chore: move token classes into chat templates
Merge pull request instructlab#312 from instructlab/granite-dolomite Adding Dolomite Support and Bringing HF Padding-Free into Performance Parity
Merge pull request instructlab#282 from instructlab/mergify/bp/releas… …e-v0.5/pr-217 chore: add exit code & tox fix (backport instructlab#217)
Merge pull request instructlab#260 from instructlab/mergify/bp/releas… …e-v0.5/pr-259 Add rocm extra to pyproject.toml (backport instructlab#259)
Merge pull request instructlab#258 from instructlab/mergify/bp/releas… …e-v0.5/pr-255 fix: Add explicit flash_attn requirement for ROCm (backport instructlab#255)
Merge pull request instructlab#244 from instructlab/fix-pretrain-max Fix pretrain token list->int for masking
Merge pull request instructlab#238 from RobotSail/fix-checkpoint-sele… …ction fix: updates sorting logic to correctly compare numbers
Merge pull request instructlab#235 from JamesKunstle/fullstate_saving adds Accelerate full-state (opt, lr_sched, params)
PreviousNext