LLaMA-Factory

mirror of https://github.com/hiyouga/LLaMA-Factory.git synced 2025-08-04 20:52:59 +08:00

Author	SHA1	Message	Date
hiyouga	4be704823c	fix #2195 Former-commit-id: a83fb6d3ff1e2a9657e926083a926d48b0f3e1a6	2024-01-16 23:53:50 +08:00
hiyouga	2a3980d6ba	update loader Former-commit-id: 6629087e12f64f2635f24311234202077814083c	2023-12-24 19:10:23 +08:00
hiyouga	f0d405f392	support unsloth Former-commit-id: 7aad0b889d9a316fffd65f32a419078418fc0986	2023-12-23 00:14:33 +08:00
hiyouga	ce79528bb1	fix param type Former-commit-id: ba69378841778410f8004385df3fd4c41e5fa573	2023-12-21 17:33:01 +08:00
hiyouga	4e75ca1222	support dpo-ftx Former-commit-id: b87c74289d523ef88611b376074199ffd03cf103	2023-12-16 19:21:41 +08:00
hiyouga	7dbc670902	support quantization in export model Former-commit-id: 3524aa1e58da94ab00e9a2024952ea1b4119b2af	2023-12-15 23:44:50 +08:00
hiyouga	bd03307bbd	refactor adapter hparam Former-commit-id: 0716f5e470afffd2df5a815712b552a4b4797153	2023-12-15 20:53:11 +08:00
hiyouga	15b321da8e	remove loftq Former-commit-id: 3a8a50d4d42082b3bdce549653b398e49f2eb554	2023-12-13 01:53:46 +08:00
hiyouga	4c69025a83	support loftq Former-commit-id: 6219dfbd9377528bce286c724ae2dd0090881095	2023-12-12 22:47:06 +08:00
hiyouga	bd28dd0fe6	update readme Former-commit-id: 8cace7780867dd78760f40c46fd5b6ddd47dea0a	2023-12-12 11:44:30 +08:00
hiyouga	1cb390b9b2	implement rm server #1543 Former-commit-id: 7df4f3ab206fddb462f6ed865eaf04234fd72ed6	2023-12-03 20:52:54 +08:00
hiyouga	ae1048db6d	fix #1659 Former-commit-id: 475a3fa0f4c09d4cfd55ec66271a6d3c9eb5f4d2	2023-11-28 20:52:28 +08:00
hiyouga	b015ac35d8	support export size setting Former-commit-id: 859a6ea9425a09d7263f6436d05102df8129c248	2023-11-26 18:34:09 +08:00
hiyouga	f06c4c8f7a	update ppo trainer Former-commit-id: 5021062493ed63ad1f6133cfb543e4e7f528d2cc	2023-11-20 21:39:15 +08:00
Yuchen Han	ec910a87c0	Update finetuning_args.py Former-commit-id: b24635d22b3084ad29217ef55c1dd1fa4f85a1fb	2023-11-17 00:15:51 -08:00
hiyouga	678052a7ef	fix rlhf callback Former-commit-id: 1817ffc86fe3463ea91e9359c0e3611979a9d53e	2023-11-16 03:26:19 +08:00
hiyouga	b71da932eb	fix bug in PPO training Former-commit-id: 856522a3df4bb9ddfaaa137119eceb9574873950	2023-11-16 02:32:54 +08:00
hiyouga	f441932bd1	support full-parameter PPO Former-commit-id: ce783036001397a20b0b4c5da2fea6d0c03389d2	2023-11-16 02:08:04 +08:00
hiyouga	e30290444a	support multiple modules in freeze training #1514 Former-commit-id: 4907452d955367ebe987e6deae4fd4213628f2b2	2023-11-15 17:08:18 +08:00
hiyouga	125587b187	refactor evaluation, upgrade trl to 074 Former-commit-id: 442aefb925c4ff02b98aa30c49c2e01d04f6496a	2023-11-13 22:20:35 +08:00
hiyouga	6ee32cf71c	tiny fix Former-commit-id: 415bca900e5cc3afaddd5b06d35f472d9ead3263	2023-11-09 17:20:49 +08:00
Yanqing	fc05fd52cf	Update finetuning_args.py 更新 chatglm/falcon/bloom 的 lora_target 的名称 Former-commit-id: 3684dffa14ca0551d51027467c0134b884ed1c59	2023-11-09 17:04:40 +08:00
hiyouga	91f406cc99	fix ppo train and dpo eval Former-commit-id: 01260d975477ebb8570933a1bd7f547b4dba607f	2023-11-07 22:48:51 +08:00
hiyouga	3d40bdb600	upgrade peft, fix #1088 #1411 Former-commit-id: b2a60905f384ada92618bf21301fe96dac1c10bf	2023-11-07 16:13:36 +08:00
hiyouga	d6c77d9196	reimplement neftune Former-commit-id: 7b4acf7265b04cc4a674b3dcafdb90e76f149e39	2023-10-22 16:15:08 +08:00
anvie	3635823fbe	add NEFTune optimization Former-commit-id: 57fb40aa04fec11ca165a97ea463579faeaeebe7	2023-10-21 13:24:10 +07:00
hiyouga	f3fa47fa7d	refactor export, fix #1190 Former-commit-id: ea82f8a82a7356bbdf204190d596d0b1c8ef1a84	2023-10-15 16:01:48 +08:00
hiyouga	2562376f84	fix ppo args Former-commit-id: 11bd271364488d523d5117ec2ea26f39853175b7	2023-10-11 23:40:50 +08:00
hiyouga	927ff702ff	refactor finetuning Args Former-commit-id: 620efe1d8d2429f4bc3fa8009900ec43e1b5ef4b	2023-09-27 22:28:06 +08:00
hiyouga	802494e20a	update template Former-commit-id: 4318347d3f1982c773dad1074636ec7b550770fd	2023-08-22 19:46:09 +08:00
hiyouga	b88f0b396c	support ppo score norm (trl 0.5.1.dev required) Former-commit-id: 53e33418d02ee0f34c783e30ae510b811308c598	2023-08-18 12:02:42 +08:00
hiyouga	03edfd07e7	fix PPO trainer #551 , update readme Former-commit-id: 90205244186df558cd6b0000728d638348db3a10	2023-08-18 11:43:10 +08:00
hiyouga	79f4ba0d26	Release v0.1.6 Former-commit-id: a48cb0d474ef0648a97387daf5f623498b5e3ee6	2023-08-11 23:25:57 +08:00
hiyouga	abdfa26d06	support DPO training (2305.18290) Former-commit-id: 3ec4351cfdaf2aefcc7d13345e19d79874ed61d3	2023-08-11 03:02:53 +08:00
hiyouga	921778a7cf	update args spec Former-commit-id: 5453b93db04ee26223b7616dfdf26e749bea7473	2023-08-07 15:23:35 +08:00
hiyouga	9c84c4ed5d	support Qwen-7B, fix InternLM-7B inference Former-commit-id: 87f8f830e20aa839e089559c1d038954742000ef	2023-08-03 15:53:32 +08:00
hiyouga	2e0342dc54	fix #194 Former-commit-id: 8f7819fcaa00f6ddcf59552c2866d8fc5659d0e9	2023-07-19 17:07:33 +08:00
hiyouga	b8b38a9ade	create chat model Former-commit-id: 657cf0f55a7f0886bc837bdd44528971dc5e5caa	2023-07-15 19:26:20 +08:00
hiyouga	a696148d6b	modity code structure Former-commit-id: f75137661358f9070bc70c341dfa2cc5fd69cf94	2023-07-15 16:54:28 +08:00

39 Commits