ColossalAI

Commit Graph

Author	SHA1	Message	Date
GuangyaoZhang	d84d68601a	change 'xxx if xxx else None' to 'xxx or None'	5 months ago
pre-commit-ci[bot]	996c65077e	[pre-commit.ci] auto fixes from pre-commit.com hooks for more information, see https://pre-commit.ci	5 months ago
GuangyaoZhang	a83a2336e8	rebase master llama change	5 months ago
GuangyaoZhang	20c0b06ff5	Merge branch 'command-r' of github.com:GuangyaoZhang/ColossalAI into command-r	5 months ago
GuangyaoZhang	363cde6957	merge model and attention forward	5 months ago
GuangyaoZhang	7a2b08646f	Remove CohereLayerNorm and use existing layernorm	5 months ago
GuangyaoZhang	fe2e74c03a	fix precommit	5 months ago
GuangyaoZhang	98da648a4a	Fix Code Factor check	5 months ago
GuangyaoZhang	f656d61778	change command	5 months ago
GuangyaoZhang	0b81163bc0	Copy llama to command	5 months ago
Edenzzzz	8795bb2e80	Support 4d parallel + flash attention (#5789 ) * support tp + sp + pp * remove comments --------- Co-authored-by: Edenzzzz <wtan45@wisc.edu>	5 months ago
GuangyaoZhang	3c7302ad0e	merge model and attention forward	5 months ago
GuangyaoZhang	8c3f524660	Remove CohereLayerNorm and use existing layernorm	5 months ago
GuangyaoZhang	c9025ebd7c	Merge branch 'command-r' of github.com:GuangyaoZhang/ColossalAI into command-r	5 months ago
GuangyaoZhang	9a290ab013	fix precommit	5 months ago
pre-commit-ci[bot]	2a7fa2e7d0	[pre-commit.ci] auto fixes from pre-commit.com hooks for more information, see https://pre-commit.ci	5 months ago
GuangyaoZhang	1016bb3257	Fix Code Factor check	5 months ago
GuangyaoZhang	94fbde6055	change command	5 months ago
GuangyaoZhang	431b7bcf8f	Copy llama to command	5 months ago
flybird11111	2ddf624a86	[shardformer] upgrade transformers to 4.39.3 (#5815 ) * [shardformer]upgrade transformers for gpt2/gptj/whisper (#5807) * [shardformer] fix modeling of gpt2 and gptj * [shardformer] fix whisper modeling * [misc] update requirements --------- Co-authored-by: ver217 <lhx0217@gmail.com> * [shardformer]upgrade transformers for mistral (#5808) * upgrade transformers for mistral * fix * fix * [shardformer]upgrade transformers for llama (#5809) * update transformers fix * fix * fix * [inference] upgrade transformers (#5810) * update transformers fix * fix * fix * fix * fix * [gemini] update transformers for gemini (#5814) --------- Co-authored-by: ver217 <lhx0217@gmail.com>	5 months ago
botbw	3bcbba9262	[gemini] quick fix on possible async operation (#5803 ) * [gemini] quick fix on possible async operation * [gemini] quick fix on possible async operation	5 months ago
Haze188	d9dddf574f	[Gemini] Use async stream to prefetch and h2d data moving (#5781 ) * use async stream to prefetch and h2d data moving * Remove redundant code	6 months ago
Li Xingjian	8554585a5f	[Inference] Fix flash-attn import and add model test (#5794 ) * Fix torch int32 dtype Signed-off-by: char-1ee <xingjianli59@gmail.com> * Fix flash-attn import Signed-off-by: char-1ee <xingjianli59@gmail.com> * Add generalized model test Signed-off-by: char-1ee <xingjianli59@gmail.com> * Remove exposed path to model Signed-off-by: char-1ee <xingjianli59@gmail.com> * Add default value for use_flash_attn Signed-off-by: char-1ee <xingjianli59@gmail.com> * Rename model test Signed-off-by: char-1ee <xingjianli59@gmail.com> --------- Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
Guangyao Zhang	aac941ef78	[test] fix qwen2 pytest distLarge (#5797 )	6 months ago
Hongxin Liu	aa125bcc91	[shardformer] fix modeling of bloom and falcon (#5796 )	6 months ago
Hongxin Liu	587bbf4c6d	[test] fix chatglm test kit (#5793 )	6 months ago
YeAnbang	74f4a29734	Merge pull request #5759 from hpcaitech/colossalchat_upgrade [ColossalChat] Colossalchat upgrade	6 months ago
Runyu Lu	c0948aff97	[Inference]refactor baichuan (#5791 ) * refactor baichuan * remove unused code and add TODO for lazyinit	6 months ago
YeAnbang	84eab13078	update sft trainning script	6 months ago
Li Xingjian	77a219a082	Merge pull request #5771 from char-1ee/refactor/modeling [Inference] Refactor modeling attention layer by abstracting attention backends	6 months ago
char-1ee	b303976a27	Fix test import Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
YeAnbang	2abdede1d7	fix readme	6 months ago
char-1ee	f5981e808e	Remove flash attention backend Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
YeAnbang	77db21610a	replace the customized dataloader setup with the build-in one	6 months ago
YeAnbang	0d7ff10ea5	replace the customized dataloader setup with the build-in one	6 months ago
char-1ee	ceba662d22	Clean up Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
char-1ee	5f398fc000	Pass inference model shard configs for module init Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
char-1ee	eec77e5702	Fix tests and naming Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
char-1ee	04386d9eff	Refactor modeling by adding attention backend Signed-off-by: char-1ee <xingjianli59@gmail.com>	6 months ago
YeAnbang	790e1362a6	merge	6 months ago
YeAnbang	ac1520cb8f	remove baichuan from template test due to transformer version conflict	6 months ago
YeAnbang	e16ccc272a	update ci	6 months ago
YeAnbang	45195ac53d	remove local data path	6 months ago
YeAnbang	bf57b13dda	remove models that require huggingface auth from ci	6 months ago
YeAnbang	0bbac158ed	fix datasets version	6 months ago
YeAnbang	62eb28b929	remove duplicated test	6 months ago
YeAnbang	b8b5cacf38	fix transformers version	6 months ago
pre-commit-ci[bot]	1b880ce095	[pre-commit.ci] auto fixes from pre-commit.com hooks for more information, see https://pre-commit.ci	6 months ago
YeAnbang	b1031f7244	fix ci	6 months ago
YeAnbang	7ae87b3159	fix training script	6 months ago

... 2 3 4 5 6 ...

3578 Commits (ColossalChat) All Branches Search

3578 Commits (ColossalChat)

All Branches