Instructions to use microsoft/bloom-deepspeed-inference-int8 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use microsoft/bloom-deepspeed-inference-int8 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("feature-extraction", model="microsoft/bloom-deepspeed-inference-int8")# Load model directly from transformers import AutoTokenizer, AutoModel tokenizer = AutoTokenizer.from_pretrained("microsoft/bloom-deepspeed-inference-int8") model = AutoModel.from_pretrained("microsoft/bloom-deepspeed-inference-int8", device_map="auto") - Notebooks
- Google Colab
- Kaggle
adding ckpt 2 0
Browse files- BLOOM-tp_02_00.pt +3 -0
BLOOM-tp_02_00.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:059e1759868f0988e2dfa044ca34e5d5a2289287a7b6cfa887d1bd920762a1d1
|
| 3 |
+
size 5139992291
|