Spaces:

ikeno-ada
/

m2m100_418M-Quanto-4bit

Runtime error

App Files Files Community

m2m100_418M-Quanto-4bit / app.py

ikeno-ada

add

841c84b 10 months ago

raw

history blame

3.27 kB

	import os
	# import uvicorn
	# from fastapi import FastAPI, Request,HTTPException, Depends
	import gradio as gr
	from transformers import M2M100ForConditionalGeneration, M2M100Tokenizer,QuantoConfig

	# app = FastAPI()

	quantization_config = QuantoConfig(weights="int4")
	model = M2M100ForConditionalGeneration.from_pretrained("facebook/m2m100_418M",quantization_config=quantization_config)
	model.to_bettertransformer()
	tokenizer = M2M100Tokenizer.from_pretrained("facebook/m2m100_418M")


	lang_ids = {
	"Afrikaans": "af",
	"Amharic": "am",
	"Arabic": "ar",
	"Asturian": "ast",
	"Azerbaijani": "az",
	"Bashkir": "ba",
	"Belarusian": "be",
	"Bulgarian": "bg",
	"Bengali": "bn",
	"Breton": "br",
	"Bosnian": "bs",
	"Catalan": "ca",
	"Cebuano": "ceb",
	"Czech": "cs",
	"Welsh": "cy",
	"Danish": "da",
	"German": "de",
	"Greeek": "el",
	"English": "en",
	"Spanish": "es",
	"Estonian": "et",
	"Persian": "fa",
	"Fulah": "ff",
	"Finnish": "fi",
	"French": "fr",
	"Western Frisian": "fy",
	"Irish": "ga",
	"Gaelic": "gd",
	"Galician": "gl",
	"Gujarati": "gu",
	"Hausa": "ha",
	"Hebrew": "he",
	"Hindi": "hi",
	"Croatian": "hr",
	"Haitian": "ht",
	"Hungarian": "hu",
	"Armenian": "hy",
	"Indonesian": "id",
	"Igbo": "ig",
	"Iloko": "ilo",
	"Icelandic": "is",
	"Italian": "it",
	"Japanese": "ja",
	"Javanese": "jv",
	"Georgian": "ka",
	"Kazakh": "kk",
	"Central Khmer": "km",
	"Kannada": "kn",
	"Korean": "ko",
	"Luxembourgish": "lb",
	"Ganda": "lg",
	"Lingala": "ln",
	"Lao": "lo",
	"Lithuanian": "lt",
	"Latvian": "lv",
	"Malagasy": "mg",
	"Macedonian": "mk",
	"Malayalam": "ml",
	"Mongolian": "mn",
	"Marathi": "mr",
	"Malay": "ms",
	"Burmese": "my",
	"Nepali": "ne",
	"Dutch": "nl",
	"Norwegian": "no",
	"Northern Sotho": "ns",
	"Occitan": "oc",
	"Oriya": "or",
	"Panjabi": "pa",
	"Polish": "pl",
	"Pushto": "ps",
	"Portuguese": "pt",
	"Romanian": "ro",
	"Russian": "ru",
	"Sindhi": "sd",
	"Sinhala": "si",
	"Slovak": "sk",
	"Slovenian": "sl",
	"Somali": "so",
	"Albanian": "sq",
	"Serbian": "sr",
	"Swati": "ss",
	"Sundanese": "su",
	"Swedish": "sv",
	"Swahili": "sw",
	"Tamil": "ta",
	"Thai": "th",
	"Tagalog": "tl",
	"Tswana": "tn",
	"Turkish": "tr",
	"Ukrainian": "uk",
	"Urdu": "ur",
	"Uzbek": "uz",
	"Vietnamese": "vi",
	"Wolof": "wo",
	"Xhosa": "xh",
	"Yiddish": "yi",
	"Yoruba": "yo",
	"Chinese": "zh",
	"Zulu": "zu",
	}

	lang_list = list(lang_ids.keys())


	def translate(lang, text):
	encoded = tokenizer(text, return_tensors="pt")
	generated_tokens = model.generate(**encoded, forced_bos_token_id=tokenizer.get_lang_id(lang_ids[lang]))
	return tokenizer.batch_decode(generated_tokens, skip_special_tokens=True)[0]


	article = "<a href = https://huggingface.co/facebook/m2m100_418M>model page</a>"
	iface = gr.Interface(fn=translate, inputs=[gr.Dropdown(lang_list,label="tgt_lang"),gr.Textbox(label="text")], outputs=gr.Textbox(label="translated_text"),article=article,api_name="translate")
	iface.launch()



	# if __name__ == "__main__":
	# uvicorn.run(app)