chore: scaffold buddhagpt, verify Qwen2.5-7B-4bit runs on M5 (PAI-87)
This commit is contained in:
8
scripts/smoke_generate.py
Normal file
8
scripts/smoke_generate.py
Normal file
@@ -0,0 +1,8 @@
|
||||
from mlx_lm import load, generate
|
||||
|
||||
model, tokenizer = load("mlx-community/Qwen2.5-7B-Instruct-4bit")
|
||||
prompt = tokenizer.apply_chat_template(
|
||||
[{"role": "user", "content": "What is the Second Noble Truth?"}],
|
||||
tokenize=False, add_generation_prompt=True,
|
||||
)
|
||||
print(generate(model, tokenizer, prompt=prompt, max_tokens=200))
|
||||
Reference in New Issue
Block a user