Optimum‑NVIDIA percepat inference LLM dengan satu baris kod
Hugging Face memperkenalkan Optimum‑NVIDIA yang mendakwa membolehkan inference LLM sangat pantas dengan hanya satu baris kod. Alat ini direka untuk mempermudah penyebaran dan mempercepatkan inferens pada perkakasan NVIDIA, menurut catatan blog Hugging Face.