mozilla-ai/llamafile
Distribute and run LLMs with a single file.
解決的問題
llamafile 簡化了大型語言模型(LLMs)與語音轉文字工具的分發與執行。它消除了安裝的複雜性、相依性管理與環境設定的繁瑣,讓使用者能在大多數作業系統與 CPU 架構上,無需安裝軟體即可在本機執行開源 LLM。
工作原理
它結合 llama.cpp 與 whisper.cpp,並使用 Cosmopolitan Libc 建立單一可執行檔。這個「llamafile」將模型權重與推論引擎打包成一個可攜式、跨平台的二進位檔,可直接在 macOS、Linux、BSD 與 Windows(Windows 有部分大小限制)上執行。
適用對象
希望零安裝、最小技術門檻地在本機執行開源 LLM 或語音轉文字工具的開發者與終端使用者。
主要亮點
- 單一檔案分發:將模型與引擎打包為一個可執行檔。
- 跨平台:可在大多數作業系統與 CPU 架構上運行。
- 零安裝:無需安裝相依性或管理環境。
- 包含 whisperfile:提供基於
whisper.cpp的單一檔案音訊轉錄與翻譯工具。 - 廣泛模型支援:透過與
llama.cpp的整合,支援多種模型大小與架構。
相關
- 專案
- 專案
- 專案
- 專案
- 專案