🔧 AI Nachrichten Major AI platforms go down in unprecedented simultaneous outage(03.09.2026 um 17:34 Uhr)
🔧 AI Nachrichten ChatGPT, Claude, and Grok Down? Users Report Widespread Outages(03.09.2026 um 19:14 Uhr)
🔧 AI Nachrichten OpenAI Launches GPT-6 Astra, Says We May Have Entered the AGI Era(03.09.2026 um 22:08 Uhr)
🔧 AI Nachrichten Claude Comes to CarPlay as Fifth Major AI Chatbot App(05.09.2026 um 05:31 Uhr)
🔧 AI Nachrichten OpenAI’s GPT-6 Astra Is AGI, Says NVIDIA CEO Jensen Huang(07.09.2026 um 06:31 Uhr)
🔧 AI Nachrichten Blame AI companies for Mac mini and Mac Studio shortage(31.08.2026 um 10:32 Uhr)
🔧 AI Nachrichten Major AI platforms go down in unprecedented simultaneous outage(03.09.2026 um 17:34 Uhr)
🔧 AI Nachrichten ChatGPT, Claude, and Grok Down? Users Report Widespread Outages(03.09.2026 um 19:14 Uhr)
🔧 AI Nachrichten OpenAI Launches GPT-6 Astra, Says We May Have Entered the AGI Era(03.09.2026 um 22:08 Uhr)
🔧 AI Nachrichten Claude Comes to CarPlay as Fifth Major AI Chatbot App(05.09.2026 um 05:31 Uhr)
🔧 AI Nachrichten OpenAI’s GPT-6 Astra Is AGI, Says NVIDIA CEO Jensen Huang(07.09.2026 um 06:31 Uhr)
🔧 AI Nachrichten Blame AI companies for Mac mini and Mac Studio shortage(31.08.2026 um 10:32 Uhr)

🔧 Programmierung 🕛 kürzlich 4 Min Lesezeit
0

Panduan Teknikal: Compile llama.cpp di Debian 12/13 dan Cross Compile ARM64

↗ Quelle (dev.to)
🗣️ Stimme:

1. Pengenalan



llama.cpp ialah runtime inference LLM berasaskan C/C++ yang popular kerana ringan, pantas, dan sesuai untuk menjalankan model GGUF secara local. Ia boleh digunakan pada:



Server x86_64

Workstation Linux

Mini PC

Raspberry Pi

Orange Pi

SBC ARM64

Container Linux



Dalam deployment sebenar, terdapat dua pendekatan utama:



Native build

Compile terus pada mesin yang akan menjalankan llama.cpp.

Cross compile

Compile pada mesin lebih laju (contohnya PC x86_64), tetapi menghasilkan binary untuk platform lain (contohnya ARM64 Orange Pi).



Bahagian 1 — Persediaan Debian 12/13



1.1 Install dependency asas




CODE
sudo apt update

sudo apt install -y \
git \
build-essential \
cmake \
ninja-build \
pkg-config






Komponen utama:



Package Fungsi

git Ambil source code

build-essential GCC, G++, make

cmake Build configuration

ninja-build Build engine lebih pantas

pkg-config Cari library dependency



Bahagian 2 — Clone llama.cpp




CODE
git clone https://github.com/ggml-org/llama.cpp.git

cd llama.cpp






Semak versi:




CODE
git log -1 --oneline






Bahagian 3 — Compile Native (Mesin Sama)



Contoh:



Debian 12/13 x86_64

Debian ARM64

Orange Pi

Raspberry Pi



3.1 Configure CMake




CODE
Build menggunakan Ninja:

cmake -B build \
-G Ninja \
-DCMAKE_BUILD_TYPE=Release
3.2 Compile
ninja -C build -j$(nproc)






atau:




CODE
cmake --build build






plaintext

3.3 Hasil build



Semak:




CODE
ls build/bin






plaintext

Contoh:




CODE
llama-cli
llama-server
llama-bench
llama-perplexity






shell



Bahagian 4 — Enable OpenBLAS (Pilihan)



OpenBLAS boleh membantu operasi matrix CPU.



Install:




CODE
sudo apt install libopenblas-dev






cmake

Build:




CODE
cmake -B build \
-G Ninja \
-DCMAKE_BUILD_TYPE=Release \
-DGGML_BLAS=ON \
-DGGML_BLAS_VENDOR=OpenBLAS






shell

Kemudian:




CODE
ninja -C build






Nota Penting: CMake Cache



Jika pernah configure dengan:




CODE
-DGGML_BLAS=ON






kemudian buang option tersebut, CMake masih menyimpan konfigurasi lama.



Contoh masalah:



BLAS not found

missing: BLAS_LIBRARIES



Penyelesaian:




CODE
rm -rf build






Kemudian configure semula.



Sentiasa ingat:



CMakeCache.txt menyimpan konfigurasi lama.

Bahagian 5 — Cross Compile x86_64 → ARM64



Contoh:



PC Debian 12 x86_64

|

|

v

Orange Pi ARM64



Kelebihan:



Compile lebih cepat

Tidak membebankan SBC

Sesuai untuk production image



5.1 Install ARM64 cross compiler




CODE
sudo apt install -y \
gcc-12-aarch64-linux--gnu\
g++-12-aarch64-linux-gnu









CODE
sudo apt install -y \
gcc-13-aarch64-linux--gnu\
g++-13-aarch64-linux-gnu






Semak:




CODE
aarch64-linux-gnu-gcc --version






5.2 Configure cross build



Bersihkan dahulu:




CODE
rm -rf build-arm






Kemudian:




CODE
cmake -B build-arm \
-G Ninja \
-DCMAKE_BUILD_TYPE=Release \
-DCMAKE_SYSTEM_NAME=Linux \
-DCMAKE_SYSTEM_PROCESSOR=aarch64 \
-DCMAKE_C_COMPILER=aarch64-linux-gnu-gcc \
-DCMAKE_CXX_COMPILER=aarch64-linux-gnu-g++
5.3 Compile
ninja -C build-arm -j$(nproc)






Hasil:




CODE
ls build-arm/bin






Bahagian 6 — Semak Architecture Binary



Gunakan:




CODE
file build-arm/bin/llama-server






Contoh output berjaya:




CODE
ELF 64-bit LSB pie executable,
ARM aarch64,
dynamically linked






Maksud:



Output Maksud

ELF 64-bit Binary 64-bit

ARM aarch64 Untuk ARM64

dynamically linked Perlukan shared library

PIE executable Linux security hardening

Bahagian 7 — Semak Dependency .so

Jangan guna ldd untuk cross binary



Jika compile ARM64 tetapi check pada PC x86:




CODE
ldd llama-server






boleh gagal:




CODE
not a dynamic executable






Sebab:



PC:



x86_64 loader



Binary:



ARM64 loader

Gunakan readelf

aarch64-linux-gnu-readelf \

-d build-arm/bin/llama-server | grep NEEDED



Contoh:




CODE
Shared library: [libllama.so]
Shared library: [libggml.so]
Shared library: [libstdc++.so.6]






Cari semua .so




CODE
find build-arm -name "*.so"






Contoh:




CODE
libllama.so
libggml.so
libggml-base.so
libggml-cpu.so






Semak architecture:




CODE
file build-arm/bin/*.so






Output:




CODE
ARM aarch64
Bahagian 8 — Dynamic vs Static Binary






Semak:




CODE
file llama-server






Contoh dynamic:




CODE
dynamically linked






Perlu:



lib*.so



Contoh static:



statically linked



Tidak perlu .so.



Bahagian 9 — Installation ke Linux

Pilihan standard



Binary:




CODE
/usr/local/bin






Library:




CODE
/usr/local/lib






Contoh:




CODE
sudo cp llama-server /usr/local/bin/
sudo cp llama-cli /usr/local/bin/

sudo cp *.so /usr/local/lib/

sudo ldconfig






Pilihan appliance / embedded



Untuk SBC:




CODE
/opt/llama.cpp/

llama-server
llama-cli
libllama.so
libggml.so






Kemudian:




CODE
export LD_LIBRARY_PATH=/opt/llama.cpp






Sesuai untuk:



Orange Pi

kiosk AI

edge inference node



Bahagian 10 — Deploy ke Orange Pi



Copy:




CODE
scp build-arm/bin/llama-server \
orangepi:/usr/local/bin/









CODE
scp build-arm/bin/llama-cli \
orangepi:/usr/local/bin/






Jika perlu:




CODE
scp build-arm/bin/*.so \
orangepi:/usr/local/lib/






Pada Orange Pi:




CODE
sudo ldconfig






Semak:




CODE
uname -m






Expected:




CODE
aarch64






Bahagian 11 — Cadangan Production Architecture



Untuk sistem AI agent:



+----------------+

| Go Agent |

| Tool Router |

+-------+--------+

|

|

HTTP API

|

v

+----------------+

| llama-server |

| llama.cpp |

+----------------+

|

|

GGUF

Model



Kelebihan:



Go agent tidak perlu embed model

Model boleh tukar tanpa rebuild

llama.cpp boleh upgrade sendiri

Mudah scale ke banyak node

Kesimpulan



Workflow yang stabil:



Native

cmake -B build -G Ninja -DCMAKE_BUILD_TYPE=Release



ninja -C build

Cross Compile ARM64

sudo apt install gcc-aarch64-linux-gnu g++-aarch64-linux-gnu



rm -rf build-arm



cmake -B build-arm \

-G Ninja \

-DCMAKE_SYSTEM_NAME=Linux \

-DCMAKE_SYSTEM_PROCESSOR=aarch64 \

-DCMAKE_C_COMPILER=aarch64-linux-gnu-gcc \

-DCMAKE_CXX_COMPILER=aarch64-linux-gnu-g++



ninja -C build-arm

Verification

file llama-server



aarch64-linux-gnu-readelf -d llama-server | grep NEEDED



find . -name "*.so"



Dengan proses ini, satu mesin Debian 12/13 boleh menjadi build server untuk menghasilkan node AI ARM64 seperti Orange Pi, Raspberry Pi, atau edge inference appliance.

Vollständiger Original-Bericht
Ausführliche Details, Code-Beispiele & Hersteller-Stellungnahme auf dev.to.
↗ Original-Artikel auf dev.to lesen
Wie bewertest du diesen Beitrag?
1 Klick Feedback
Teilen mit Netzwerk & Team:

Community-Analysen & Experten-Meinungen 0

Verfasse deine eigene Analyse, teile Workarounds oder diskutiere diesen Vorfall im Blog.
Noch keine Community-Analyse verfasst. Markiere einen Textabschnitt oder klicke oben auf Eigene Analyse verfassen“!
Community Pulse: Relevanz-Einschätzung
1 Klick Experten-Votum
🔴 Akute Relevanz 0%
🟡 In Evaluierung 0%
🟢 Keine Auswirkung 0%
Spannende Innovation 0%
Verwandte Story-Cluster & Quellen (Vektor-KI)
Port 8095 Engine
3 Quellen
GPT-6 Astra Release Today? OpenAI’s Next Major AI Model Is Almost Here
1 Quelle
Apple accuses OpenAI of destroying evidence as trade-secrets fight intensifies
1 Quelle
Major AI platforms go down in unprecedented simultaneous outage
Ähnliche Beiträge
🔍 Verwandte News

Auch interessante Nachrichten Panduan Teknikal: Compile llama.cpp di Debian 12/13 dan Cross Compile ARM64

Thematisch verwandte Begriffe: Panduan, Teknikal, Compile, llamacpp · 6 Treffer

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...