Перейти к содержимому

Czy lokalny LLM na Mac mini M6 ma sens?

iMagazine PL

0:00 / 0:00

Czy lokalny LLM na Mac mini M6 ma sens?

1 531 просмотр · 7 часов назад
iMagazine PL
12,5 тыс. подписчиков
1 531 просмотр · 7 часов назад
Zostań wspierającym kanał i podcast na Patreonie:   / imagazinepl   🛍️ Fueran 4K/120 Dummy Adapter https://link.amazon/B05t2wRGs Czy lokalny LLM na Macu mini M6 ma w ogóle sens? Tym razem konfiguruję Maca mini jako headless server, czyli komputer działający bez monitora i klawiatury, do którego łączę się zdalnie z MacBooka Pro. Po drodze jest dummy HDMI, BetterDisplay i własna rozdzielczość 16:10, ale najważniejsza część zaczyna się później: AnythingLLM, oMLX, lokalny Qwen 3.5 9B, własna baza dokumentów i próba zbudowania prywatnego chatbota na podstawie transkrypcji podcastu. Sprawdzam, jak taki model radzi sobie z wyszukiwaniem konkretnych informacji, gdzie zaczyna halucynować, jak szybko działa na 24 GB RAM-u i czy rzeczywiście da się na nim sensownie pracować bez wysyłania danych do chmury. Wnioski są trochę brutalne: do prostych zadań, RAG-u i prywatnego przeszukiwania dokumentów lokalne AI ma sens, ale kiedy przyzwyczaimy się do współczesnych modeli online i agentów, powrót do małego lokalnego LLM-u potrafi boleć. Przy okazji pokazuję całą konfigurację, sposób działania embeddera, lokalnej bazy danych, cache, llama servera oraz wyjaśniam, dlaczego do poważniejszej zabawy z AI w Macu mini raczej wybrałbym 32 GB RAM-u niż 24 GB. Spis treści (timestamps): 00:00:00 Wstęo 00:00:14 Mac mini jako headless server 00:00:28 Dummy HDMI i zdalna praca bez monitora 00:01:37 BetterDisplay i własna rozdzielczość 16:10 00:02:23 Czy lokalny LLM na Macu mini ma sens? 00:02:55 Hermes, lokalne modele i ograniczenia 128 GB RAM-u 00:04:03 Prosty prywatny chatbot na 24 GB RAM-u 00:04:29 AnythingLLM i transkrypcje podcastu 00:05:12 Qwen 3.5 9B, oMLX i konfiguracja modelu 00:06:01 Pierwsze odpowiedzi i problemy z jakością 00:06:51 Jak działa lokalny RAG bez internetu 00:07:53 Test wyszukiwania informacji w transkrypcjach 00:10:45 Do czego lokalny LLM faktycznie się nadaje? 00:11:07 Konfiguracja oMLX, modelu i cache 00:11:58 Lokalna baza danych i embeddingi BGE-M3 00:13:05 Prywatność kontra możliwości modeli online 00:14:05 Mac mini M6 jako serwer do AI i transkrypcji 00:15:01 Jaką konfigurację RAM wybrać? 00:16:03 Lokalne AI czy ChatGPT? 00:16:13 Podsumowanie i dalsze testy Bądźmy w kontakcie: 👉🏻 WWW: https://imagazine.pl 👉🏻 Instagram:   / moridin   👉🏻 Mastodon: https://mastodon.online/@moridin Dzięki za oglądanie!