KursyWłasne AI na własnej karcie
Własne AI na własnej karcie
Od pierwszego modelu uruchomionego w przeglądarce po wyciśnięcie maksimum z karty, którą masz albo dopiero kupujesz.
Program
- Model w Twojej przeglądarce — teraz Uruchamiasz prawdziwy model bez instalowania czegokolwiek i widzisz prędkość na swoim sprzęcie. Podgląd
-
Co to w ogóle jest ten model Plik z liczbami. Skąd się biorą nazwy 7B i 27B i co z nich wynika dla Ciebie. 🔒
-
Pierwszy model na Twojej karcie Silnik, pobranie modelu, pierwsze pytanie. Koniec lekcji to działająca instalacja lokalna. 🔒
-
Ile naprawdę masz pamięci Karta ma 12 GB, do dyspozycji masz mniej. Co zjada pulpit i jak to odzyskać. 🔒
-
Kwantyzacja: jak 27 miliardów mieści się w 24 GB Po co obcina się liczby, co się przy tym traci i gdzie leży granica sensu. 🔒
-
Co się zmieści na Twojej karcie Wagi plus kontekst plus reszta. Liczymy budżet pamięci dla Twojego sprzętu. 🔒
-
Kupujesz kartę? Od budżetowej do zawodowej Co dostaniesz za 1500, 2500, 5000 i 10 000 zł. Używane karty i czego przy nich szukać. 🔒
-
Nie wstaje: czytanie komunikatów Pięć najczęstszych błędów i co naprawdę znaczą. Brak pamięci rzadko znaczy kup lepszą kartę. 🔒
-
Rozmowa też zajmuje pamięć Dlaczego model wstaje, a wywala się po dwudziestu minutach. Dobieranie długości kontekstu. 🔒
-
Działa, ale wolno Co tu właściwie trwa: liczenie pytania czy pisanie odpowiedzi. I co da się z tym zrobić. 🔒
-
Wzrok, głos i inne dodatki Model patrzący na obrazki potrzebuje drugiego modelu obok. Ile to kosztuje i kiedy odpuścić. 🔒
-
Zmierz u siebie i nie skłam sobie Własny pomiar i trzy sposoby, żeby wyszedł nieprawdziwy. Dlaczego cudze benchmarki są bezużyteczne. 🔒
-
Formaty i silniki: co daje ile Ten sam model, inny format i inny silnik. Kiedy różnica to 40 procent, a kiedy 160. 🔒
-
Długa pamięć czy kilka rozmów naraz Ta sama pamięć karty: albo bardzo długi kontekst, albo kilka sesji równolegle. 🔒
-
Kilka modeli, jeden komputer Przełączanie bez ręcznego ubijania, zwalnianie karty na czas gry, model do kodu obok modelu do rozmowy. 🔒
-
Podłącz to do czegoś Model w edytorze kodu, w oknie czatu i w skrypcie. Jeden wspólny sposób dostępu zamiast pięciu. 🔒
-
Po co w ogóle lokalnie Prywatność, koszty, brak limitów. Uczciwie też o tym, czego lokalnie nie zrobisz lepiej. 🔒
-
Co dalej Dokąd to rośnie i jak nie utknąć na konfiguracji sprzed roku. 🔒
Dla kogo jest ten kurs
Dla dwóch osób, które zadają to samo pytanie z dwóch stron:
- Masz kartę i chcesz z niej wycisnąć maksimum — bo dziś używasz jej na 30% możliwości i nie wiesz o tym.
- Rozważasz zakup i nie wiesz, czy warto — a każdy poradnik mówi co innego.
Co Cię tu nie spotka
Pięciu lekcji teorii, zanim cokolwiek zadziała. Pierwsza lekcja kończy się działającym modelem — zanim padnie słowo „kwantyzacja". Teoria wchodzi dopiero wtedy, gdy zaczyna Ci na niej zależeć.
Liczby, którym możesz zaufać
Każda liczba w tym kursie jest podpisana:
- ZMIERZONA — konkretna karta, konkretny dzień, opisane warunki pomiaru
- POLICZONA — arytmetyka pamięci, prawdziwa na każdym sprzęcie
- OSZACOWANA — wyliczona z przepustowości, z podanym sposobem liczenia
Nauczysz się też, jak mierzyć u siebie i jak rozpoznać trzy sposoby, którymi pomiar potrafi skłamać: pamięć podręczna udająca szybkość, nierozgrzany silnik i rozumowanie modelu wliczone w wynik. Bo liczba z cudzego benchmarku nie jest parametrem modelu — jest zapisem tego, co ktoś wtedy mierzył.
Program: 18 lekcji w pięciu krokach
- Zadziałało — model w przeglądarce, czym właściwie jest plik modelu, pierwszy model na Twojej karcie
- Twoja karta — ile naprawdę masz pamięci, jak 27 miliardów parametrów mieści się w 24 GB, co się u Ciebie zmieści i co kupić na jakim budżecie (z osobnym rozdziałem o kartach używanych)
- Kiedy nie działa — pięć najczęstszych komunikatów i co NAPRAWDĘ znaczą, dlaczego model wywala się po dwudziestu minutach rozmowy, co robić, gdy działa, ale wolno
- Wyciskanie maksimum — własne pomiary bez oszukiwania się, formaty i silniki, długi kontekst kontra kilka rozmów naraz, wiele modeli na jednym komputerze
- Na co dzień — podłączenie do edytora i czatu, uczciwy bilans lokalnie kontra chmura, co się zmienia szybko, a co zostanie
Ćwiczenia interaktywne — w przygotowaniu
Kurs ma dziś pełną treść osiemnastu lekcji. Ćwiczenia w emulowanym środowisku (diagnostyka błędów uruchomienia, kalkulator pamięci, przełącznik karty 12 / 16 / 24 / 32 GB) dochodzą etapami — kto kupi teraz, dostaje je bez dopłaty, tak jak przy pozostałych kursach na tej platformie.
Czego w kursie nie ma
Trenowania własnych modeli (to inny temat), budowania aplikacji na modelach (to warstwa wyżej) i rankingów „który model najlepszy" — te starzeją się w miesiąc. Zamiast tego uczymy mierzyć.
Dostęp do kursu
169 złPełny dostęp do wszystkich 18 lekcji, ćwiczeń i sprawdzianów, bezterminowo. Płatność BLIK-iem, przelewem albo kartą — dostęp aktywuje się od razu po zaksięgowaniu.
Kup dostęp — 169 zł Mam kod — załóż konto
Dla zespołu: jeden kod na dowolną liczbę miejsc — rozdajesz go ludziom, zamiast zakładać konta za nich. Napisz na kursy@aurora-tech.pl, ilu osób dotyczy.