TechCrunch opublikował glosariusz kluczowych pojęć ze სფერы sztucznej inteligencji — od AGI i dużych modeli językowych po agentów, halucynacje i nowe metody rozumowania. Redakcja zaznacza, że słownictwo branżowe szybko się rozszerza wraz z rozwojem modeli generatywnych i narzędzi automatyzacji. Modele, agenci i moc obliczeniowa
AGI, czyli ogólna sztuczna inteligencja, jest zwykle określana jako system zdolny wykonywać wiele zadań na poziomie wyższym niż przeciętny człowiek. Jednocześnie nie istnieje jedna definicja tego terminu: statut OpenAI, dyrektor generalny firmy Sam Altman oraz Google DeepMind opisują AGI nieco inaczej.
Agent AI to narzędzie zdolne samodzielnie wykonywać sekwencję działań, aby osiągnąć cel, na przykład rezerwować bilety, rozliczać wydatki lub pracować z kodem. Osobną kategorię stanowią agenci programistyczni, którzy mogą pisać, testować i debugować kod, choć rezultaty ich pracy wymagają weryfikacji przez człowieka.
Duże modele językowe, czyli LLM, są wykorzystywane przez popularnych asystentów AI, w tym ChatGPT, Claude, Gemini, Llama, Microsoft Copilot i Le Chat. Są to głębokie sieci neuronowe z miliardami parametrów, które uczą się związków między słowami i frazami na dużych zbiorach tekstów. Inferencja oznacza uruchomienie już wytrenowanego modelu w celu tworzenia prognoz lub odpowiedzi, a compute oznacza zasoby obliczeniowe, w tym GPU, CPU, TPU i inną infrastrukturę.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram. Trenowanie i kontrola odpowiedzi
Łańcuch rozumowania, czyli chain of thought, oznacza podział złożonego zadania na kroki pośrednie. Takie podejście może zajmować więcej czasu, ale pomaga zwiększyć dokładność odpowiedzi, w szczególności w zadaniach logicznych i programowaniu. Do metod doskonalenia modeli należą także dostrajanie na specjalistycznych danych oraz destylacja, gdy bardziej kompaktowy model uczy się odtwarzać zachowanie większego.
Halucynacjami nazywa się przypadki, gdy model generuje fałszywe informacje. Może to stwarzać ryzyko, zwłaszcza gdy system udziela błędnych porad w wrażliwych obszarach. Wśród innych pojęć w glosariuszu są modele dyfuzyjne do tworzenia obrazów, muzyki i tekstów, generatywne sieci przeciwstawne GAN oraz architektura Mixture of Experts, w której dla każdego zapytania aktywowana jest tylko część wyspecjalizowanych podsieci. Nieprzejrzysta rekurencja
TechCrunch osobno zwraca uwagę na opaque recurrence — 'nieprzejrzystą rekurencję'. W takim podejściu model nie tworzy rozumowania krok po kroku w zrozumiałym języku, lecz wielokrotnie przepuszcza to samo zapytanie przez wewnętrzne warstwy. Redakcja pisze, że może to być bardziej efektywne i pozwalać mniejszym modelom wykazywać wyższą wydajność przy niższych kosztach obliczeniowych, ale jednocześnie pozostawia mniej śladów rozumowania dostępnych do weryfikacji. Badacze bezpieczeństwa AI wiążą to z utrudnionym nadzorem nad zachowaniem modeli.
Czytaj nas na Telegram i Sends
Pobierz naszą aplikację
(0)Comments