Результаты поиска
Материал из MachineLearning.
По запросу «Llama»
Страницы с названием «Llama» не существует.
Для получения более подробной информации о поиске на страницах проекта, см. справочный раздел.
Ниже показаны 15 результатов, начиная с № 1.
Просмотреть (предыдущие 20) (следующие 20) (20 | 50 | 100 | 250 | 500)
Нет совпадений в названиях статей
Совпадения в текстах статей
- Нейросеть (21 133 байта)
60: ... современных LLM: GPT, Claude, Gemini, Llama, DeepSeek. Однако их главный не...
113: ...развитие открытых моделей (Llama, DeepSeek, Qwen), делающих передов... - Большая языковая модель (34 506 байт)
8: ...ких систем, как GPT, Claude, Gemini, Llama, DeepSeek и Qwen. Они рассматрива...
81: === Llama 4 (Meta) ===
82: ...продолжающее линию Llama 2 и 3. Llama 4 доступна в широком диапаз...
102: | Llama 4 || Meta || Открытые веса || Тек... - Двойной спуск (49 365 байт)
121: ...х LLM (таких как [[GPT|GPT-4]] или [[Llama]]) на гигантских корпусах т... - Закон масштабирования нейронных сетей (27 690 байт)
21: ...обучения (модели семейств [[LLaMA]], [[Mistral]] и [[Gemma]] стали замет...
59: ...е модели нового поколения (LLaMA-7B на 1T токенов, Mistral-7B, Gemma) и...
84: * [[LLaMA]] - Квантование нейронных сетей (27 481 байт)
132: ... используемый в экосистеме llama.cpp для запуска квантованны...
163: ... квантованных LLM на CPU через llama.cpp. - Фундаментальная модель (47 646 байт)
163: После появления семейств Llama, Mistral, Gemma и других открытых ...
280: * [[Llama]]; - Позиционное кодирование (8877 байт)
28: ...дов, применяется в моделях LLaMA, GPT-NeoX и стал фактическим ст... - RAG (16 812 байт)
45: ...екодер (T5, BART) или decoder-only (GPT, LLaMA). - Глубокое обучение (21 502 байта)
54: ...ыковых моделей (GPT, Claude, Gemini, Llama, DeepSeek). Однако их главный не... - Генеративная модель (24 683 байта)
105: ...ыковых моделей (GPT, Claude, Gemini, Llama) и всё чаще используются дл... - Малые языковые модели (14 896 байт)
48: ... также компактные версии '''Llama''', '''Qwen''' и '''Mistral'''. Ветвь ра... - Авторегрессионная модель (26 377 байт)
60: ... семейства GPT (GPT-3], GPT-4, GPT-4o), LLaMA, Mistral и множество других ис... - Позитивные и негативные сценарии развития ИИ (21 794 байта)
12: ...елей семейства GPT, Gemini, Claude, Llama и DeepSeek на базе архитектуры ... - Эффект края (15 560 байт)
47: ...дели семейства GPT, Claude, PaLM и Llama. - Адаптация низкого ранга (LoRA) (21 017 байт)
81: ... позволил дообучить модель LLaMA-65B на одной видеокарте с 48 Г...
106: ...ткрытых моделей (таких как LLaMA, Falcon, Mistral). LoRA позволил энту...
111: ...и для обучения LLM (Axolotl, Unsloth, LLaMA-Factory) используют LoRA как мет...
Просмотреть (предыдущие 20) (следующие 20) (20 | 50 | 100 | 250 | 500)

