Безкоштовна бібліотека ШІ

технічний напрямніВільний назавжди.

177 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

177Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~6hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

177 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

технічний

Спекулятивне потокове передавання та прогнозування кількох токенів

Спекулятивне потокове передавання та прогнозування кількох токенів прискорюють створення мовної моделі, вгадуючи кілька майбутніх токенів одночасно та перевіряючи їх за один…

2 хв. читанняПрочитайте
технічний

BERTScore та семантична оцінка

BERTScore вимірює, наскільки добре згенерований машиною текст відповідає посиланню, порівнюючи значення, а не точні слова.

2 хв. читанняПрочитайте
технічний

Лінійні ядра уваги та виконавців

Лінійна увага замінює квадратичну м’яку максимальну увагу в Трансформерах на математичний трюк, який лінійно масштабується з довжиною послідовності.

2 хв. читанняПрочитайте
технічний

YaRN і розширення довжини контексту

YaRN (Yet another RoPE extensioN) — це ефективна техніка для розтягування придатного для використання контекстного вікна моделі далеко за межі того, на чому її навчали.

2 хв. читанняПрочитайте
технічний

Позиційна інтерполяція для тривалого контексту

Позиційна інтерполяція (PI) — це простий, впливовий метод, який розширює вікно контексту Transformer, стискаючи нові індекси позиції в діапазон…

2 хв. читанняПрочитайте
технічний

Суміш експертів LoRA

Комбінація LoRA Experts (MoLE) поєднує в собі багато невеликих, дешево навчених адаптерів із навченим маршрутизатором, щоб одна базова модель могла гнучко спеціалізуватися на…

2 хв. читанняПрочитайте
технічний

Спекулятивні редагування для моделей коду

Спекулятивні редагування роблять редагування коду ШІ миттєвим, передбачаючи, що більша частина файлу залишиться без змін, і перевіряючи лише невеликі частини, які відрізняються.

2 хв. читанняПрочитайте
технічний

Керування активацією та розробка представлення

Керування активацією підштовхує поведінку моделі шляхом прямого додавання або віднімання векторів у її прихованих активаціях під час виконання, без необхідності повторного навчання.

2 хв. читанняПрочитайте
технічний

Розріджені автокодери для інтерпретації

Розріджені автокодери (SAE) — це інструмент, який розбирає заплутані внутрішні активації нейронної мережі в набагато більший набір чистіших…

2 хв. читанняПрочитайте
технічний

Суперпозиція та полісемантичність у інтерпретації ШІ

Дізнайтеся про суперпозицію та полісемантичність у інтерпретації штучного інтелекту: чому моделі упаковують характеристики в спільні напрямки, чому нейрони стають полісемантичними…

2 хв. читанняПрочитайте
технічний

Logit Lens і Tuned Lens

Логіт-лінза та налаштована лінза — це методи інтерпретації, які шар за шаром переглядають приховані стани трансформатора, щоб побачити, що «думає» модель…

2 хв. читанняПрочитайте
технічний

Навчальні стеки DeepSpeed ​​і Megatron

DeepSpeed ​​(Microsoft) і Megatron-LM (NVIDIA) — це стеки програмного забезпечення, які створюють навчальні моделі з мільярдами параметрів на тисячах графічних процесорів…

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.