ІнфраструктураПідрозділ
Моніторинг
Дві сторінки з чіткою межею між ними. Логування володіє записом: що фіксується і чи матиме відповідь питання, поставлене через три тижні. Алертинг починається там, де умова мусить дійти до людини, — а це питання про переривання людини, а не про пороги. Читайте в цьому порядку: не можна корисно алертувати на даних, які ви не структурували.
Що всередині
Усі сторінки цієї групи — і про що кожна з них.
З чого почати
Інше в цьому розділі
- ІнфраструктураІнфраструктура — це все, що перетворює код на щось працююче, за чим можна спостерігати, що можна змінювати й відкочувати. У розділі 11 тем у чотирьох групах: DevOps і пайплайн, який збирає один артефакт і просуває його незмінним; три великі хмари й те, як кожна стримує помилку; MLOps — ті самі задачі знову, але для моделі замість бінарника; і моніторинг, який робить інцидент відповідним на питання о третій ночі.
- DevOpsЯк довести зміну з машини розробника до працюючої системи — повторювано й без церемоній. Три теми, що складаються одна на одну: пайплайн, що вирішує, чи зміна безпечна; формат образу, який робить «у мене працює» перевірюваним твердженням; і планувальник, що тримає результат запущеним. Кожна сторінка про механізм, а не про синтаксис конфігурації інструмента, — саме механізм і переноситься при зміні інструментів.
- MLOpsУсе, що має бути правдою до того, як модель підпустять до продакшну, і все, що лишається правдою після. Три теми: пайплайн, що робить тренувальний запуск відтворюваним; шлях обслуговування, де затримка й вартість стають чиєюсь проблемою; і індекс, що робить пошук за схожістю достатньо швидким. Експлуатація саме LLM-фічі — це LLMOps, у розділі «Розробка».
Було корисно?
Поділіться з тим, хто працює над тією ж задачею.