Мащаб AI
Scale AI е компания, която доставя висококачествени етикетирани и курирани данни, които захранват съвременните AI модели.
Преглед
It matters because even the best algorithms are only as good as the data they learn from, and Scale built a business out of producing that data at industrial scale.
Дълбоко гмуркане
Основана през 2016 г. от Александър Уанг (тогава на 19 години) и Луси Гуо, Scale AI започна с етикетиране на изображения за самоуправляващи се автомобили – рисуване на кутии около пешеходци, автомобили и линии на платна. Той съчетава глобална човешка работна сила със софтуерни инструменти и машинно подпомагано етикетиране за анотиране на изображения, видео, текст, лидарни и сензорни данни. Тъй като генеративният AI избухна, Scale се насочи силно към данните за LLM: етикетиране на човешките предпочитания, обучение за подсилване от човешка обратна връзка (RLHF), групиране на червени екипи и експертна оценка. Чрез своя Scale Data Engine и платформи като Outlier и Remotasks, той осигурява човешки анотатори по целия свят. Сред клиентите са производители на автомобили, водещи лаборатории за изкуствен интелект и правителството на САЩ чрез дейността му Scale AI в публичния сектор и отбраната.
Техническа информация
Стойността на Scale е превръщането на необработени, разхвърляни данни в чист тренировъчен сигнал. Неговият тръбопровод съчетава човешки анотатори с ML модели, които предварително етикетират данни, плюс слоеве за контрол на качеството, които улавят и коригират грешки. За LLM това означава генериране на подкани, писане на идеални отговори, класиране на резултатите от модела за RLHF и модели за стрес-тестове чрез red-teaming. Специализираните данни – математика на висше ниво, код, многоезично разсъждение – често изискват експертни етикети, поради което висококачествените данни, генерирани от хора, се превърнаха в оскъден и ценен вход.
Стратегическо въздействие
Vendor strategy
Пътните карти на доставчиците влияят на това какви функции вашият екип може да изгради по-нататък.
Cost and budget
Търговските условия и опциите за внедряване влияят върху дългосрочните разходи и риск.
Risk and safety
Стимулите на компанията оформят продуктовите стандарти, безопасността и откритостта.
Бъдещето на мащабния AI
Тъй като граничните модели изчерпват лесно изтрития уеб текст, търсенето се измества към експертни, гранични човешки данни и строга оценка – сладкото място на Scale. Очаквайте растеж в оценката на модела, тестването на безопасността, сравнителния анализ на агентите и държавните договори, наред с напрежението, тъй като някои големи лаборатории изграждат вътрешни екипи за данни или разчитат повече на синтетични данни. Мащабът навлиза и в приложенията за оценка като услуга и отбраната. Неговият дългосрочен залог: че надеждният AI винаги ще се нуждае от внимателно измерени, базирани на хора данни и независима оценка.
Внедряване в реалния свят
Компания за автономни превозни средства плаща на Scale, за да етикетира лидарни данни и данни от камери, очертавайки автомобили и пешеходци за модели на възприятие.
Една гранична лаборатория за изкуствен интелект използва Scale за RLHF, като човешките оценители класират отговорите на чатбота, за да приведат в съответствие модела.
Правителствена агенция сключва договор със Scale за оценка и екипиране на AI система за безопасност и надеждност.
Разработчик на модели наема експерти от Scale, за да напишат примери за математика и кодиране за висше образование, за да подобрят разсъжденията.
Рискове и предпазни огради
Съобщенията за стартиране може да изпреварят стабилността в реалните производствени работни процеси.
Ценообразуването на API или промените в политиката могат да разбият предположенията за една нощ.
Зависимостта от един доставчик увеличава разходите за заключване и миграция.
Пътна карта за изпълнение
Оценявайте доставчиците, като използвате вашите собствени задачи и набори от данни.
Прегледайте поверителността, сигурността и правните условия преди интегриране.
Поддържайте резервен план за модели или доставчици.
Наблюдавайте бележките по изданието, така че промените в пътната карта да не изненадват екипите.
Продължете да изследвате
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Scale AI quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Next guide
Суно
Frequently asked questions
What is Scale AI?
Scale AI е компания, която доставя висококачествени етикетирани и курирани данни, които захранват съвременните AI модели. Има значение, защото дори най-добрите алгоритми са толкова добри, колкото и данните, от които се учат, а Scale изгради бизнес от производството на тези данни в индустриален мащаб.
Какъв основен проблем решава предимно Scale AI за разработчиците на AI?
Бизнесът на Scale AI произвежда висококачествени етикетирани и курирани данни, тъй като моделите са толкова добри, колкото и техните данни.
Върху какъв тип данни фокусира върху етикетирането Scale AI, когато стартира?
Мащабът започна с етикетиране на изображения и сензорни данни за автономни превозни средства, като боксиращи пешеходци и автомобили.
Какво означава RLHF, скала за услуги, предоставяна за LLM?
RLHF е Reinforcement Learning from Human Feedback, където хората класират резултатите, за да приведат в съответствие модел.
Защо експертните данни, генерирани от хора, стават все по-ценни?
Тъй като лесните уеб данни изчезват, граничните модели се нуждаят от експертни, висококачествени човешки данни – специалността на Scale.
Чрез кои платформи Scale извлича своите глобални човешки анотатори?
Scale използва платформи като Outlier и Remotasks, за да набира и управлява човешки анотатори по целия свят.