회사 가이드

라마 모델 가족

Llama는 누구나 무료로 다운로드, 실행 및 미세 조정할 수 있는 Meta의 개방형 대형 언어 모델 제품군입니다.

2분 읽기마지막 업데이트

개요

By releasing the weights publicly, Meta turned Llama into the foundation for a huge open-source AI ecosystem.

심층 분석

Llama(대형 언어 모델 Meta AI)는 Meta에서 개발한 일련의 변환기 기반 언어 모델입니다. 첫 번째 Llama는 연구 릴리스로 2023년 초에 도착했습니다. Llama 2(2023년 7월)에는 상업적 사용을 허용하는 허용 라이선스가 추가되었으며, Llama 3 및 3.1(2024)은 최고의 독점 시스템에 필적하는 4,050억 매개변수 모델을 통해 극적으로 확장되었습니다. 정의적인 특징은 Meta이 모델 가중치를 게시하므로 개발자가 자신의 하드웨어에서 Llama를 실행하고 사용자 정의하며 데이터를 외부 API로 보내는 것을 피할 수 있다는 것입니다. 이러한 개방성은 수천 개의 파생 모델과 도구를 탄생시켰습니다. Llama 모델은 다양한 크기(수십억에서 수천억 개의 매개변수)로 제공되며 기본 모델과 함께 명령에 맞춰 조정된 '채팅' 변형을 포함합니다.

기술적 통찰력

Llama 모델은 수조 개의 텍스트 및 코드 토큰에서 다음 토큰을 예측하도록 훈련된 디코더 전용 변환기입니다. 그들은 추론 속도를 높이기 위해 RMSNorm, SwiGLU 활성화, RoPE(회전 위치 임베딩) 및 그룹화된 쿼리 주의와 같은 효율성 중심 설계 선택을 사용합니다. 명령 조정 변형은 인간 피드백(RLHF)을 통한 감독 미세 조정 및 강화 학습을 통해 더욱 개선되어 사용자 프롬프트를 따르고 유용한 보조자 역할을 합니다.

전략적 영향

벤더 전략

공급업체 로드맵은 팀이 다음에 구축할 수 있는 기능에 영향을 미칩니다.

비용 및 예산

상업적 조건과 배포 옵션은 장기적인 비용과 위험에 영향을 미칩니다.

위험과 안전

회사 인센티브는 제품 기본값, 안전 태세 및 개방성을 형성합니다.

라마 모델 가족의 미래

Meta은 Llama를 더 큰 컨텍스트 창, 더 강력한 다국어 및 다중 모드 기능(비전 지원 변형이 이미 존재함), 더 엄격한 기기 내 효율성으로 추진하고 있습니다. 가격과 접근성 측면에서 더 넓은 시장에 압력을 가하는 지속적인 공개 릴리스와 함께 미세 조정된 도메인별 Llama 변종 생태계의 성장을 기대하세요. 라이센스 및 허용 가능한 사용 제한을 포함하여 '개방'이 무엇을 의미해야 하는지에 대한 논쟁은 이러한 강력한 가중치를 얼마나 자유롭게 사용할 수 있는지를 계속 형성할 것입니다.

실제 구현

스타트업과 연구원은 토큰당 API 비용을 지불하지 않고도 개인 데이터에 대해 Llama를 미세 조정하여 맞춤형 챗봇을 구축합니다.

개발자는 데이터가 건물 밖으로 나갈 수 없는 개인 정보 보호에 민감한 애플리케이션을 위해 노트북이나 서버에서 로컬로 더 작은 Llama 모델을 실행합니다.

기업에서는 교육에 맞춰 조정된 Llama를 코딩 보조자, 요약자 및 고객 지원 도구의 기반으로 사용합니다.

오픈 웨이트는 Code Llama 및 학술 연구에 사용되는 수많은 Hugging Face 파생물과 같은 커뮤니티 프로젝트에 힘을 실어줍니다.

위험 및 가드레일

출시 발표는 실제 생산 워크플로의 안정성보다 앞설 수 있습니다.

API 가격 책정이나 정책 변경으로 인해 하룻밤 사이에 가정이 깨질 수 있습니다.

단일 공급업체 종속성은 종속 및 마이그레이션 비용을 증가시킵니다.

구현 로드맵

1

자체 작업과 데이터 세트를 사용하여 공급자를 평가합니다.

2

통합하기 전에 개인정보 보호, 보안, 법적 약관을 검토하세요.

3

모델이나 공급업체 전반에 걸쳐 대체 계획을 유지합니다.

4

로드맵 변경으로 인해 팀이 놀라지 않도록 릴리스 노트를 모니터링하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Llama Model Family quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

다음 가이드

NVIDIA Cosmos World 재단 모델

자주 묻는 질문

What is Llama Model Family?

Llama는 누구나 무료로 다운로드, 실행 및 미세 조정할 수 있는 Meta의 개방형 대형 언어 모델 제품군입니다. Meta는 가중치를 공개적으로 공개함으로써 Llama를 거대한 오픈 소스 AI 생태계의 기반으로 만들었습니다.

Llama 제품군이 많은 경쟁 모델과 눈에 띄게 다른 점은 무엇입니까?

Llama의 특징은 Meta가 가중치를 공개적으로 해제하여 개발자가 모델을 실행하고, 미세 조정하고, 자체 호스팅할 수 있다는 것입니다.

'라마'라는 약어는 무엇을 의미합니까?

Llama는 Large Language Model Meta AI의 약자로 해당 목적과 작성자를 모두 반영합니다.

광범위한 상업적 사용을 허용하는 라이선스를 처음으로 추가한 Llama 릴리스는 무엇입니까?

2023년 7월에 출시된 Llama 2에는 연구 전용 첫 번째 릴리스와 달리 상업적 사용을 허용하는 보다 관대한 라이선스가 함께 제공되었습니다.

Llama 모델의 기반이 되는 아키텍처는 무엇입니까?

Llama 모델은 큰 텍스트 및 코드 말뭉치를 통해 다음 토큰을 예측하도록 훈련된 디코더 전용 변환기입니다.

사용자 프롬프트를 따르도록 Llama '채팅' 또는 지시 조정 변형이 어떻게 만들어 집니까?

지시에 따라 조정된 Llama 모델은 감독된 미세 조정 및 RLHF를 통해 개선되어 도움이 되고 신속하게 따르는 보조자 역할을 합니다.