HƯỚNG DẪN công ty

Groq

Groq là một công ty phần cứng xây dựng LPU (Bộ xử lý ngôn ngữ), một con chip tùy chỉnh được thiết kế để chạy các mô hình ngôn ngữ AI ở tốc độ cực cao.

Đọc trong 2 phútCập nhật lần cuối

Tổng quan

It matters because it delivers some of the fastest inference available, generating hundreds of tokens per second for low-latency AI applications.

Lặn sâu

Được thành lập vào năm 2016 bởi Jonathan Ross, cựu kỹ sư Google, người đã giúp tạo ra TPU, Groq tập trung vào suy luận AI hơn là đào tạo. LPU của nó sử dụng kiến ​​trúc xác định, được lập lịch bằng phần mềm được gọi là Bộ xử lý truyền phát Tensor, trong đó trình biên dịch lên kế hoạch trước cho mọi hoạt động thay vì dựa vào bộ lập lịch phần cứng động và bộ nhớ đệm lớn. Khả năng dự đoán này giúp loại bỏ tắc nghẽn và cho phép Groq phục vụ các mô hình ngôn ngữ lớn như Llama với tốc độ tạo mã thông báo cao đáng kể với độ trễ thấp, nhất quán. Groq cung cấp quyền truy cập thông qua GroqCloud, nơi các nhà phát triển có thể chạy các mô hình mở phổ biến thông qua API. Lưu ý rằng công ty Groq khác với chatbot Grok của Elon Musk, mặc dù có cùng tên.

Hiểu biết kỹ thuật

Không giống như GPU xử lý công việc với nhiều lõi cộng với hệ thống phân cấp bộ nhớ phức tạp và lập lịch động, LPU có tính quyết định: trình biên dịch lên lịch tĩnh cho mọi lệnh và chuyển động dữ liệu, do đó thời gian hoàn toàn có thể dự đoán được. Nó sử dụng SRAM trên chip thay vì bộ nhớ ngoài chậm hơn để có băng thông cao và các chip được thiết kế để liên kết với nhau để các mô hình lớn truyền qua nhiều LPU. Luồng dữ liệu được sắp xếp hợp lý này là yếu tố cho phép suy luận số lượng mã thông báo mỗi giây rất cao của Groq.

Tác động chiến lược

Chiến lược nhà cung cấp

Lộ trình của nhà cung cấp ảnh hưởng đến những tính năng mà nhóm của bạn có thể xây dựng tiếp theo.

Chi phí và ngân sách

Các điều khoản thương mại và các lựa chọn triển khai ảnh hưởng đến chi phí và rủi ro dài hạn.

Rủi ro và an toàn

Các biện pháp khuyến khích của công ty định hình các tình trạng vỡ nợ của sản phẩm, trạng thái an toàn và tính cởi mở.

Tương lai của Groq

Khi các tác nhân AI thời gian thực, trợ lý giọng nói và giao diện trò chuyện yêu cầu phản hồi tức thì, tốc độ suy luận sẽ trở thành một chiến trường cạnh tranh và Groq được đặt ở vị trí ngang tầm với GPU Nvidia và các công ty khởi nghiệp chip AI khác. Kỳ vọng Groq sẽ mở rộng công suất GroqCloud, hỗ trợ ngày càng nhiều mô hình lớn hơn cũng như nhắm mục tiêu triển khai AI cho doanh nghiệp và chủ quyền. Xu hướng rộng hơn là sự phân chia ngày càng tăng giữa phần cứng đào tạo và phần cứng suy luận cực nhanh, chuyên dụng được tối ưu hóa để phục vụ các mô hình ở quy mô với giá rẻ.

Triển khai trong thế giới thực

Hỗ trợ các chatbot có độ trễ thấp, phản hồi gần như ngay lập tức với các câu hỏi của người dùng

Chạy trợ lý giọng nói theo thời gian thực trong đó việc tạo văn bản nhanh giúp giảm bớt những khoảng dừng khó xử

Phục vụ các mô hình mở như Llama ở tốc độ cao thông qua API GroqCloud

Cho phép các tác nhân AI kết nối nhiều cuộc gọi mô hình một cách nhanh chóng mà không có độ trễ chậm trên mỗi bước

Rủi ro & lan can

Thông báo ra mắt có thể vượt xa sự ổn định trong quy trình sản xuất thực tế.

Việc định giá API hoặc thay đổi chính sách có thể phá vỡ các giả định chỉ sau một đêm.

Sự phụ thuộc vào một nhà cung cấp làm tăng chi phí khóa và di chuyển.

Lộ trình thực hiện

1

Đánh giá các nhà cung cấp bằng cách sử dụng các nhiệm vụ và bộ dữ liệu của riêng bạn.

2

Xem lại các điều khoản về quyền riêng tư, bảo mật và pháp lý trước khi tích hợp.

3

Duy trì kế hoạch dự phòng giữa các mô hình hoặc nhà cung cấp.

4

Theo dõi ghi chú phát hành để những thay đổi về lộ trình không gây ngạc nhiên cho các nhóm.

Tiếp tục khám phá

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Groq quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Bắt đầu bài kiểm tra

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Câu hỏi thường gặp

What is Groq?

Groq là một công ty phần cứng xây dựng LPU (Bộ xử lý ngôn ngữ), một con chip tùy chỉnh được thiết kế để chạy các mô hình ngôn ngữ AI ở tốc độ cực cao. Điều này quan trọng vì nó cung cấp một số suy luận nhanh nhất hiện có, tạo ra hàng trăm mã thông báo mỗi giây cho các ứng dụng AI có độ trễ thấp.

LPU của Groq có nghĩa là gì?

LPU là viết tắt của Ngôn ngữ xử lý đơn vị, chip của Groq được thiết kế để chạy các mô hình ngôn ngữ nhanh.

Chip của Groq chủ yếu được tối ưu hóa cho phần nào của quy trình làm việc AI?

Groq tập trung vào suy luận, phục vụ các mô hình đã được đào tạo ở tốc độ rất cao thay vì đào tạo.

Đặc điểm xác định kiến trúc của LPU là gì?

LPU sử dụng một thiết kế xác định trong đó trình biên dịch lập lịch trình tĩnh cho mọi hoạt động, giúp cho thời gian có thể dự đoán được và nhanh chóng.

Ai đã thành lập Groq và công việc đáng chú ý trước đây của ông là gì?

Groq được thành lập bởi Jonathan Ross, người trước đây đã giúp phát triển Bộ xử lý Tensor (TPU) của Google.

GroqCloud cung cấp những gì?

GroqCloud cho phép các nhà phát triển chạy các mô hình AI phổ biến thông qua API trên phần cứng LPU nhanh của Groq.