Hệ thống não
Cerebras chế tạo chip máy tính lớn nhất thế giới, Wafer-Scale Engine, đặt toàn bộ bộ xử lý AI trên một miếng silicon có kích thước bằng chiếc đĩa ăn tối.
Tổng quan
It matters because this radical design slashes the time it takes to train and run large AI models.
Lặn sâu
Được thành lập vào năm 2015 và có trụ sở tại Sunnyvale, California, Cerebras đã đặt cược một điều trái ngược: thay vì kết nối hàng nghìn GPU nhỏ lại với nhau, họ sẽ tạo ra một con chip khổng lồ. Động cơ quy mô wafer (WSE) của nó được cắt từ một tấm wafer silicon hoàn chỉnh thay vì được cắt thành hàng trăm con chip nhỏ. WSE-3 thế hệ thứ ba, ra mắt vào năm 2024, chứa khoảng 4 nghìn tỷ bóng bán dẫn và 900.000 lõi được tối ưu hóa cho AI trên một miếng silicon có kích thước bằng một chiếc đĩa ăn tối. Cerebras bán chúng dưới dạng hệ thống CS-3 và cung cấp dịch vụ suy luận đám mây. Đến năm 2024-2025, nó được biết đến với tốc độ suy luận kỷ lục, chạy các mô hình mở như Llama với hàng nghìn mã thông báo mỗi giây, nhanh hơn nhiều so với các thiết lập GPU thông thường.
Hiểu biết kỹ thuật
Một xưởng đúc chip thông thường sẽ cắt một tấm wafer silicon tròn thành nhiều khuôn nhỏ. Thay vào đó, Cerebras giữ toàn bộ tấm wafer dưới dạng một con chip, sau đó sử dụng các lõi dự phòng và định tuyến thông minh để khắc phục các lỗi sản xuất thường làm hỏng từng khuôn. Giữ mọi thứ trên một tấm wafer có nghĩa là dữ liệu di chuyển giữa các lõi qua dây dẫn trên chip thay vì làm chậm kết nối mạng bên ngoài, mang lại băng thông bộ nhớ khổng lồ và độ trễ thấp hơn đáng kể cho khối lượng công việc AI.
Tác động chiến lược
Chiến lược nhà cung cấp
Lộ trình của nhà cung cấp ảnh hưởng đến những tính năng mà nhóm của bạn có thể xây dựng tiếp theo.
Chi phí và ngân sách
Các điều khoản thương mại và các lựa chọn triển khai ảnh hưởng đến chi phí và rủi ro dài hạn.
Rủi ro và an toàn
Các biện pháp khuyến khích của công ty định hình các tình trạng vỡ nợ của sản phẩm, trạng thái an toàn và tính cởi mở.
Tương lai của hệ thống Cerebras
Cerebras đã nộp đơn xin IPO và đang đẩy mạnh hoạt động suy luận tốc độ cao, đặt cược rằng nhu cầu về phản ứng AI nhanh, theo thời gian thực sẽ cạnh tranh với nhu cầu đào tạo. Mong đợi các thế hệ quy mô wafer trong tương lai có nhiều lõi và bộ nhớ hơn, mối quan hệ hợp tác sâu sắc hơn với các phòng thí nghiệm mô hình và chính phủ cũng như áp lực ngày càng tăng đối với thị trường thống trị bởi GPU. Thách thức của nó là mở rộng quy mô sản xuất, hoàn thiện phần mềm và sự chấp nhận của khách hàng trước các đối thủ cố thủ như Nvidia.
Triển khai trong thế giới thực
Chạy các mô hình ngôn ngữ lớn nguồn mở như Llama với hàng nghìn mã thông báo mỗi giây để có phản hồi đại lý và chatbot cực nhanh
Đào tạo các mô hình khoa học và ngôn ngữ lớn nhanh hơn bằng cách tránh tắc nghẽn mạng của các cụm đa GPU
Hỗ trợ việc phát hiện thuốc và mô phỏng phân tử cho các đối tác nghiên cứu dược phẩm và phòng thí nghiệm quốc gia
Đóng vai trò là xương sống điện toán cho các dự án AI có chủ quyền, chẳng hạn như triển khai quy mô lớn ở Trung Đông
Rủi ro & lan can
Thông báo ra mắt có thể vượt xa sự ổn định trong quy trình sản xuất thực tế.
Việc định giá API hoặc thay đổi chính sách có thể phá vỡ các giả định chỉ sau một đêm.
Sự phụ thuộc vào một nhà cung cấp làm tăng chi phí khóa và di chuyển.
Lộ trình thực hiện
Đánh giá các nhà cung cấp bằng cách sử dụng các nhiệm vụ và bộ dữ liệu của riêng bạn.
Xem lại các điều khoản về quyền riêng tư, bảo mật và pháp lý trước khi tích hợp.
Duy trì kế hoạch dự phòng giữa các mô hình hoặc nhà cung cấp.
Theo dõi ghi chú phát hành để những thay đổi về lộ trình không gây ngạc nhiên cho các nhóm.
Tiếp tục khám phá
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Cerebras Systems quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Hướng dẫn tiếp theo
Hệ thống tự lái Cruise
Câu hỏi thường gặp
What is Cerebras Systems?
Cerebras chế tạo chip máy tính lớn nhất thế giới, Wafer-Scale Engine, đặt toàn bộ bộ xử lý AI trên một miếng silicon có kích thước bằng chiếc đĩa ăn tối. Điều này quan trọng vì thiết kế cấp tiến này giúp giảm thời gian đào tạo và chạy các mô hình AI lớn.
Điều gì bất thường trong thiết kế của Động cơ quy mô bánh quế Cerebras?
Cerebras giữ toàn bộ tấm wafer silicon như một con chip khổng lồ thay vì cắt nó thành nhiều khuôn nhỏ, tạo ra một bộ xử lý có kích thước bằng một chiếc đĩa ăn tối.
Tại sao việc giữ tất cả các lõi trên một tấm wafer lại giúp tăng hiệu suất của AI?
Giao tiếp trên chip nhanh hơn nhiều so với kết nối mạng giữa các chip riêng biệt, mang lại băng thông lớn và độ trễ thấp cho khối lượng công việc AI.
WSE-3 chứa khoảng bao nhiêu bóng bán dẫn?
Công cụ quy mô wafer thế hệ thứ ba có khoảng 4 nghìn tỷ bóng bán dẫn, một con số khổng lồ được kích hoạt bằng cách sử dụng toàn bộ tấm bán dẫn.
Điều gì đã trở thành thế mạnh đặc trưng của Cerebras vào năm 2024-2025?
Cerebras nổi tiếng nhờ chạy các mô hình ngôn ngữ lớn với hàng nghìn mã thông báo mỗi giây, nhanh hơn nhiều so với việc triển khai GPU thông thường.
Cerebras xử lý các lỗi sản xuất trên một con chip khổng lồ như thế nào?
Bởi vì một số khiếm khuyết là không thể tránh khỏi trên một tấm wafer đầy đủ, Cerebras xây dựng dự phòng để con chip có thể định tuyến xung quanh các khu vực xấu mà vẫn hoạt động.