大脑系统公司
Cerebras 打造了世界上最大的计算机芯片——晶圆级引擎,将整个人工智能处理器放置在一块餐盘大小的硅片上。
概述
It matters because this radical design slashes the time it takes to train and run large AI models.
深入探讨
Cerebras 成立于 2015 年,总部位于加利福尼亚州桑尼维尔,它采取了一个逆向赌注:它不会将数千个小型 GPU 连接在一起,而是构建一个巨大的芯片。其晶圆级引擎(WSE)是从整个硅晶圆上切割而成,而不是切成数百个小芯片。第三代 WSE-3 于 2024 年推出,将大约 4 万亿个晶体管和 90 万个 AI 优化核心封装在一块餐盘大小的硅片上。 Cerebras 将这些作为 CS-3 系统出售,并提供云推理服务。到 2024-2025 年,它以破纪录的推理速度而闻名,以每秒数千个令牌的速度运行 Llama 等开放模型,远远快于典型的 GPU 设置。
技术洞察
普通的芯片代工厂将圆形硅晶圆切成许多小芯片。相反,Cerebras 将整个晶圆保留为一个芯片,然后使用冗余核心和巧妙的布线来解决通常会毁坏单个芯片的制造缺陷。将所有内容保留在一块晶圆上意味着数据通过片上线路在内核之间移动,而不是缓慢的外部网络,从而为人工智能工作负载提供巨大的内存带宽并显着降低延迟。
战略影响
供应商策略
供应商路线图会影响您的团队接下来可以构建的功能。
成本与预算
商业条款和部署选项会影响长期成本和风险。
风险与安全
公司激励措施塑造了产品默认、安全态势和开放性。
Cerebras 系统的未来
Cerebras 已申请上市,并正在大力推动高速推理,并押注对快速、实时人工智能响应的需求将与对培训的需求相抗衡。预计未来的晶圆级世代将具有更多的内核和内存,与模型实验室和政府的合作将更加深入,并且 GPU 主导的市场面临的压力将越来越大。它面临的挑战是扩大制造规模、软件成熟度和客户采用率,以对抗英伟达等根深蒂固的竞争对手。
现实世界的实施
以每秒数千个令牌的速度运行 Llama 等开源大型语言模型,以实现超快速的聊天机器人和代理响应
通过避免多 GPU 集群的网络瓶颈,更快地训练大型语言和科学模型
为制药和国家实验室研究合作伙伴提供药物发现和分子模拟支持
充当主权人工智能项目的计算骨干,例如在中东的大规模部署
风险与防护栏
发布公告可能会超过实际生产工作流程的稳定性。
API 定价或政策转变可能会在一夜之间打破假设。
单一供应商依赖性增加了锁定和迁移成本。
实施路线图
使用您自己的任务和数据集评估提供商。
在集成之前查看隐私、安全和法律条款。
维护跨模型或供应商的后备计划。
监控发行说明,以便路线图的更改不会让团队感到意外。
不断探索
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Cerebras Systems quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
常见问题
What is Cerebras Systems?
Cerebras 打造了世界上最大的计算机芯片——晶圆级引擎,将整个人工智能处理器放置在一块餐盘大小的硅片上。这很重要,因为这种激进的设计缩短了训练和运行大型人工智能模型所需的时间。
Cerebras 晶圆级发动机的设计有何不同寻常之处?
Cerebras 将整个硅晶圆保留为一个巨大的芯片,而不是将其切割成许多小芯片,从而创建了一个餐盘大小的处理器。
为什么将所有核心保留在一块晶圆上有助于提高 AI 性能?
片上通信远远快于单独芯片之间的网络,为人工智能工作负载提供巨大的带宽和低延迟。
WSE-3 大约包含多少个晶体管?
第三代晶圆级引擎封装了大约 4 万亿个晶体管,这是通过使用整个晶圆实现的巨大数量。
到 2024 年至 2025 年,什么将成为 Cerebras 的标志性优势?
Cerebras 因以每秒数千个令牌运行大型语言模型而闻名,远快于典型的 GPU 部署。
Cerebras 如何处理如此巨大芯片上的制造缺陷?
由于在整个晶圆上有些缺陷是不可避免的,Cerebras 建立了冗余,因此芯片可以绕过坏区域并仍然正常工作。