人工智能基金会
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
免费人工智能库
1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。
从这里开始
每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
在保护隐私、核查输出和保持人类问责的同时,高效使用人工智能。
评估工作场所用例,运行安全试点,衡量价值,负责任地沟通变更。
通过权利、公平、治理、安全和公共利益结果分析人工智能系统。
通过实用的系统设计,理解语言模型、检索、代理、评估、成本和部署保障。
主题曲目
跳入您关心的领域。每条赛道都有多个简单的英文指南。
全库
1019 的 1019 显示指南。按曲目过滤或在上方搜索。
DreamFusion 使用 2D 图像扩散模型作为批评者,从文本生成 3D 对象,从不训练任何 3D 数据。
视觉人工智能Magic3D 是 NVIDIA 针对 DreamFusion 的两阶段解决方案,可更快地生成更高分辨率、更详细的 3D 内容。
语言人工智能无分词器的模型放弃了单词片段的固定词汇,直接对原始字节进行操作,让一个模型可以处理任何语言、代码,甚至是嘈杂的......
语言人工智能函数向量是语言模型隐藏状态内的紧凑方向,用于编码整个任务,例如“翻译成法语”或“返回反义词”。
语言人工智能Best-of-N 采样从模型中生成多个候选答案,然后使用单独的评分步骤选择最佳答案。
音频人工智能StyleTTS 2 是一种文本转语音模型,它将语音“风格”(韵律、情感和说话者音色)视为使用扩散模型采样的随机变量……
音频人工智能FastPitch 是一种快速、非自回归的文本转语音模型,可显式预测每个输入标记的音调(基本频率),让您……
音频人工智能Voicebox 是 Meta 的文本引导语音生成模型,通过流匹配目标进行训练,以“填充”屏蔽音频,让一个模型执行零样本语音……
技术的SmoothQuant 是一种技术,可以将大型语言模型的权重和激活压缩为 8 位整数,而无需……
技术的结构化剪枝删除了神经网络的整个组件,例如注意力头、神经元或整个层,因此更精简的模型运行得更快......
技术的推测流和多令牌预测通过一次猜测多个未来令牌并在单个......中验证它们来加速语言模型的生成。
公司GPT-4.5 和 GPT-5 是 OpenAI 的旗舰大语言模型,为 ChatGPT 及其 API 提供支持。