人工智能基金会
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
免费人工智能库
1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。
从这里开始
每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
在保护隐私、核查输出和保持人类问责的同时,高效使用人工智能。
评估工作场所用例,运行安全试点,衡量价值,负责任地沟通变更。
通过权利、公平、治理、安全和公共利益结果分析人工智能系统。
通过实用的系统设计,理解语言模型、检索、代理、评估、成本和部署保障。
主题曲目
跳入您关心的领域。每条赛道都有多个简单的英文指南。
全库
1019 的 1019 显示指南。按曲目过滤或在上方搜索。
词干提取和词形还原都将单词简化为基本形式,以便“running”、“ran”和“runs”可以被视为一个概念。
语言人工智能词袋将文本转换为忽略顺序的字数统计,而 TF-IDF 对这些字数进行加权,因此罕见的、独特的单词比常见的单词更重要。
视觉人工智能视觉-语言-动作(VLA)模型是大型神经网络,它接收相机图像和书面指令并直接输出机器人电机命令。
视觉人工智能扩散策略将稳定扩散等图像生成器背后的相同去噪思想应用于机器人控制:而不是预测单个下一个动作......
基础知识世界模型是一种神经网络,它学习预测环境如何随时间变化,让人工智能在行动之前“想象”未来的结果。
语言人工智能神经模型比较文本的两种方式:双编码器分别嵌入每个片段以进行快速搜索,而交叉编码器将两个文本一起读取以获得更高的……
语言人工智能缩小文本的两种策略:提取摘要逐字复制最重要的句子,而抽象摘要则写入新的……
技术的ROUGE 和 BLEU 是将机器生成的文本与人类参考进行比较的主要自动指标。
视觉人工智能Make-A-Video 是 Meta 的 2022 年系统,可将文本提示转换为短视频剪辑,而无需对标记的文本-视频对进行训练。
视觉人工智能Imagen Video 是 Google 的 2022 年文本转视频系统,它通过级联七个扩散模型构建剪辑,每个模型都会添加更多帧或更高的分辨率。
视觉人工智能CogVideo (2022) 是第一个大规模开放的文本到视频模型,CogVideoX (2024) 是清华/智普人工智能的更强大的开源继承者。
应用领域AI 母带处理和混音工具分析音轨的频率平衡、响度和动态,然后自动应用 EQ、压缩和限制以使其......