人工智慧基礎
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
免費人工智慧庫
1019 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。
從這裡開始
每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
有效率地使用人工智慧,同時保護隱私、檢查輸出並維持人類責任。
評估工作場所用例、運行安全試點、衡量價值並負責任地傳達變更。
透過權利、公平、治理、安全和公共利益結果來分析人工智慧系統。
透過實務系統設計,了解語言模型、檢索、代理、評估、成本及部署保障。
主題曲目
跳入您關心的領域。每條賽道都有多個簡單的英文指南。
全庫
1019 的 1019 顯示指南。按曲目過濾或上方搜尋。
詞幹擷取和詞形還原都將單字簡化為基本形式,以便「running」、「ran」和「runs」可以被視為一個概念。
語言人工智慧詞袋將文字轉換為忽略順序的字數統計,而 TF-IDF 對這些字數進行加權,因此罕見的、獨特的單字比常見的單字更重要。
視覺人工智慧視覺-語言-動作(VLA)模型是大型神經網絡,它接收相機影像和書面指令並直接輸出機器人馬達指令。
視覺人工智慧擴散策略將穩定擴散等影像產生器背後的相同去噪思想應用於機器人控制:而不是預測單一下一個動作...
基礎知識世界模型是一種神經網絡,它學習預測環境如何隨時間變化,讓人工智慧在行動之前「想像」未來的結果。
語言人工智慧神經模型比較文本的兩種方式:雙編碼器分別嵌入每個片段以進行快速搜索,而交叉編碼器將兩個文本一起讀取以獲得更高的…
語言人工智慧縮小文本的兩種策略:提取摘要逐字複製最重要的句子,而抽象摘要則寫入新的…
科技ROUGE 和 BLEU 是將機器產生的文字與人類參考進行比較的主要自動指標。
視覺人工智慧Make-A-Video 是 Meta 的 2022 年系統,可將文字提示轉換為短影片剪輯,而無需對標記的文字-影片對進行訓練。
視覺人工智慧Imagen Video 是 Google 的 2022 年文字轉視訊系統,它透過級聯七個擴散模型建立剪輯,每個模型都會添加更多幀或更高的解析度。
視覺人工智慧CogVideo (2022) 是第一個大規模開放的文本到視訊模型,CogVideoX (2024) 是清華/智普人工智慧的更強大的開源繼承者。
應用領域AI 母帶處理和混音工具分析音軌的頻率平衡、響度和動態,然後自動套用 EQ、壓縮和限制以使其...