ወደ ዜና ተመለስ
ምርትAI Understanding አጭር መግለጫ

Google Gemini 3.8 Flash TTS ሞዴሎችን አስጀምሯል

Google DeepMind ብጁ የድምጽ ፈጠራን እና SynthID የውሃ ምልክትን በማሳየት በGoogle DeepMind Gemini 3.8 Flash TTS እና Flash-Lite TTSን ለቋል።

4 min readRead the primary source
Source-provided image accompanying Google launches Gemini 3.8 Flash TTS models
ዋና-ምንጭ ሰነድምንጭ ተመዝግቧል
አታሚ
deepmind.google
ምንጭ አገናኝ
deepmind.googlehttps://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech/
የምንጭ ዓይነት
ዋና ሰነድ - ኦፊሴላዊ ማስታወቂያ ፣ ወረቀት ፣ ፋይል ወይም የመጀመሪያ ወገን ገጽ በቀጥታ እናነባለን።
አውድይህንን በ60 ሰከንድ ውስጥ ይረዱት።

እዚ ጀምር

ቁልፍ ቃላት

ኤፒአይ (የመተግበሪያ ፕሮግራሚንግ በይነገጽ)
አንድ የሶፍትዌር ስርዓት ከሌላ ስርዓት ጥያቄዎችን ለመላክ እና ምላሽ የሚቀበልበት የተቀናጀ መንገድ።
የውሃ ምልክት ማድረግ
ሊታወቅ የሚችል ምልክት በ AI የመነጨ ጽሑፍ ወይም ሚዲያ ውስጥ በመክተት በኋላ በማሽን እንደተመረተ ሊታወቅ ይችላል።
ቤንችማርክ
የሞዴል አፈጻጸምን ለመለካት እና ለማነፃፀር የሚያገለግል ደረጃውን የጠበቀ ሙከራ ወይም የውሂብ ስብስብ።
እራስህን ፈትን።AI ሞዴሎች የተብራሩ ጥያቄዎች

ምን ተፈጠረ

Google DeepMind ሁለት አዲስ የጽሑፍ-ወደ-ንግግር ሞዴሎችን Gemini 3.8 Flash TTS እና Gemini 3.8 Flash-Lite TTS መውጣቱን አስታውቋል። እነዚህ ሞዴሎች ወዲያውኑ በGoogle AI ስቱዲዮ እና በGemini API በኩል እንደ Agora፣ LiveKit እና Vercel ካሉ የመሣሪያ ስርዓቶች ውህደቶች ጋር ይገኛሉ። ልቀቱ የGemini ኦዲዮ ቤተሰብን ያሰፋዋል፣ ብጁ የገጸ-ባህሪይ ድምፆችን የማፍለቅ እና የመድረክ ላይ ንግግርን በትክክል የማድረስ ችሎታን ይጨምራል።

Google DeepMind Gemini 3.8 Flash TTS እና Gemini 3.8 Flash-Lite TTSን አስተዋውቋል፣ በGemini ቤተሰብ ውስጥ በጣም ገላጭ የድምጽ ትውልድ ሞዴሎች እንደሆኑ ገልጿል። እነዚህ ሞዴሎች የድምጽ ማመንጨትን ከስታቲክ ቅድመ-ቅምጦች ወደ ተለዋዋጭ የፈጠራ ስቱዲዮ እንደሚቀይሩ ማስታወቂያው ገልጿል፣ ይህም ብጁ የገፀ ባህሪ ድምፆችን ለመፍጠር እና የትዕይንት ውይይት አቅጣጫ።

ሞዴሎቹ ከዛሬ ጀምሮ በ Google AI ስቱዲዮ ውስጥ ይገኛሉ፣ እሱም እንደ የድምጽ ዲዛይን የስራ ቦታ ይሰራሉ። ተጠቃሚዎች ከባዶ ጀምሮ አዲስ የድምፅ ማንነቶችን መጠየቅ ወይም የራሳቸውን ድምጽ ማባዛት፣ ከዚያም በመስመር-በመስመር ማድረስ ለመምራት ባለሁለት ተናጋሪ ስክሪንፕሌይ አርታዒን መጠቀም ይችላሉ። እንደ Agora፣ LiveKit፣ Pipecat እና Vercel ያሉ የገንቢ መድረኮች የንግግር ማመንጨት ልምዶችን እንዲገነቡ እና እንዲያሰማሩ የሚያስችል በGemini ኤፒአይ በኩል ተደራሽነት ይሰጣል።

Google Gemini 3.8 Flash TTS በHume AI's Voice Design ላይ #1 አጠቃላይ ቦታን በ71.4 ውጤት እንደሚያስገኝ እና በ60.8 ነጥብ በድምፅ ሞዴሊንግ ይመራል። ሁለቱም ሞዴሎች በHume AI አጠቃላይ የጥራት መረጃ ጠቋሚ ላይ #1 እና #2 ቦታዎችን እንደጠበቁ ተዘግቧል። በVoice Arena ላይ በተደረጉ የጭፍን የሰዎች ምርጫ ግምገማዎች ሞዴሎቹ ከ100 በላይ ቋንቋዎችን በመደገፍ ጃፓንኛ፣ ብራዚላዊ ፖርቹጋልኛ፣ ቬትናምኛ፣ ዘመናዊ ስታንዳርድ አረብኛ፣ ሜክሲኮ ስፓኒሽ እና ሂንዲን ጨምሮ ቁልፍ በሆኑ የአለም ቋንቋዎች ከፍተኛ ቦታዎችን እንደሚይዙ ተነግሯል።

ልቀቱ ለድምፅ መባዛት ልዩ የደህንነት ስልቶችን ያካትታል፣ ድምጽ ከመፈጠሩ በፊት ተጠቃሚዎች ከድምጽ ባለቤቱ የቃል ፍቃድ ቀረጻውን ከማጣቀሻ ተናጋሪው ጋር የሚዛመድ ድምጽ እንዲሰጡ ይፈልጋል። በተጨማሪም፣ በእነዚህ ሞዴሎች የሚመነጨው እያንዳንዱ የኦዲዮ ክሊፕ የተሳሳተ መረጃን ለመከላከል በ AI የመነጨ ንግግር መታወቁን ለማረጋገጥ በተዘጋጀው በSynthID የውሃ ምልክት ተደርጎበታል።

የምንጭ ዝርዝሮች: deepmind.google

ለምን አስፈላጊ ነው።

ይህ ጅምር በ AI ድምጽ ማመንጨት ውስጥ ከስታቲክ ቅድመ-ቅምጦች ወደ ተለዋዋጭ፣ ሊበጅ ወደሚችል የድምጽ ፈጠራ ከፍተኛ ለውጥ ያሳያል። ገንቢዎች ሙሉ ለሙሉ አዲስ የድምጽ ማንነቶችን እንዲፈጥሩ ወይም የተወሰኑ ድምጾችን ከፈቃድ ማረጋገጫ ጋር እንዲደግሙ በማስቻል ሞዴሎቹ ለሚዲያ አካባቢያዊነት፣ ለውይይት ወኪሎች እና ለፈጠራ ይዘት ማምረት አዳዲስ እድሎችን ይከፍታሉ። የSynthID የውሃ ምልክት ማድረጊያን ማካተት በ AI የመነጨ የድምጽ የተሳሳተ መረጃ ላይ እያደጉ ያሉ ስጋቶችን ይመለከታል፣ ይህም ለይዘት ግልፅነት ቴክኒካዊ ጥበቃ ያደርጋል።

የእነዚህ ሞዴሎች መግቢያ ለገንቢዎች እና ኢንተርፕራይዞች በቋሚ የድምጽ ቅድመ-ቅምጦች ላይ ሳይመሰረቱ የበለፀጉ እና የበለጠ ገላጭ የኦዲዮ ልምዶችን ለመፍጠር መሳሪያዎችን ይሰጣል። ይህ ችሎታ በተለይ ለመገናኛ ብዙኃን አካባቢያዊነት ልዩ የሆኑ የክልል ዘዬዎችን ወይም ለውይይት ወኪሎች ወጥ የሆነ የምርት ድምፅ ለሚፈልጉ ኢንዱስትሪዎች ጠቃሚ ነው።

እንደ Figma፣ HeyGen፣ Linguana፣ Wondercraft፣ 99.co እና Ollang ካሉ ኩባንያዎች ጋር ያለው ሽርክና ዓለም አቀፋዊ ቅጂዎችን በማፋጠን እና የንግግር ድምጽ ወኪሎችን በመጠን ለማዳበር ፈጣን ተግባራዊ አተገባበርን ያመለክታል። ይህ የላቁ የTTS ችሎታዎችን ከዋና የፈጠራ እና የድርጅት የስራ ፍሰቶች ጋር ለማዋሃድ የሚደረግ እንቅስቃሴን ይጠቁማል።

ለድምጽ ማባዛት እና የSynthID የውሃ ምልክት አጠቃቀም ላይ ያለው አጽንዖት በአይ ኦዲዮ ማመንጨት ውስጥ ያሉ ወሳኝ የስነምግባር እና የደህንነት ስጋቶችን ይመለከታል። እነዚህ ጥበቃዎች ዓላማው የድምጽ ችሎታን ማንነት ለመጠበቅ እና የይዘት ግልጽነትን ለማረጋገጥ ነው፣ ይህም በአይ-የመነጨ ሚዲያ ይበልጥ እየሰፋ ሲሄድ ይበልጥ አስፈላጊ ነው።

Interactive Mechanism

በይነተገናኝ ሜካኒዝም፡ በትክክል እንዴት እንደሚሰራ

ከዚህ ልማት በስተጀርባ ያለውን ቴክኖሎጂ በይነተገናኝ ያስሱ።

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
በይነተገናኝ ጽንሰ-ሐሳብ ቼክ+10 Points
AI Models Explained Quiz

In AI, what are a model's "parameters"?

ቀጥሎ ምን እንደሚታይ

የእነዚህን ሞዴሎች እንደ ፊግማ እና ሄይጄን ባሉ አጋር ኩባንያዎች ለአለምአቀፍ ስያሜ እና የሚዲያ አካባቢያዊነት መቀበሉን ይከታተሉ። ለድምጽ መባዛት መከላከያዎች እና የSynthID ውጤታማነት በ AI የመነጨ ንግግርን በመለየት ረገድ ገለልተኛ ግምገማዎችን ይመልከቱ። በተጨማሪም፣ በGoogle AI ስቱዲዮ ውስጥ ያለው ባለሁለት ተናጋሪ ስክሪንፕሌይ አርታኢ በገንቢዎች ለተወሳሰበ የኦዲዮ ትረካዎች እንዴት ጥቅም ላይ እንደሚውል ይመልከቱ።

የገሃዱ ዓለም አፈጻጸምን እና የተጠቃሚን አቀባበል ለመገምገም የአጋር ኩባንያዎች እነዚህን ሞዴሎች ከምርታቸው ጋር እንዴት እንደሚያዋህዷቸው ተመልከታቸው።

የድምፅ መባዛት ፍቃድ ስልቶችን እና የሲንታይድ የውሃ ምልክቶችን መለየት የገለልተኛ ወገን ግምገማዎችን ይከታተሉ ምክንያቱም እነዚህ የቴክኖሎጂውን ደህንነት እና ታማኝነት ለማረጋገጥ ወሳኝ ናቸው።

በGoogle AI ስቱዲዮ ውስጥ ባለሁለት ተናጋሪ ስክሪንፕሌይ አርታዒ እድገትን ይከታተሉ ይህ ባህሪ ፈጣሪዎች የኦዲዮ ታሪኮችን እንዴት እንደሚቀርቡ ላይ ተጽእኖ ሊያሳድር የሚችል በ AI የመነጨ ንግግርን ለመምራት አዲስ በይነገጽን ስለሚወክል ነው።

ተዛማጅ መመሪያዎች እና ጥያቄዎች

AI ሞዴሎች ተብራርተዋልየAI ሥነ ምግባርAI ወኪሎችየሚያውቁትን ይሞክሩ - ነፃ የ AI ጥያቄዎችን ይሞክሩበእኛ የቃላት መፍቻ ውስጥ የ AI ቃልን ይፈልጉ
ይህ ጠቃሚ ሆኖ ተገኝቷል?