Hur identifierar Alexa vem som talar?

Innehållsförteckning

  • Alexas befruktning
  • The Alexa Ecosystem – Din resa Röst
  • Hur känner Alexa igen din röst? – Röstprofiler
  • Föreslagen läsning
  • Amazons Alexa sparar röstprofilen för användare, från vilken den skapar akustiska modeller som är sparas i molnet. När den tar emot/hör ett nytt kommando, jämför den ingången med de akustiska modellerna och identifierar användaren.

    Tal är det naturliga läget kommunikation mellan människor. Om du ser en konversation flöda, blir det uppenbart hur enkelt vi kan prata, hur grundläggande det är för hur vi är. Och det med rätta, eftersom det möjliggör snabb överföring av information fylld med de rika nyanserna av språk, kultur, gester och ton.

    Det här inmatningsläget har till stor del varit oanvänt när det kommer till interaktion mellan människa och dator; för det mesta av vår kommunikation med datorer har vi använt tangentbord, mus och pekskärmar med våra tummar och fingrar.

    Detta är dock inte på grund av brist på fantasi, eftersom fiction har florerat med röstade personer som hjälper mänskliga huvudpersoner, från JARVIS som hjälper Tony Stark bygg en flygande bodysuit på nästa nivå i

    Iron Man

    till Samantha som hjälper huvudpersonen i Henne

    ta sig ur ett hjulspår och upptäck vad kärlek verkligen betyder.

    fiction har varit full av futuristisk rösthjälp. (Fotokredit: Siberian Art/Shutterstock)

    Även om det nuvarande tillståndet för röstassistans inte är i närheten av funktionerna hos JARVIS eller Samantha, har vi sett massmarknadsanpassningen av röstaktiverade enheter under de senaste åren. Bland dessa är den marknadsledare som har utplånat sin konkurrens och har 70 % av marknadsandelen i USA Amazon Echo.

    Den låter dig spela musik och spel, beställa saker från Amazon, ställa in påminnelser, streama podcaster, göra att-göra-listor , och automatisera hembelysning, tillsammans med många andra funktioner som läggs till av Amazon eller tredjepartsutvecklare som bygger ovanpå Alexa-plattformen.

    Alla dessa funktioner drivs enbart av din röst! Frågan är, hur känner Alexa igen vem som ger kommandona? Låt oss försöka förstå sammanhanget kring Amazon Echo för att få en bättre uppfattning om hur denna magiska bakom kulisserna uppstår.

    Alexas befruktning

    Amazon började utveckla sina röstaktiverade smarta högtalare på sitt Lab126-kontor. Detta är helägt av Amazon, ligger i Silicon Valley och ansvarar för dess forskning, utveckling och datorhårdvara. Echo-enheten var tänkt 2010 som ett försök för Amazon att bredda sitt utbud från sin e-läsare Kindle.

    Enheten släpptes mycket senare och den första försäljningen var enbart inbjudan, även om den blev allmänt tillgänglig i juli 2015. I den första utgåvan , levererades enheten med en fjärrkontroll, eftersom det rådde otydlighet mellan skaparna om huruvida högtalaren ensam skulle räcka för att registrera röstkommandon. Efter att den första satsen av denna produkt användes av konsumenter blev det klart att enheten var skicklig på egen hand och fjärrkontrollen fasades ut i efterföljande utgåvor.

    Amazon Echo första generationen med fjärrkontroll. (Fotokredit: brewbooks /Wikimedia Commons)

    Väckningsordet (ordet som enheten väntar på att lyssna på innan ett kommando registreras) för enheten under utvecklingen av enheten var 'Amazon' och enheten var sig själv kallas Amazon Flash. Utvecklingsteamet ansåg dock att Amazon är ett mycket vanligt ord, ett som används i konversationer och under tv-reklam, så detta kan trigga enheten oavsiktligt och få den att beställa något från Amazon. De föreslog “Alexa” som vakenord och Amazon Echo som enhetsnamn, vilket verkar som ett beslut som har lönat sig. Med det sagt kan en användare ändra väckningsordet till “Amazon”, “Echo” eller “Dator” om de vill.

    Enheten har anammats helhjärtat, inte bara av konsumenter utan även av utvecklare. I september 2019 var antalet färdigheter som Alexa kunde utföra 100 000, som alla är beroende av det robusta ekosystem som Amazon har byggt.

    Alexa Ecosystem – Din rösts resa

    I januari 2019 rapporterade Amazon att de hade sålt 100 miljoner Alexa-enheter. Alexa är integrerad i många av produkterna som släpps av Amazon, såväl som i tredjepartsprodukter. Amazon har skapat en plattform för röstaktiverade enheter och färdigheter från tredje part som utvecklare kan använda utan att behöva serverutrymme samtidigt som Alexa tränas för att utföra särskilda uppgifter.

    Ekoet i sig rymmer inte mycket av processorkraften för att känna igen kommandon och uppfylla dem. Den rymmer en rad mikrofoner med en cylindrisk högtalare. Bearbetningen sker genom den enorma infrastrukturen för cloud computing som Amazon redan har på plats – AWS (Amazon Web Services). En liten dator i enheten lyssnar hela tiden efter dess vakna ord, varefter den registrerar kommandot du ger.

    När du beordrar något till Alexa, skickar inombordsdatorn kommandot till molnet, som sedan tolkas av Alexa Voice Service (AVS) ). Kommandot bryts ner av AVS och nödvändiga åtgärder vidtas, beroende på kompetenstyp, nämligen om det är en intern färdighet eller en som utvecklats av en tredje part. Åtgärderna skickas sedan tillbaka till Echo och levereras till dig. Allt detta görs via ditt WiFi, på några sekunder, utan så mycket som en viskning till dig. Nästa intressanta bit kommer när den känner igen din röst!

    Bakom kulisserna

    Hur känner Alexa igen din röst? – Röstprofiler

    När du beordrar Alexa att utföra en viss uppgift inleder du ditt kommando med väckningsordet ('Alexa', 'Amazon', 'Echo' eller 'Dator'). Din röst identifieras som den analoga ingången i det här fallet och måste konverteras till ett digitalt format för att enheten ska förstå ditt kommando och utföra den nödvändiga åtgärden.

    Detta är där analog-till-digital-omvandlare kommer in, vilket Alexa gör med sin Automatic Speech Recognition (ASR). Denna djupinlärningsprocess gör det möjligt för Alexa att konvertera talade ljud till ord, vilket gör det till det första steget för att möjliggöra röstaktiverad assistans.

    När du börjar använda Alexa skapar den din unika röstprofil i sin databas, som lagras i molnet. Den här profilen är en samling av dina röstprover, som den använder för att skapa akustiska modeller av din rösts egenskaper. När du beordrar den framåt använder den dina akustiska modeller för att jämföra den med de inkommande röstproverna och verifierar om det faktiskt är du som talar i andra änden. Den använder samma process för att skilja mellan flera användare i samma hushåll.

    Automatisk taligenkänning möjliggör konvertering av talade ljud till ord. (Fotokredit: metamorworks/Shutterstock)

    När du kommer åt en tredjepartsapp med din röst, tilldelar den en numerisk identifierare för din röst till färdigheten, vilket gör att den kan skilja din röst från andra användare. Du kan anpassa dina inställningar för alla färdigheter som tillhandahålls av Alexa och tilldela olika privilegier till olika användare.Så varsågod, skapa din röstprofil och anpassa ditt Echo. Och om du inte har fått tag på en ännu kan du lära dig mer och hämta en här.

  • Föreslagen läsning

  • Kolla på Amazon

    Kolla på Amazon

  • Referenser
  • Amazon (länk 1)
  • Amazon (länk 2)
  • Amazon (länk 3)
  • ,,,,

    ,,,

    © 2026 THE FOREFRONT OF TECHNOLOGY - Theme by WPEnjoy · Powered by WordPress