Nytt på bloggen: När din röst rymmer hemifrån
Att klona en röst kan göras med mindre än en minuts inspelning idag. Men har du koll på vem som använder din röst och till vad?
https://axbom.se/rost-klonad/
#DigitalEtik
Posts in English
Din dotter ringer från semestern och säger med panik i rösten att hon och hennes kompis har problem med en betalning. Snälla, du behöver Swisha kompisen så att de kan betala för hotellrummet. Vad gör du? Tryggast är att lägga på och ringa upp din dotter. Hur mycket det än låter som Sofia så kanske det inte alls är det.
Bedrägerier med klonade röster är på framväxt. Telefonsamtal där människor luras på pengar har en lång tradition, men det nya idag är att rösten i andra änden kan vara en röst du känner igen. Kanske en röst du delar bostad med.
Min podd-kollega James Royal-Lawson och jag har skämtat om att det finns flera hundra timmars ljudmaterial med våra röster från över ett decennium av poddande och föreläsningar som publicerats online. I mitt fall även på svenska. Det går att få våra röster att säga vad som helst. Jag har låtit min familj förstå dilemmat med detta.
Din röst är också i riskzonen
Men sanningen är att även din röst kan vara lika utsatt idag. De nya verktygen behöver bara en inspelad minut av din röst för att skapa en trovärdig kopia. Sextio sekunder. Ja, Microsoft påstår sig kunna göra det på tre. Sedan kan din röst säga vad som helst*.
*Än så länge är detta framför allt sant när det gäller engelsktalande röster. Men även denna utveckling får förstås hisnande snabbt och fler språk är runt hörnet.
Den som tänker att deras röst i alla fall inte finns inspelad i någon större utsträckning tänker säkert inte på alla samtal som spelas in i 'utbildningssyfte', alla video-möten man deltar på där man kanske ställer frågor, fester där det spelas in filmer eller alla de mikrofoner som finns närvarande i vår vardag hela tiden och kan aktiveras på distans. Det är nästan svårt att inte ibland spela in sig själv av misstag.
Din chef kallar in dig till sitt kontor och undrar vad du menade med ditt samtal igår kväll där du sa upp dig. Men du har inte alls ringt. Ett kul 'practical joke' av en kollega eller en föraning om värre saker som kan komma?
Vad kan hända?
I förra veckan kunde vi läsa om Jennifer som fick ett samtal av en kidnappare där hennes dotter först sa "Mamma, jag har gjort bort mig..." och sedan, under det att kidnapparen ställde sina krav, snyftade i bakgrunden "mamma, snälla, hjälp mig". Tilltaget lyckades inte då ett separat samtal verifierade att dottern befann sig trygg och säker hos en kompis. Men Jennifer var under samtalet helt övertygad om att det var hennes dotter i andra änden.
I Australien används röster för att verifiera identitet hos banker och hos skattemyndigheten. Det har visat sig att röstkloner kan användas för att lura systemen för att komma åt konton. Tack och lov behöver man också känna till en pin-kod, vilket kan hjälpa till att stoppa en stor del av försöken.
Men tänk på de gånger du blivit ombedd att bekräfta en prenumeration via en inspelning av din röst. Din röst. Som du förutsätter att ingen annan har.
En chat-tjänst på Telegram låter dig beställa swatting-tjänster som använder röstkloner. Det är ett fenomen där kriminella lurar en blåljus-tjänst till att skicka polis eller utryckningspersonal till någons adress. I senaste avsnittet av Cyber berättas om hur den används för att skicka utryckningsfordon till skolor som hotas av sprängdåd, av datorgenerade röster.
När vet du om nästa bedrägeri kommer innehålla en röst som tillhör dig eller någon i din närhet? Kan den egentligen sägas tillhöra dig längre?
Självklart finns goda användningsområden
Redan 2007 testade jag att använda en tjänst vid namn ReadSpeaker för att få mina blogginlägg upplästa. Det bidrog till att fler kunde ta del av mina texter och var självklart positivt för att öka tillgängligheten på min webbplats.
På samma sätt ger dessa verktyg en röstkvalitet som leder till än bättre tillgänglighet: det blir behagligare att lyssna till. Och det går även med dessa till exempel att göra om nyheter och artiklar till en podcast, utan att behöva yttra ett ord.
Jag som idag på egen hand läser in mina blogginlägg till en podcast skulle alltså kunna låta detta automatiseras. Än så länge håller jag mig försiktigt skeptisk till att själv gå den vägen, eftersom jag skulle förlora så många andra av fördelarna med att läsa högt, som kan förbättra såväl text som inläsning.
Om valet står mellan att göra text tillgänglig på ett automatiserat sätt (inte så gediget) och att inte göra det alls, så känns det spontant bättre att det faktiskt görs. Men ett skifte där klonade röster blir gängse får förstås effekten att många som arbetar med rösten som yrke (reklam, inläsning av böcker, dubbning med mera) får allt svårare att hitta arbete. Många av dessa personer har redan avtvingats rättigheter till sina egna röster(!)
Effektivisering behöver såväl eftertanke som omtanke
För kreatörer som jag själv finns det förstås ytterligare fördelar i att kunna erbjuda innehåll i flera format och på så sätt också nå fler med mitt innehåll på ett sätt som bättre passar den som läser eller lyssnar eller varvar mellan dessa format.
Och redan nu är det så att människor med funktionsnedsättningar som gör att de förlorar sin talförmåga kan erbjudas att kommunicera via tekniska verktyg med röster som de en gång haft eller som de önskar att de fått. En teknik känd som voice banking görs oerhört mycket mer effektiv när man inte behöver spela in flera timmar av sin röst. Även om det går att önska mer inkludering av personer med de faktiska behoven i dessa utvecklingsprocesser.
Men huruvida vi ska kunna generera nya låtar med kända artisters röster, och om du ska få låta avlidna personer i din närhet ge röst åt dina egna digitala assistenter, är förstås också sådant vi kommer behöva ta ställning till framöver. Spelar det någon roll om musiken vi lyssnar på är AI-genererad om vi inte vet om det?
Jag skulle trots allt önska att vi skyndade långsammare.
Riskmedvetenhet kräver transparens
Mitt budskap är som alltid att samtidigt som vi pratar om fördelar med digitalisering måste vi vara öppna och tydliga med alla problem som skapas. Det är först då vi blir bättre på att också bemöta, mitigera och hantera risker. Först då skapar vi det sociala trycket som tvingar företag att bli mer försiktiga i en annars otyglad framfart.
I min engelska podd Carefully kommer jag i nästa avsnitt använda en röstklon för delar av ljudet. Prenumerera om du vill försöka lista ut vilka delar av avsnittet som inte är jag som pratar, vilket avslöjas i slutet. Jag lägger ett exempel i den svenska podden Omtanke också.
Vi har en fördel i Sverige (många skulle säkert säga nackdel) och det är att dessa klon-verktyg har kommit betydligt längre när det gäller just engelska röster och uttal. Men det kan också invagga oss i falsk trygghet. Oavsett vilken falang man tillhör så ger det oss trots allt mer tid för reflektion kring lämpliga användningsområden innan den stora vågen av syntetiska röster slår emot oss. Och redan idag kan din röstklon tala mer än 30 språk.
Vad tänker du när du hör om den här utvecklingen? Vilka fördelar och risker ser du för dig själv och andra?
Ljudexempel
Exempel när min röst klonats från min engelskspråkiga podd:
🔗 Article Embed Content
Boosta din digitalisering
🔗 Digital drivkraft med Per Axbom
Nu kan du anlita mig 1, 2 eller 3 dagar i månaden på årsbasis. Jag förklarar varför det är det smartaste sättet att få tillgång till hela bredden av mina kunskaper och förmågor.
🔗 Mina podcaster
Lyssna på Per Axbom i flera poddar om omtänksam digitalisering. Engelska och svenska.
Att klona en röst kan göras med mindre än en minuts inspelning idag. Men har du koll på vem som använder din röst och till vad?
Way more dangerous than a jerk is a billionaire jerk who feels offended. Completely unpredictable with unjustified power and impact.
I'm not afraid of AI (not in the sense the manufacturers would have you be) but I am afraid of the inappropriate power of the billionaires backing their development.
Suppose it's time to write an open letter calling for a pause on giant billionaire experiments.
⚠️ Content Warnings
Reposting this, originally posted on my old account last November. As a reminder to myself as well:
I can appreciate content warnings (CWs). A lot. And I’m not a person who necessarily needs any for my wellbeing.
But I do often avoid opening posts that warn about ‘uspol’. That does make me feel better.
There are people who need CWs for their wellbeing. For reasons I do not always understand. And I do not *have* to understand. CWs remind me of that.
Content warnings are like adding a layer of compassion and consent, and I personally can not see a reason to object to that.
And if you truly do not need them, you can disable content warnings in settings under Sensitive Content. There's one setting for sensitive images and another for having post with CWs always expanded.
Imagine that, the compassionate setting is default and you still have control over changing it.
You can do more and actually set all images to hidden.
Quick sidenote: this is a great time to reflect on the best option for your wellbeing, before you change any settings.
@mmitchell_ai Made me spit out my drink... 😂
⚠️ Twitter covertly removing protections against hate speech
« Earlier this Month, Twitter Covertly Removed Section of Hateful Conduct Policy Protecting Transgender People from Targeted Misgendering and Deadnaming.
GLAAD statement: “Twitter’s decision to covertly roll back its longtime policy is the latest example of just how unsafe the company is for users and advertisers alike.” »
https://www.glaad.org/releases/glaad-responds-twitters-roll-back-long-standing-lgbtq-hate-speech-policy
@autiomaa @laurenshof
Yes, this is outlined in my original blog post 😊
https://axbom.com/world-map/
@laurenshof
It is fascinating isn't it? Another wonderful example that we could likely contribute to organisational silos:
The team working on Russia is likely not the same team as the one working on Africa. By one way of measuring the figure for Africa is correct (for the land mass continent straight across at the longest point). And for another way of measuring Russia it is correct (if you go across all bodies of water, including ocean and allow for a slanted measurement than a strictly horizontal one.) Both can be verified in their own way (almost) but there appears to be no standard for these types of measurements,
The interesting thing about the community notes though is that they did not set out to measure the lines in the image, they just went after answers in text and made an assumption. I can see how this is appealing... and likely also feels obviously correct because of the Mercator distortion.
But yes, I do wonder about the 9,000km figure for Russia and how that really got approved for Britannica.
Great way of illustrating how one distortion sticks and then the distortion supports further false assumptions. The high status of Britannica ensures that many simply won't believe the truth...
So Twitter now has Community Notes that are used to fact check other tweets. A person used my blog post about the world map to demonstrate how a longer line across Russia represents a distance that is actually shorter than a visibly shorter line across Africa.
In the Community Notes attached to that tweet it is stated that this is false, along with numbers of country/continent width that themselves are incorrect. But the original post actually isn't false. So the tool (Community Notes) designed to provide more trust is actually "debunking" actual truths and instead spreading the misinformation. And of course, Africa is as always a target of reduction.
Here ScafidiTravels shows how the original tweet is correct. Due diligence:
https://twitter.com/ScafidiTravels/status/1647463005024649217?s=20
I've now added all these details about the Russia-Africa controversy (regarding distance across East-West) to the blog post.
Direct link to the referenced section: https://axbom.com/world-map/#rudebate
@Loukas @Mabande
Gah vad frustrerande. Och det finns ju dessutom ett till konsumentperspektiv: säkerhet. Hur svårt kan det vara när man till och med i flygblad går ut och talar om exakt vad problemen är:
* Resenärer med funktionsnedsättning kan inte resa spontant eftersom rampservice nu måste förbokas.
• Resenärer kläms i dörrarna eftersom kamerabilderna är dåliga.
• Förseningarna ökar markant när föraren ska åtgärda alla störningar själv, eller vänta på att assisterande personal kommer åkande i bil.
• Ingen hjälp finns att få ombord, och trafikinformationen vid störningar uteblir helt när föraren har annat att prioritera.
Bara att läsa upp för lyssnarna! Lägger in dem här för alla andra som läser i tråden. 😊
https://vildstrejkpendeln.blogg.se/2023/april/flygblad.html
I'm just so tired of people reposting prompts and responses from ChatGPT as if they're showing off something novel. "Hey look at this profound synthetic text!" Can we fast forward through this maddening point in time please. I'm not coping well.
@lukaisunlucky
You can get an overview in @annaleen 's thread I think:
https://wandering.shop/@annaleen/110199740713221658
One concept I likely will be adding to The Elements of Digital Ethics is ”Linguistic Misdirection”. Very much inspired by @emilymbender ’s objections to the use of AI.
Do listen to this episode of Tech Won’t Save Us, where Bender and Marx towards the end get into ”how the tech industry uses language to trick us into buying its narratives about technology”: https://techwontsave.us/episode/163_chatgpt_is_not_intelligent_w_emily_m_bender
”Wishful Mnemonic” is the term Bender uses in the show. Coined by Drew McDermott in 1976.
She gives the example of Automatic Speech Recognition (falsely attributes cognition) which should just be Automatic Transcription.
Some other examples of terms that may give an impression of something going on that really isn’t:
- Cognitive Computing
- Machine Learning
- Neural Network
Would love to hear some more examples of misleading terminology in the tech space in general, if you’ve got them. ”Cloud”, ”Smart” and ”Autonomous” would absolutely qualify.
#AIHype #DigitalEthics #DoubleSpeak #NewSpeak #WishfulMnemonic
@jtrem
Here is a guide by @jamesmontemagno on how to accomplish this with IFTTT and Mastodon:
https://montemagno.com/automate-posting-to-mastodon-via-web-requests/amp/
I know I've seen other services that can be set up to do this as well.
#RSS2AP
Given all the controversy around Substack (again) I just want to promote the idea of self-hosting your own blog/newsletter using Ghost.
This allows you to set up your newsletter very much in the same way as Substack, with different tiers and a connection to Stripe. And it’s all yours, on your own domain, and without having to associate with bad actors.
While I myself don’t do paid tiers (I want all my content available openly), I have shared my way of setting up a VPS running Ghost within this blog post:
https://axbom.com/indieweb/
If I gauge enough interest I’m considering writing a post about only running a Substack alternative using Ghost..
#Indieweb #Substack
If a VPS is not your thing, and you want a really cheap option for just running a Ghost blog/newsletter with the possibility of paid subscription tiers, FastComet is the only hosting provider I know of that gives you a 1-click install of Ghost on a shared hosting solution.
Honestly, to get started in a day with a Ghost setup to replace Substack or any other newsletter/blog solutions I believe this could be the killer app. This currently starts at $2.19 per month.
https://www.fastcomet.com/ghost-hosting
#Indieweb #Substack
@Scmbradley
Inside Out, definitely.
So there is this film category, psychological thriller, that is supposedly different from just a thriller. But wouldn’t this suggest that we should also have psychological comedies and psychological romance films?
Anyway, that was my absurdist thought for the night. Wishing everyone a pleasant weekend.
Finally a well-versed walkthrough of how ChatGPT works that more people can take to heart. No we are not even close to something that "understands" our input. And maybe, just maybe, we can stop calling these things AI. But I won't hold my breath.
https://www.newyorker.com/science/annals-of-artificial-intelligence/what-kind-of-mind-does-chatgpt-have
#AIHype #DigitalEthics
Writing this book has been on my mind for two years now. By breaking it down into ~42 blog posts I think I can get it done in a reasonable amount of time.
Just getting started and will be scouting for publishers. Any words of advice are welcome.
Telling you all this so you can hold me accountable over the next 7 months. My goal is to finish writing by the end of the year. 😁
https://debook.axbom.com
#DigitalEthics #AIHype #ResponsibleInnovation
If you're curious about the content you can read a blog post of mine from March 2021 that covers all the elements (though a couple will be added for the book):
https://axbom.com/elements/