Posts in English
@maddad Thank you.
New business cards. Haven't had any in a fair few years, but been at events lately where it makes sense to have something to hand over.

I don’t believe I’ve ever had time to “jump on a quick call”.
Benefits and risks of synthetic video and audio.
In this one-minute video I am speaking seven languages. In truth, I can speak two of those. None of the audio is actually me speaking, even if it sounds very much like my voice. And the video? Despite what it looks like, that’s not me moving my mouth. In some ways impressive and in other ways quite unsettling.
To make this happen I made a two-minute recording of myself talking in English about random stuff, and uploaded this as input to the generative tool provided by a service known as HeyGen. That video provided a voiceprint that can be used for more than 25 languages and counting. And honestly, the generated English voice really does sound like me.
With regards to the video, the scene where I appear to be standing is where I was actually standing when I recorded the original video. But the head, hand, eye and lip movements are all generated based on what I want my digital twin, or puppet, to say. I type text into a box and then the video with me, speaking in the selected language, comes out.
For purposes of firing up the mind to imagine what’s possible, this will likely suffice.
https://vimeo.com/875449365
In my latest blog post/newsletter I unpack the benefits and risks of this technology:
https://axbom.com/synthetic-video-benefits-risks/
#AIEthics #DigitalEthics #SyntheticVideo #DeepFake
I videon nedan, en minut lång, pratar jag sju språk. Egentligen kan jag bara tala två av dem. Inget av ljudet du hör är faktiskt jag som talar, även om det låter väldigt mycket som min röst. Och videon? Trots hur det ser ut är det inte jag som rör på munnen. På vissa sätt imponerande och på andra sätt tämligen obehagligt.
🔗 Compilation: Synthetic video and audio
För att uppnå det här resultatet gjorde jag en två minuters-inspelning av mig själv när jag pratade på engelska om vardagliga saker. Jag laddade upp denna som input till det generativa verktyget som tillhandahålls av en tjänst som kallas HeyGen. Den videon gav ett röstavtryck som kan användas för ett växande antal språk, idag mer än 25. Och ärligt talat, den genererade engelska rösten låter verkligen som jag.
När det gäller videon, så är scenen där jag ser ut att stå faktiskt där jag stod när jag spelade in originalvideon. Men huvud-, hand-, ögon- och läpprörelser genereras alla baserat på vad jag vill att min digitala tvilling, eller docka, ska säga. Jag skriver text i en ruta och tillbaka får jag en video med mig, talandes språket som texten skrevs på.
Observera också att tjänsten inte har några problem med rörelse i bakgrunden, vilket är något jag ville testa.
Din personliga docka kommer att säga vad som helst
För att vara tydlig: jag använder budgetversionen av den här tjänsten. Låt oss säga att jag vill ha en helkroppsversion av mig själv med anpassningsbara bakgrunder. Jag skulle åstadkomma det genom att spela in några minuter av mig själv när jag pratar i en green screen-studio. Lite dyrare, men inte alls krångligt
I syfte att väcka dina fantasi till att föreställa sig vad som är möjligt är detta förmodligen tillräckligt.
Jag kan se fördelar här för många typer av roller. Utbildare, chefer och presentatörer som behöver göra tillkännagivanden eller korta handledningar. En digital docka kan också helt enkelt läsa upp mötesprotokoll eller rapporter för personer som helst inte vill – eller inte kan – läsa.
Fördelar
Vissa fördelar är lätta att ta till sig:
- Det finns inget behov av omtagningar eftersom det inte förekommer stamning, stakande eller snubblande över ord. Tekniskt strul lyser också med sin frånvaro och tidsbesparingarna blir därför kolossala.
- Om jag vill ändra ett ord i det jag säger i videon betyder det att jag bokstavligen bara ändrar ordet i manuset. Ljudet av min virtuella röst förändras inte över dagen som det gör i verkligheten, där jag ofta måste spela in långa segment igen för att inte dra uppmärksamhet till skillnader i röstläge.
- Jag behöver inte sätta upp en kamera, fixa belysningen eller ens klä på mig. Den visuella scenen är redan etablerad. Kom ihåg att du kan skapa ett konto för att ha ett urval av scener för olika tillfällen. Du behöver bara en två minuters källvideo för varje scen.
- Jag kan skapa versioner av samma video på flera språk, inklusive de jag inte kan. Ja, denna nytta kan förstås leda till en rad problem.
Risker
Vilka är då riskerna?
- Om du automatiskt översätter till språk du inte behärskar kan ditt budskap bli grammatiskt felaktigt, förvirrande eller till och med kränkande på sätt som du inte hade tänkt dig. Att ha någon språkkunnig som ansvarar för kvalitetssäkring är fortfarande ett måste.
- Okonventionella uttal kommer sannolikt att hända då och då också, och hände mig när jag skapade en svensk röst. Jag behärskar förstås språket och blev inte jätteimponerad av hur vissa ord uttalades. Eller vilka ord som valdes vid automatisk översättning. Du måste anta att detta sker för alla språk.
- Människor kan känna sig lurade och tappa förtroendet om du inte är transparent med vad som verkligen pågår. Tydlighet kring teknikanvändning kommer att ha betydelse. Och även när folk är medvetna kan de känna att du tar ohederliga genvägar och inte lägger ner förväntat arbete. Ditt specifika sammanhang kommer att ha betydelse.
- Överanvändning. Ja, när något är enkelt nog är det troligt att det kommer att sättas i bruk i många situationer där det faktiskt inte är så användbart eller relevant. Detta påverkar också den långsiktiga kvaliteten, och tilliten hos mottagarna.
- När du använder en tredjepartstjänst se till att du förstår hur – och under vilka omständigheter – materialet du använder som input (dina videor och ditt textinnehåll/manus) kan användas av leverantören för att finjustera tjänsten. Du vill försäkra dig om att inget känsligt innehåll hamnar på oönskade platser och att du inte avsäger dig rättigheter för andra att använda din avbild.
- Vem får styra din digitala tvilling? Den smidiga och friktionsfria upplevelsen av att ha en virtuell docka som du enkelt kan delegera kontroll över till andra kan naturligtvis slå tillbaka. Du kanske plötsligt tycker att din avbild säger saker som du inte riktigt har gått med på. Och om tillit blir ett problem, hur kommer förtroendet för den här typen av virtuella presentationer påverkas över tid?
Utöver dessa risker så kommer syntetisk video naturligtvis också att fungera som verktyg för missbruk och övergrepp. Jag nämnde kort att kontrollen över någons digitala tvilling innebär att du kan ge sken av att de säger vad som helst – och lura ett stort antal människor. Detta kan innefatta allt från smaklösa skämt till att få någon att hetsa till våld eller häva ur sig rasistiska kommentarer.
När det gäller övergrepp vill jag öka medvetenheten om det faktum att många unga kvinnor utsätts för att bli virtuella skådespelare i pornografiska filmer mot sin vilja, med mycket liten makt att invända eller ställa förövare inför rätta. Och även om lagar och tillsynsåtgärder förbättras, är många liv redan förstörda så snart det kränkande innehållet publiceras. Om du någon gång stöter på dylikt innehåll, rapportera det alltid till polisen omedelbart.
Tänk på hur ... men också varför och när och vem ... och varför inte
Fler och fler individer och organisationer kommer sannolikt att använda generativ programvara för att producera syntetisk video. Om du tror att det finns fördelar för dig och din verksamhet bör du sätta igång att lära dig. Men du måste också överväga och hantera användningsfall där transparens, pålitlighet och risker spelar in. Ett felsteg kan radera alla upplevda fördelar på några sekunder, om tilliten går förlorad.
Kanske viktigast av allt är nog att du själv bara som varandes en människa på den här planeten förmodligen måste vara medveten om just detta: det är enkelt och billigt nu för vem som helst att använda någon annans ansikte och få dem att säga vad som helst. På vilket språk som helst.
Listan över fördelar och risker i den här artikeln är inte uttömmande. 🧰
Det finns metoder och verktyg för att avslöja etiska dilemman och hantera dem. I Elementen inom AI-etik hittar du en kartläggning av potentiella skador som kan hjälpa dig att styra ditt arbete. Element som inte nämns i detta inlägg är till exempel miljöpåverkan och exploatering av arbetare. Säg till om jag kan hjälpa till som rådgivare.
P.S. Jag lutar mer och mer åt att kalla det dockvideo, eller marionettvideo, snarare än syntetisk video. Vad tycker du?
Alla filmer 🎬
Här finns fullängdsversionerna av filmerna med mig som säger samma meddelande på sju olika språk. Jag har också inkluderat en version av mig som talar svenska med min egen röst, för att kunna jämföra. Videon för det klippet genereras alltså baserat på min riktiga röst, och det kan vara bra att veta att det också är ett alternativ att använda ljud som ingång för videoskapandet.
Hitta tillbaka? 🕵️
Originalet till dessa nyhetsbrev publiceras alltid på min egen blogg för att inte vara beroende av LinkedIn som plattform för synlighet, arkivering och fortlevnad. Där hittar du också tips på vidare läsning, och en hel del av mina produktioner i andra format.
I veckans nyhetsbrev kan du se och höra mig tala sju språk. Fem som jag inte kan. Och inget av ljudet är egentligen jag som pratar. Ja, inte är det mina huvud- och läpprörelser heller förresten.
Så vad kan du egentligen lita på, och hur ska du förhålla dig till att video nu allt oftare går att skapa på syntetisk väg? Jag går igenom fördelar och nackdelar med det som jag lutar åt att kalla för dockvideo, eller marionettvideo.
#DigitalEtik #AIetik
Benefits and risks of synthetic video and audio.
In this one-minute video I am speaking seven languages. In truth, I can speak two of those. None of the audio is actually me speaking, even if it sounds very much like my voice. And the video? Despite what it looks like, that’s not me moving my mouth. In some ways impressive and in other ways quite unsettling.
To make this happen I made a two-minute recording of myself talking in English about random stuff, and uploaded this as input to the generative tool provided by a service known as HeyGen. That video provided a voiceprint that can be used for more than 25 languages and counting. And honestly, the generated English voice really does sound like me.
With regards to the video, the scene where I appear to be standing is where I was actually standing when I recorded the original video. But the head, hand, eye and lip movements are all generated based on what I want my digital twin, or puppet, to say. I type text into a box and then the video with me, speaking in the selected language, comes out.
For purposes of firing up the mind to imagine what’s possible, this will likely suffice.
In my latest blog post/newsletter I unpack the benefits and risks of this technology:
https://axbom.com/synthetic-video-benefits-risks/
#AIEthics #DigitalEthics #SyntheticVideo #DeepFake
”You’re naive, Per.”
”No. Naive is a construct. I choose love, kindness and compassion over surrendering to the invisible forces of perpetual growth. I’m winning every day.”
@marcusosterberg Jag har en teori om hopplöshetens grepp. Nästan alla förstår klimatkrisens hopplöshet, även om det för många är undermedvetet, och mycket av det vi ser är försvarsmekanismer. Man “bygger sin båt” och förbereder sig för att skydda sina närmaste. Man känner spontant att alla inte får plats i båten så man vill avgränsa. För vissa innebär paniken att man tar till våld, både i ord och handling.
Får mig att tänka på Den oändliga historien av Michael Ende, en av mina favoritböcker. Ingentinget – ett mörker – bara växer.
Hoppet får inte överge oss. Jag tror att människor komma stiga fram och hjälpa oss hitta det igen. Vi får plats i varandras båtar, i samtalen, i värmen av varandras närvaro. Vi hänger alla ihop.
När ledsamhet tynger oss måste vi kämpa, och kämpa för varandra. Och våga be om hjälp. Vi mår bra av att kämpa och hjälpa.
Det här var vara mina spontana reflektioner… som jag tydligen behövde skriva av mig. 😊
Nope, I won't write an analysis of Andreessen's manifesto. Attention is what he craves. He'll live rent-free in my head for as briefly as possible.
I'll just leave this emoji here and let that be my final word on the matter…
🤮
Shut the door on your way out, Marc.
DN:s ledarredaktion träffade otäckt rätt idag. Allt känns surrealistiskt. Och ja det räcker nästan med att läsa ingressen…
https://www.dn.se/ledare/akesson-vill-lasa-in-minderariga-pa-livstid-kristersson-tycker-inget-sarskilt/

The idea appears to be to let computers exponentially proliferate some of the tasks they excel at: numbers, statistics, labelling people, copying, collecting data and mass surveillance. Rather than sit down and talk about how we boost the values we as humans wish to proliferate: compassion, love, care, connection and belonging.
Few are talking about how the former is antithetical to the latter.
I’m not saying ”stop using computers”, I’m saying ”stop letting computers assume the leadership position”. Computers can act as aids for compassion, love, care, connection and belonging. Think of games, text-to-speech and long-distance communication. But computers arrive there by instruction code from humans. Not the other way around.
The more alarming truth is this: computers can be used to destroy compassion, love, care, connection and belonging much faster than we can keep up with building it. Sometimes that destruction is with intent, but often it is oblivious.
Building machines
to perform tasks
we should have eliminated…
@april Haha, fair point. Though there aren’t many cars, or even places, without cameras anymore.
We've really made things efficient for highway robbers if they can just put a traffic cone on the hood, or place their own bespoke stop sign on the road, to stop the self-driving cars and rob whoever is inside.
At least it's efficiency for everyone.
Only humans can engage in increasing workplace efficiency for a century and end up working more.
Only humans can increase the number of methods and opportunities for communication exponentially, and end up feeling more lonely.
@Teucer Same, but at least they’re not powered up, like all the other useless data (photos and documents) that are consuming energy every second just to exist in the cloud, but will never be used again. 😕