Kaip naudoti „Twitter“ asmeniniams duomenims gauti

Jūsų „Twitter“ srautas (ir netrukus „Facebook“ sienos įrašų istorija) yra gausus informacijos apie jus šaltinis arba, atsižvelgiant į tai, kad dauguma „Twitter“ žinučių yra vieši, apie ką nors kitą. Tai apima viską nuo jūsų kalbos modelių ir temų, kurias apsėsti, iki jūsų tikrų draugų tapatybės – bent jau tviteryje. Triukas yra jį atrakinti.





Pirmas žingsnis norint įsiskverbti į pasąmonę – atsisiųsti reprezentatyvų savo tviterių pavyzdį. Laimei, „Twitter“ saugo paskutinius 3 200 iš jų, o tai tikriausiai yra daugiau nei jūs kada nors skelbėte, nebent esate ypač vaisingas.

Vienas paprastas būdas atsisiųsti visus tuos tviterius yra prisiregistruoti gauti tokią paslaugą kaip BackupMy.Net , kuris paims visus turimus tviterius (iki tos 3 200 ribos) ir leis juos atsisiųsti įvairiais formatais.

Antras žingsnis, įsigykite nemokamą kopiją TextWrangler (jei naudojate „Mac“) arba jo Windows atitikmuo . Jei naudojate „Linux“, „vi“ arba „emacs“ gali padaryti viską, ką aš aprašysiu.



Trečias veiksmas, pradėkite filtruoti savo tviterių korpusą. Pagalvokite apie tai kaip apie šlapio molio kauburėlį. Galite užduoti bet kokius jums patinkančius klausimus. Štai ko aš paklausiau savo; Jei turite kitų idėjų, palikite jas komentaruose.

i) Ištrinkite visas kitas eilutes, kad pašalintumėte visų tų laiko ir datos žymų triukšmą. Teksto meniu „TextWrangler“ turi galingą funkciją Proceso eilutės, kuriose yra…. Šiuo atveju tai leidžia ištrinti kiekvieną eilutę, kurioje yra eilutė +0000, kuri, mano manymu, yra tuščias kintamasis, į kurį paprastai patenka geografinės vietos duomenys. Jei jūsų „Tweets“ yra geografinėje vietovėje, tiesiog ieškokite kiekvienų metų, kuriais rašėte „Twitter“, darant prielaidą, kad dažnai neįtraukiate metų į savo tviterius.

Tai:



Tampa taip:

Dabar įklijuokite gautą tekstą į Wordle , žodžių debesies generatorius, nes žodžių debesys yra tiesiog puikus būdas įsivaizduoti žodžių dažnį.

Iš pirmo žvilgsnio tai nėra blogai – kai kurie jūsų pomėgiai ir draugai matomi bandantys žvilgtelėti į šlamštus žodžius, kuriuos mes visi naudojame „Twitter“, pvz., RT.



ii) Naudodami paprastą radimo ir pakeitimo komandą, atsikratykite RT, via ir kitų žodžių, kurie jums nieko nesako. Dabar galite pamatyti, kuo esate apsėstas. Buvau apsėstas klimato kaitos, naujienų madingų žodžių (naujas, dabar) ir, matyt, signalizuojantis apie sarkazmą ir ironišką distanciją sakinio fragmentus pradėdamas žodžiu, matyt.

iii) Norėdami gauti grynesnį savo kalbos modelių ir neurozių distiliatą, naudokite komandą Process Lines Containing… arba jos atitikmenį, kad pašalintumėte visas eilutes, kurios yra retweets.

iv) Jei norite sužinoti, kas yra jūsų tikrieji draugai „Twitter“ (ir, kiek mažiau, apie ką su jais kalbate), ištraukite visas eilutes, kuriose yra @.



Jei norite žinoti, ką sakote kalbėdami su draugais, tiesiog ištrinkite kiekvieną žodį, prasidedantį @. Arba surūšiuokite dokumentą, kad galėtumėte užfiksuoti tik kiekvieną pokalbį, kurį kada nors turėjote su konkrečiu asmeniu, ir paverskite *tą* žodžių debesimi.

v) Jei norite žinoti, kad kalbate, kai kalbate apie save, tiesiog ištraukite kiekvieną eilutę naudodami eilutę (skiriant didžiąsias ir mažąsias raides)

Žiniatinklyje yra daugybė įrankių, skirtų jūsų „Twitter“ srautui analizuoti dažnio analizė į emocinis turinys , bet, kiek žinau, visų savo tviterinių žinučių atsisiuntimas ir jų analizė yra vienintelis būdas vizualizuoti tikrąjį jų turinį tokiu specifiškumo lygiu. Esu tikras, kad yra daugybė užklausų, apie kurias net nepagalvojau, kad tai įmanoma naudojant šį metodą – nedvejodami palikite savo idėjas komentaruose.

Stebėkite Mims „Twitter“. arba susisiekite su juo el .

paslėpti