Näytetään tekstit, joissa on tunniste Aila. Näytä kaikki tekstit
Näytetään tekstit, joissa on tunniste Aila. Näytä kaikki tekstit

12. marraskuuta 2025

FSD's AILA Service Portal 2.0: Current Updates from the Developers

The AILA service portal is a data deposit, discovery and delivery system for archived research data. I met with the development team to discuss the latest updates on the development work. Our conversation focused particularly on the background of the service’s development, its current stage, and the next steps.

What is AILA?

In addition to serving as FSD’s data catalogue, data deposits are also managed through AILA. The entire AILA service portal is developed in-house by FSD and was originally launched in May 2014. The current development of AILA 2.0 began as part of the Research Council of Finland-funded project Cross-Border Tools and Services (C-BOTS 2019–2024). For FSD and its clients, AILA is a central and essential service, and maintaining and developing it is one of the Archive’s core responsibilities. Metadata from AILA is harvested to the CESSDA Data Catalogue.

Why is AILA 2.0 being developed?

The reasons and objectives behind the development of AILA portal are based on several complementary perspectives, such as technical, user-oriented, and accessibility-focused considerations.

Societal changes affect all areas of activity in our society. With the advance of digitalisation, the pace of web application development has accelerated, customer needs have evolved, and accessibility requirements have increased. The development team emphasised that there was a recognised need to renew the technical environment to ensure that the AILA service portal can remain secure and interoperable in the future.

In addition, a key focus now and in the future is customer orientation, highlighting the need for a smoother and more accessible service.

Accessibility in the context of websites and applications refers to similar principles as physical accessibility in the built environment, such as the ability to move through spaces smoothly regardless of potential personal mobility limitations.

Our discussion strongly underscored the importance of collaboration, as the development team and other contributors bring extensive expertise from different areas, such as content knowledge, metadata, and user experience.

What has been developed?

After identifying development needs, the AILA portal has been systematically renewed under the guidance of the development team, in collaboration with other FSD staff and stakeholders.

  1. Aila’s data security is being improved by upgrading the hashing functions for secrets to more secure and modern, tightening password requirements and secrets management practices, and securing administrative interfaces at the network level
  2. Accessibility is being enhanced by ensuring that text and other elements in the application have appropriate size and colour contrast, taking visual impairments into account. In addition, AILA 2.0 will be fully navigable using keyboard only. The development work has also considered Aila’s clients who use screen readers or other assistive technologies.
  3. Search functions have been improved to make it easier and more efficient for clients to locate the datasets they need. Below is a comparison of the old and new Aila search functions.

AILA’s current advanced search allows filtering by availability, data type, language, temporal coverage of the study, and unit of observation.

Image 1: Aila’s current advanced search.

The next screenshot shows AILA 2.0’s advanced search. In the new Aila, filtering options have been expanded, and it is now possible to filter searches by, for example, the year of data collection.

Image 2: Aila 2.0’s advanced search. Click the image to view it larger.

What’s next?

The Aila 2.0 development team will continue their work. Once AILA 2.0 reaches the deployment phase, developers will be able to focus more closely on areas requiring further refinement. You can learn more about the updates in an upcoming article.

In the next project news, we will continue with the AIMS project, where we will discuss artificial intelligence from the perspective of the Data Archive.

See this blog entry in Finnish.

Henna Kaartinen
Project Assistant
firstname.surname [at] tuni.fi

28. lokakuuta 2025

AILA 2.0: Kehittäjien ajakohtaisia kuulumisia

Tapasin Tietoarkiston AILA 2.0 -kehittäjätiimin aiheenani ajankohtaiset kuulumiset kehitystyöstä. Kävimme keskustelua erityisesti palvelun kehitystyön taustasta, tämänhetkisestä vaiheesta sekä seuraavista askelista.

Mikä on AILA?

Palveluportaali AILA on tietoarkistolaisten itse toteuttama arkistoitujen tutkimusaineistojen tilaus- ja toimitusjärjestelmä. Se otettiin käyttöön toukokuussa 2014. AILA 2.0 -versiota on lähdetty kehittämään osana Suomen Akatemian rahoittamaa Rajoja ylittävät työkalut ja palvelut (C-BOTS 2019-2024) -hanketta. Tietoarkistolle ja sen asiakkaille AILA on keskeinen ja tärkeä palvelu, jonka ylläpitäminen ja kehittäminen ovat yksi Tietoarkiston keskeisimpiä tehtäviä.

Miksi AILA 2.0 -versio kehitetään?

AILAn kehityksen taustalla olevat perusteet ja tavoitteet rakentuvat useista toisiaan tukevista näkökulmista, kuten tekninen, asiakaslähtöinen ja saavutettavuuden näkökulma.

Yhteiskunnalliset muutokset kytkeytyvät kaikkeen toimintaan yhteiskunnassamme. Digitalisaation etenemisen myötä esimerkiksi verkkosovelluskehityksen tahti on kiihtynyt, asiakkaiden tarpeet muuttuneet ja saavutettavuuden edellytykset kasvaneet. Kehittäjätiimi korostaakin, että oli havaittu tarve teknisen toimintaympäristön uudistamiselle, jotta AILA-palveluportaalia voidaan jatkossakin käyttää turvallisesti ja yhteen toimivasti.

Sen lisäksi keskeistä kehittämiselle on nyt ja jatkossa asiakaslähtöisyyden näkökulma, jossa korostuu tarve sujuvammalle ja saavutettavammalle palvelulle.

Saavutettavuudella tarkoitetaan verkkosivujen ja -sovellusten kohdalla samankaltaisia asioita kuin rakennetun ympäristön kohdalla tarkoitetaan esteettömyydellä, kuten mahdollisuutta kulkea tiloihin sujuvasti huolimatta mahdollisista henkilökohtaisista liikkumisrajoitteista.

Keskustelussamme nousi vahvasti esille yhteistyön merkitys, sillä kehittäjätiimissä ja muilla työssä mukana olleilla on laajaa osaamista eri osa-alueilta, kuten sisällöntuntemuksesta ja metadatasta sekä käyttäjänäkökulmasta.

Mitä on kehitetty?

Kehitystarpeiden selvittämisen jälkeen AILA-portaalia on lähdetty systemaattisesti uudistamaan kehittäjätiimin johdolla, yhteistyössä muun Tietoarkiston henkilöstön sekä sidosryhmien kanssa.

  1. Ailan tietoturvaa parannetaan päivittämällä salaisuuksien tiivistefunktioita vahvemmiksi ja nykyaikaisemmiksi, tiukentamalla salasanavaatimuksia ja salaisuuksienhallintaa, sekä suojaamalla hallintakäyttöliittymät verkkotasolla.
  2. Saavutettavuutta parannetaan esimerkiksi siten, että sovelluksen tekstien ja muiden elementtien koko ja värien kontrastit asetetaan sopivaksi myös näkökyvyn rajoitteet huomioiden. Lisäksi AILA 2.0 tulee olemaan käytettävissä pelkällä näppäimistön navigoinnilla. Kehitystyössä on myös huomioitu ruudunlukijoita käyttävät Ailan asiakkaat.
  3. Hakutoimintoja on parannettu tehostamalla hakutoimintoja, jonka myötä asiakkaiden on sujuvampi ja helpompi löytää haluamansa aineistot arkistosta. Alla on vertailua vanhan ja uuden Ailan hakutoiminnoista.

AILAn nykyiset hakutoiminnot mahdollistavat tarkennetun haun saatavuuden, tyypin, kielen, tutkimuksen aikaulottuvuuden sekä havaintoyksikkötyypin mukaan.

Kuva 1: Ailan nykyinen tarkennettu haku. Paina kuvaa nähdäksesi sen suurempana.

Seuraava kuvakaappaus on AILA 2.0:n tarkennetusta hausta. Uudessa Ailassa rajausvaihtoehdot ovat kehittyneet ja siinä on mahdollista rajata hakua esimerkiksi keruuvuoden mukaan.

Kuva 2: Aila 2.0:n tarkennettu haku. Paina kuvaa nähdäksesi sen suurempana.

Mitä seuraavaksi?

Aila 2.0 -kehittäjätiimi jatkaa kehittämistyötä. AILA 2.0:n valmistuttua käyttöönottovaiheeseen, kehittäjien on mahdollista päästä perehtymään tarkemmin jatkotyöstämistä vaativiin kohteisiin. Uudistuksiin voi perehtyä tulevan kirjoituksen myötä.

Seuraavassa blogipostauksessa jatketaan AIMS-hankkeen parissa, jolloin käsitellään tekoälyä Tietoarkiston näkökulmasta!

Lue blogi englanniksi.

Henna Kaartinen
projektiassistentti
etunimi.sukunimi [at] tuni.fi

10. lokakuuta 2025

Tietoarkisto-seminaari 2025: ISSP Suomessa 25 vuotta

International Social Survey Programme (ISSP) on maailmanlaajuinen vertailututkimusohjelma, joka on koonnut tietoja eri maiden kansalaisten toiminnasta ja yhteiskunnallisista mielipiteistä jo vuodesta 1985 saakka. Suomi on ollut mukana vuodesta 2000. Suomen ISSP-jäsenyys on järjestetty eri organisaatioiden yhteistyönä. Tietoarkisto arkistoi suomenkieliset Suomen aineistot ja mukana aineistonkeruussa ovat Tampereen yliopiston yhteiskuntatieteiden tiedekunta ja keruun toteuttavat organisaatiot.

ISSP-tutkimusohjelman 25-vuotiaan taipaleen kunniaksi järjestimme 7.10.2025 kansallisen Tietoarkisto-seminaarin. Seminaari pidettiin hybridimuotoisena sekä verkossa että Tampereen yliopiston Väinö Linna –salissa. Tapahtuma oli maksuton ja avoin kaikille aihepiiristä kiinnostuneille.

Seminaarin teemat kytkeytyivät ISSP:n menneisyyteen, tähän hetkeen sekä tulevaisuuteen erilaisten mielenkiintoa herättäneiden puheenvuorojen myötä. Seminaarissa kuultiin myös tarkemmin muutamista tuoreista ISSP-aineistoista.

Seminaariin ilmoittuneita oli yhteensä 66. Mukana oli monipuolinen joukko seminaariväkeä, kuten perus- ja jatkotutkinto-opiskelijoita, lehtoreita, opettajia, professoreita, tutkimusjohtajia, tutkimusinsfraktuurin edustajia sekä tutkimuksen tuen asiantuntijoita. Tällä kokoonpanolla seminaarissa keskustelua syntyikin puheenvuorojen jälkeen mukavasti. Niissä korostui innostuneisuus ja yhteistyön sekä asiantuntijuuden tärkeys.

Harri Melin (vas.), Eriikka Oinonen ja Henna Kaartinen tarkastelevat, millainen on tosi suomalainen ISSP-aineiston ja tekoälyn näkemänä.

Tilaisuus päättyi kahvitukseen, jossa keskustelu Tietoarkisto-seminaarin aiheista jatkui täytekakun ja kahvien merkeissä.

Tietoarkistossa jatkamme ISSP-tutkimusohjelman taivalta. Tuorein aineisto on juuri ennen seminaaria Ailassa julkaistu: FSD3994 ISSP 2024: digitaalinen yhteiskunta: Suomen aineisto. Aineisto sisältää suomalaisten näkemyksiä digitaalisesta yhteiskunnasta sekä internetin ja digitaalisen teknologian käytöstä.

Ohjelma

Jaetut esitykset ovat saatavilla seminaarin verkkosivulla.

  • Avauspuheenvuoro. Johtaja Helena Laaksonen (Tietoarkisto)
  • Four Decades of ISSP: Past, Present, Future. Prof. Dr. Stephanie Steinmetz, (FORS – Swiss Centre of Expertise in the Social Sciences)
  • Suomi 25 vuotta ISSP:ssä - Pysyvätkö kansalaiset mukana? Tutkimuspäällikkö Sami Borg (Kunnallisalan kehittämissäätiö)
  • Tauko
  • Kansallinen identiteetti maailman onnellisimmassa maassa. Yliopistonlehtori Eriikka Oinonen ja professori emeritus Harri Melin (Tampereen yliopisto)
  • Digitaalinen eriarvoisuus ja irtikytkeytyminen. Professori Semi Purhonen (Tampereen yliopisto)
  • Suomalaiset ja työ 2000-luvulla. Tietoasiantuntija Emilia Hakkola (Tietoarkisto)
  • Keskustelua ja loppusanat

Henna Kaartinen
projektiassistentti
etunimi.sukunimi [at] tuni.fi

18. helmikuuta 2022

Viittaa dataan - myös omaan dataasi!

Dataviittauksen tiekartan julkaisemisesta on kulunut jo muutama vuosi. Tavoitteena oli tehdä dataan viittaamisesta osa suomalaista julkaisukäytäntöä. Suosituksena oli ja on sekä ihmislukijalle että koneelle ymmärrettävien dataviittausten käyttäminen. Tutkimusaineistoihin viitataan kuitenkin edelleen hyvin vaihtelevasti ja usein ei ollenkaan.

Olen selaillut havaintoni todentamiseksi hyvin sattumanvaraisesti Tietoarkistolle keskeisten tieteenalojen lehtiä. En siis osaa sanoa, miten asia toteutuu jollakin muulla tieteenalalla enkä väitä, että kukaan ei koskaan viittaa. Joissakin tapauksissa tutkimusaineistoon viittaaminen on peräti esimerkillistä.

Tietoarkisto on jo pitkään ohjeistanut seikkaperäisesti, miten tutkimusaineistoon voi viitata tieteellisessä tekstissä. Malliviittaukset ovat olleet aina saatavilla aineiston kuvailutietojen osana. Vuosien saatossa olemme muuttaneet kielenkäyttöä asiakasystävälliseen suuntaan, ja viittausvaatimuksen rinnakkaisterminä on nykyisin käytössä malliviittaus. Käytettyyn aineistoon viittaaminen on silti yksi käyttöehto, johon asiakas sitoutuu ladatessaan aineiston. Malliviittaus on saatavilla aineiston lataussivulla ja tarkempaan viittausohjeeseen pääsee sen yhteyteen sijoitetusta linkistä.

Toinen havaintoni vaatisi enemmän selvittelyä, mutta mututuntumani on, että toisen tutkijan aineistoon viitataan (tavalla tai toisella) useimmiten. Sen sijaan omaan aineistoon viittaaminen ei ole yleinen käytäntö. Omaan dataan ei viitata välttämättä edes silloin, kun aineisto on jo Tietoarkistossa (tai jossain tallennuspalvelussa) ja viittaus olisi kohtuullisen helppo kopioida suoraan artikkelin lähteisiin. Tietoarkistoon tallennettuun aineistoon voi viitata myös silloin, kun sen arkistointiprosessi ei ole valmis. Toisin sanoen aineistolle voi saada pysyvän tunnisteen ja niin sanotun alustavan aineistonimen. Suunnitelmissamme on myös tekijöiden tutkijatunnisteiden (ORDIC) hyödyntäminen.

Tiivistetysti saat Tietoarkistosta seuraavat "viittauspalvelut":

14. helmikuuta 2022

Datarakkautta ilmassa ja tutkimusaineistojen jatkokäyttö huipussaan

Love Data -viikko1 on taas käsillä. Teemana tänään ystävänpäivänä alkavalla viikolla on ”data kuuluu kaikille!” (Data is for everyone). Meillä Tietoarkistossa huolehditaan tänne tallennetun tutkimusdatan saatavuudesta. Saatavuus-sana pitää sisällään sekä säilytyksen että datan löydettävyyden ja pääsyn siihen.

Kaikki aineisto ei ole kuitenkaan kokonaan kaikkien saatavilla. Käyttöehdot rajoittavat jatkokäyttäjien piiriä. Toisaalta Tietoarkiston julkaisemista aineistoista on avoimesti saatavilla niin paljon yksityiskohtaista kuvailutietoa, että ihan jokainen voi halutessaan saada hyvän käsityksen vaikkapa siitä, suhtautuvatko ihmiset epäilevästi kaikkiin uutisiin valeuutisten takia3. Asia selviää Kirkon tutkimuskeskuksen Suomalaisten henkinen kriisinkestävyys -aineiston muuttujakuvailusta, vaikka varsinaisen datan voi saada vain tutkimukseen, opetukseen tai opiskeluun.

Tietoarkiston aineistoluettelon noin 1700 aineistosta on vapaasti saatavilla 109 aineistoa. Nämä aineistot voi ladata rekisteröitymättä, ja niitä voi käyttää mihin tahansa haluamaansa lailliseen tarkoitukseen Creative Commons -lisenssillä . Lähde on silti mainittava ja merkittävä tehdyt muutokset. Aiemmin lataajilta pyydettiin tieto käyttötarkoituksesta ja sähköpostiosoite tilastointia varten. Creative Commons Nimeä 4.0 Kansainvälinen -lisenssiä3 aloimme käyttää vuoden 2020 joulukuussa.

Vapaasti käytettävien aineistojen määrä on alle kymmenesosa kaikista Tietoarkiston aineistoista, mutta niitä ladataan eniten. Kaksi kulunutta koronavuotta ovat olleet arkistoitujen aineistojen jatkokäytössä huiman kasvun aikaa. Vuoden 2021 kasvua vauhditti mainittu lisenssimuutos. Kyseisten aineistojen latausmäärä kasvoi yli tuhannella vuodessa. Aineistojen käyttötilastojen muutoksia on julkaistu Tietoarkiston tiedotteessa4. Kulunut tammikuu 2022 on jälleen kaikkien aikojen vilkkain tammikuu ainakin aineistojen latausten perusteella.

Vaikka data kuuluu kaikille ja suuret aineistojen latausmäärät ilahduttavat, Tietoarkisto on ensisijaisesti tutkimuksen tuki-infrastruktuuri. Aineistot ovat niin avoimia kuin ne voivat olla, ja rajoituksille on perusteet. Meidän on tavoiteltava paitsi suuria käyttäjämääriä, myös huolehdittava aineiston soveltuvuudesta tutkimustarkoituksiin. Tavoitteet eivät aina kohtaa, mutta datan sisältämä tieto kuuluu kaikille, olipa pääsy siihen avointa tai ei.

Iloista Love Data -viikkoa! Lataa dataa Ailasta!

Lisätietoa:

1 Join us for Love Data Week 2022! “Data is for everyone” starts February 14.
2 Kirkon tutkimuskeskus: Suomalaisten henkinen kriisinkestävyys II 2020 [sähköinen tietoaineisto]. Versio 1.0 (2021-09-14). Yhteiskuntatieteellinen tietoarkisto [jakaja]. http://urn.fi/urn:nbn:fi:fsd:T-FSD3509. Muuttuja [q3_3].
3 Creative Commons Nimeä 4.0 Kansainvälinen (CC BY 4.0)
4 Aineistojen käyttö kasvoi huimasti myös toisena koronavuonna: latausten kärjessä avoimesti lisensoidut datat

Helena Laaksonen
johtaja
etunimi.sukunimi [at] tuni.fi

15. kesäkuuta 2020

Tietoarkisto mahdollistamassa kansainvälistä vertailevaa tutkimusta

Suuri osa Tietoarkiston tekemästä työstä on kansainvälistä yhteistyötä, johon kuuluu myös kaksi merkittävää kansainvälistä aineistonkeruuohjelmaa: International Social Survey Programme (ISSP) ja European Values Survey (EVS). Tietoarkisto on mukana näiden kansainvälisten aineistojen keruun rahoittamisessa, suunnittelussa, käännöstyössä sekä suomalaisen datan käsittelyssä kansainvälisen aineiston vaatimusten mukaiseksi. Tietoarkisto myös arkistoi Suomen maakohtaisen aineiston ISSP:n, EVS:n ja World Values Surveyn (WVS) keruista. Saksalainen sisararkistomme GESIS arkistoi aineistosarjojen kansainväliset aineistot.

Kansainvälinen vertailudata suosittua

Kansainväliset vertailuaineistot kuten ISSP ja EVS kuuluvat Tietoarkiston suosituimpiin aineistoihin, ja palveluportaali Ailassa on tiedot lukuisista julkaisuista, joissa aineistoja käytetään. Aiemmin Ailaan on kuitenkin kerätty julkaisutiedot vain kotimaiseen dataan pohjautuvista julkaisuista. Tänä kesänä käymme läpi kansainvälisiä yhdistelmäaineistoja hyödyntäviä julkaisuja, joissa myös Suomen aineistoa on analysoitu, ja lisäämme niiden tietoja Ailan aineistokuvailuihin.

Monissa maissa ylikansalliset vertailututkimusaineistot ovat muodostuneet tärkeäksi ja suosituksi tutkimusresurssiksi. Vertailuaineistojen ja datan globaalin löydettävyyden kasvava tarve näkyy myös esimerkiksi Euroopan yhteisiä avoimen tieteen pilvipalveluita kehittävässä EOSC-hankkeessa.

Suomi esillä kansainvälisessä tutkimuksessa

Vertailututkimusaineistojen kerääminen on kuitenkin työlästä, sillä yhteensovittamisessa pitää ottaa huomioon eri maiden ja kulttuurien erilaiset käytännöt ja kielet. Yhteistyössä suomalaisten yhteiskuntatieteilijöiden ja tutkimusorganisaatioiden kanssa Tietoarkisto on mahdollistanut viimeisen liki kahdenkymmenen vuoden ajan sen, että Suomi on mukana laajoissa ja tunnetuissa kansainvälisissä aineistosarjoissa.

Laajoihin vertailuaineistojen keruihin osallistuminen mahdollistaa sen, että kotimaiset ilmiöt asettuvat oikeisiin suhteisiinsa ja suomalainen yhteiskunta ja kulttuuri paikalleen muiden joukkoon. Maailmanlaajuisesti tunnettuja tutkimusohjelmia kuten ISSP:tä ja EVS:ää pidetään myös luotettavina sekä hyvin dokumentoituina ja suunniteltuina. Kymmeniätuhansia havaintoyksiköitä sisältäviä kansainvälisiä aineistoja käytetäänkin ahkerasti, sillä ne tarjoavat loputtoman määrän tutkimusasetelmia ja tilastollisia lähestymistapoja.

ISSP- ja WVS/EVS-aineistot ovat tärkeitä myös kotimaisessa yhteiskuntatieteellisessä tutkimuksessa, mutta Suomen datan merkitystä kansainvälisessä kontekstissa ei saa unohtaa. Tietoarkisto seuraa esimerkiksi ISSP:n osalta suomalaisten aineistojen latausten määriä Ailasta, mutta nämä määrät ovat pieniä verrattuna siihen, kuinka paljon saksalaisesta GESISistä ladataan kansainvälisiä yhdistelmäaineistoja. GESISiltä saatujen tilastojen mukaan Suomen datan sisältäviä ISSP-yhdistelmäaineistoja on ladattu vuosina 2016-2019 lähes 30 000 kertaa.

Urakkaa riittää

Kansainvälisten vertailuaineistojen avulla tehdään tutkimusta siis huimia määriä, ja kaikkia Suomen dataa hyödyntäviä julkaisuja ei todennäköisesti koskaan ehditä kirjaamaan Ailaan: pelkästään ISSP:n julkaisuluettelo sisältää yli 9 000 julkaisua, joista suuressa osassa Suomen aineistoja on mukana mutta suuressa osassa ei. Julkaisutietojen kerääminen on työlästä, sillä toistaiseksi niiden koneelliseen haravointiin ei ole olemassa välineitä; kirjattavien julkaisujen selvittäminen vaatii monissa tapauksissa siis julkaisun manuaalista läpikäyntiä.

Tähän mennessä olemme keränneet runsaat kaksisataa viitetietoa Suomen aineistoja hyödyntävistä kansainvälisistä julkaisuista, kuten tutkimusartikkeleista ja monografioista. Työ on siis alkutekijöissään, mutta jo tässä vaiheessa on selvää, että Suomi on näkyvästi vertailevan yhteiskuntatutkimuksen maailmankartalla.

Lisätietoa:

» ISSP:n esittely Tietoarkiston sivuilla
» EVS:n/WVS:n esittely Tietoarkiston sivuilla
» International Social Survey Programme -tutkimusohjelman julkaisuluettelo
» European Values Survey -tutkimusohjelman julkaisuluettelo
» GESIS - Leibniz-Institut für Sozialwissenschaften
» Ailan julkaisuhaku

Niko Koski
tietoasiantuntija
etunimi.sukunimi [at] tuni.fi

Tämä blogikirjoitus on luettavissa myös englanniksi:
FSD Enabling Cross-National Comparative Research.

FSD Enabling Cross-National Comparative Research

A lot of the work done at FSD is related to our international collaboration, which also includes two significant international survey programmes: International Social Survey Programme (ISSP) and European Values Survey (EVS). FSD is involved in the planning and funding of data collection as well as questionnaire translation and processing the data in line with the international requirements. FSD also archives the Finnish data from ISSP, EVS and World Values Survey (WVS). Our German colleagues at GESIS archive the complete international datasets from these programmes.

Comparative data growing in popularity

At FSD, international comparative datasets like ISSP and EVS are among Aila Data Service's most frequently downloaded, and information on several publications utilising data from these programmes are available on Aila. Until now, however, we have only collected information about publications based on the Finnish data, leaving out comparative research done on the complete datasets. This summer, we will go through international publications that have used the international datasets from GESIS with Finnish data included and add their information on Aila Data Service.

In many countries, cross-national comparative research data have become a significant resource for academic research. The growing need for globally discoverable comparative data is also one of the driving factors behind the European Open Science Cloud (EOSC) initiative which aims to build common European open science services.

Finland represented in international research

However, collecting comparative international data is rather labour-intensive. Harmonising data collection instruments and processing the data require consideration of the different practices and languages of different countries and cultures. For two decades, FSD has enabled Finnish participation in broad, well-known international survey programmes in collaboration with Finnish social scientists and research organisations.

Involvement in extensive comparative surveys facilitates researching Finnish society and culture in relation to other countries, enabling the measurement of domestic social phenomena to those abroad. Globally known survey programmes like ISSP and EVS are considered trustworthy, thoroughly documented and well planned. The international datasets covering tens of thousands of individual observations are popular, because they offer a limitless number of research designs and statistical approaches.

Thus, the impact of Finnish data reaches far beyond Finnish borders, although the Finnish ISSP and EVS/WVS datasets are also important in domestic social science research. FSD monitors the number of downloads of ISSP, EVS and WVS data from Aila, but these numbers are small compared to the number of downloads of the complete international datasets from GESIS. For example, the complete ISSP datasets with Finnish data included were downloaded approximately 30,000 times in 2016-2019, according to statistics received from GESIS.

Much work to be done

All in all, monumental amounts of research is done using international comparative datasets, and we will most likely never be able to identify all international publications using Finnish ISSP/EVS/WVS data: for instance, ISSP's official list of publications includes more than 9,000 publications, of which a large part utilise Finnish data but a large part also do not. Charting which publications use Finnish data is an arduous task: publication information currently cannot be machine-harvested, and each publication has to be inspected manually.

Thus far we have collected information on approximately 200 publications such as research articles or monographs that utilise Finnish ISSP, EVS or WVS data. In other words, the work is only beginning. Needless to say, however, that Finland's visibility is remarkable on the world map of comparative social science.

Further information:

» International Social Survey Programme publications
» European Values Survey publications
» ISSP datasets on Aila Data Service
» GESIS - Leibniz-Institut für Sozialwissenschaften
» Aila Data Service, publications search

Niko Koski
Information Specialist
firstname.surname[at] tuni.fi

This blog entry is available also in Finnish:
Tietoarkisto mahdollistamassa kansainvälistä vertailevaa tutkimusta.

7. helmikuuta 2019

Kehitämme kansallista datainfrastruktuuriamme Suomen Akatemian tuella ja yhteistyössä tiedeyhteisön kanssa

Tampereen yliopisto juhlisti yhdistynyttä korkeakouluyhteisöään Potentiaaleissa Tampere-talossa 24.1.2019. Osallistujille jaettiin tähtimerkkejä, joista kukin voi poimia kuvaavimman. Kun Suomen Akatemia oli vajaata viikkoa aiemmin myöntänyt Tietoarkiston rajoja ylittävälle C-BoTS-infrastruktuurihankkeelle viisivuotisen rahoituksen, minulle seitsemästä vaihtoehdosta tuntui osuvimmalta Fuusio. Se merkitsee "potentiaalia tiederajojen yli".1 Hauska idea, jolla on varmasti perinteistä horoskooppimerkkiä enemmän ennustearvoa.

Uudessa Tampereen yliopistossa Tietoarkisto jatkaa erillisyksikkönä valtakunnallisen palvelutehtävän hoitamista. Akatemian rahoitus on osoitettu juuri tämän tehtävän vahvistamiseen. Hankkeen suomenkielinen nimi on Rajoja ylittävät työkalut ja palvelut (C-BoTS): Tietoarkiston kansallinen datainfrastruktuuri 2024. Hankkeen kuusi työpakettia istuvat hyvin sekä kansallisella tutkimusinfrastruktuurien tiekartalla esitettyihin Tietoarkiston tavoitteisiin että Tietoarkiston strategiasuunnitelmaan, joka korostaa asiantuntevaa palvelua, yhteistyötä ja vastuullista avointa tiedettä.

Kuulostaa ylevältä, ja perinteiselle kriittiselle yhteiskuntatieteilijälle varmaankin hölynpölyltä, mutta hankkeemme on sisällöltään muuta kuin sanahelinää. Tietoarkisto on paitsi digiä suuressa määrin myös palvelua, jonka hoitamiseen tarvitaan asiantuntevia ihmisiä. Jotta asiantuntijamme voivat palvella tiedeyhteisöä ajanmukaisesti, on kehitettävä työkaluja, jotka helpottavat aineistojen käsittelyä ja arkistointia sekä muun muassa vähentävät raportointiin käytettyä työaikaa.

Tietoarkiston palveluarkkitehtuuri uudistetaan

Hankkeen laajimmassa työpaketissa keskitymme nykyisen palveluarkkitehtuurimme purkamiseen pienempiin osiin kokonaisuudeksi, joka mahdollistaa ulkopuolisten palvelujen ketterämmän hyödyntämisen. Uuden arkkitehtuurin myötä helpotamme myös pääsyä Tietoarkiston palveluihin ulkopuolelta erilaisten rajapintojen kautta.

Raportoinnin automatisoinnilla tietoa vaikuttavuudesta

C-BoTS-hanke lisää aineistoja arkistoivien tutkijoiden ja heidän taustaorganisaatioidensa näkyvyyttä tarjoamalla ajantasaista tietoa arkistoiduista aineistoista ja niiden tilastoja niiden käytöstä. Tietoarkiston käyttäjätilastot tuodaan ajantasaisina rahoittajien ja asiakkaiden saataville. Vastaavasti helpotamme uudella käyttöliittymällä jatkokäyttäjiltä vaadittavaa ladattujen aineistojen käytön ja julkaisutietojen raportointia.

Verkkokaupoista tuttuja ominaisuuksia ja koneoppimisen avulla tehokkaampia hakumahdollisuuksia

Palveluportaali Ailaan lisäämme verkkokaupoista tuttuja ominaisuuksia, kuten ostoskorin useiden aineistojen lataamiseen kerralla ja suositukset uusien ja samankaltaisten sisältöjen löytämiseen. Rakennamme muun muassa koneoppimista hyödyntävän käyttöliittymän, jonka avulla voimme tuottaa ja ylläpitää samankaltaisia muuttujia sisältäviä ryhmiä sekä käyttöliittymän, jonka avulla asiakkaamme pystyvät hakemaan muuttujia ja tutkimusaineistoja. Tampereen yliopiston signaalinkäsittelyn laboratorio tekoälyosaamisineen on tässä työpaketissa merkittävä kumppani.

Apuvälineitä anonymisointiin ja kvalitatiivisen aineiston hallintaan

Tietoarkisto on sähköisten laadullisten tutkimusaineistojen arkistoinnin pioneeri. Etenkin tekstimuotoisen kvalitatiivisen datan arkistointi on anonymisointivaatimusten vuoksi käsityövaltaista ja aikaa vievää. C-BoTS pyrkii helpottamaan anonymisointia arvioimalla olemassa olevia apuvälineitä kvalitatiivisen ja kvantitatiivisen aineiston anonymisointiin. Samalla kehitämme datan anonymisoinnin prosessiamme ja tuotamme ohjeistusta tutkijoille.

Päivitämme hankkeessa myös lähes kymmenen vuotta sitten julkaisemamme Kvalikirstu-ohjelmiston, joka on tehty helpottamaan kvalitatiivisen tekstimuotoisen aineiston arkistointia ja jatkokäyttöä. Uusi Kvalikirstu tuottaa nykyisiä pitkäaikaissäilytyksen vaatimuksia vastaavaa dataa ja tarjoaa jatkokäyttäjille helppokäyttöisen suomen- ja englanninkielisen käyttöliittymän. Se tukee nykyistä useampaa tiedostotyyppiä ja taustamuuttujien automaattista luomista.

Vertailevan tutkimuksen palvelu tekee yhteistyötä muiden tutkimusinfrastruktuurien kanssa

C-BoTS hankkeeseen kuuluu myös vertailevan tutkimuksen työpaketti, joka tukee muun muassa yhteistyötä Suomen ihmistieteiden ERICien kanssa ja osallistumista kahteen kansainvälisesti vertailevaan aineistosarjaan. Koska emme saaneet kaikkea hakemaamme rahoitusta, arvioimme tämän työpaketin sisältöä uudelleen. Erityisesti joudumme pohtimaan, millä vuosittainen International Social Survey Programme -sarjan aineistonkeruu rahoitetaan.

Me tietoarkistolaiset olemme joka tapauksessa erittäin tyytyväisiä valtakunnallisen tehtävän kehittämiseen saamastamme rahoituksesta ja ryhdymme toteuttamaan projektisuunnitelmaa, missä kotimainen yhteistyö tiedeyhteisön ja muiden avoimen tieteen toimijoiden kanssa on ensiarvoisen tärkeätä.

Samalla toivotan kaikki tervetulleiksi viettämään Tietoarkiston 20-vuotisjuhlavuotta kanssamme!

1 Muut tähtimerkit olivat röntgen, tekoäly, Sokrates, terawatti, fresko ja Äiti Teresa.

Lisätietoa:

» Rahoituspäätös Suomen Akatemian sivuilla
» Suomen tutkimusinfrastruktuurien strategia ja tiekartta 2014-2020
» Tietoarkiston strategia (pdf)

Helena Laaksonen
johtaja
etunimi.sukunimi [at] tuni.fi


7. joulukuuta 2018

Translation and international use of research data

To promote open science, the Finnish Social Science Data Archive also provides services to researchers and students who do not speak Finnish. In practice, this means that foreign language speakers are provided the opportunity to access quantitative research data in FSD holdings in English. In addition, we describe all data in English to allow the international audience to find them.

Translating variables, that is, the questions and response alternatives presented in a study, differs quite a lot from translating other types of texts. Translators of literature often have a great deal of linguistic and artistic freedom. The challenge of translating fiction usually lies in carrying the ambiguities of the source language over to the target language. Translating technical and informative texts requires clearer, more univocal interpretation, although depending on the text type a translator may have some creative licence.

Striving for fidelity and clarity

When survey questions are being translated, there's very little room for interpretation. In studying attitudes, how something is asked may have almost as big an effect on the frequency distributions as what is asked.1 The users of translated data have to be able to trust that the translated questions correspond to the original ones as closely as possible in terms of both content and form. Researchers may draw far-reaching conclusions based on the translated questions, which is why it's essential that non-Finnish-speaking researchers gain an understanding of what the respondents were originally asked and how the questions were phrased.

One of the challenges of translating variables faithfully is posed by the errors and inconsistencies sometimes found in source texts. At its worst, an error in a Finnish question may affect how the respondents answer the question, and the non-Finnish user of the data will wonder what has caused the unexpected frequency distributions. When translators notice an error, they have to consider how significant it is and whether it has actually affected the responses. The translator also needs to decide how to communicate the error to data users. Replicating the error in the translation is rarely a good option because a user won't know whether the error originated from the source text or the translator.

As translators at FSD, we're lucky to have the possibility to provide further information on the translations to users through a separate file. These translation notes usually contain information on the word choices and translation strategies used.

Culture-specific expressions pose challenges

In general, a translator of research data should aim to create as neutral a translation as possible while avoiding interpreting variables too strictly from her or his own point of view. However, this does not mean that we translate data word for word; relaying the idea of the original text clearly and intelligibly is our priority.

Ultimately, the challenges of data translations are very similar to those encountered when translating other kinds of texts, such as how to express a concept that does not exist in another language and how to translate the nuances of the source language into the target language.

Questions presented in surveys often have elements or expressions that are specific to the Finnish culture and have no obvious counterparts in English. In these cases, the concepts need to be explained to foreign users. For example, in one dataset, the respondents were asked whether "red cottages and potato fields" are part of the Finnish rural landscape. This expression is similar to the "white picket fence" used in the United States referring to a sort of simple and idyllic life. However, because our users are from all over the world, domesticating the question for a culturally limited audience is not a good idea. For users who are not familiar with either the Finnish or the American culture, we would simply be replacing one culture-specific expression with another. In situations like this, the translation notes are of great help to us, as we are able to explain expressions that might otherwise be incomprehensible to some users.

The translation process at FSD usually takes a few weeks depending on the size of the data and the translators' workload. After the translation is complete, the data are available on our Aila Data Service to all users who need it in English. This is why we always put a lot of care and effort in translating all of the data instead of specific, individual variables needed by one user.

"Haste makes waste" also applies to questionnaire design and translation

Some might say that a data translation is never close enough to the source text to make research on translated variables feasible. It's been noted, for example, that some established measurements of well-being do in fact measure slightly different concepts in different languages.2 Full equivalence can perhaps never be achieved, but this is rarely the goal of translation. It's good to remember that language is built on interpretations, and even speakers of the same language may understand the same question in different ways in attitudinal surveys.

Questionnaire design and translation do not always receive the attention they deserve, although well-formed questions are likely to lead to better validity. In international comparative surveys, it's particularly important that all respondents are asked the same things in the same way. If you plan to use questionnaires in more than one language, having questionnaires translated by a professional translator is something to consider when planning data collection. Surveys conducted in a single language also benefit from proofreading by a professional to prevent potential errors or inconsistencies from endangering the objective of the study.

Survey question form and wording require some effort, but there is no need to reinvent the wheel; inspiration for questions can be found, for example, in the UKDS Variable and question bank, the upcoming CESSDA Euro Question Bank and of course our question and variable search on Aila Data Service.

Henri Ala-Lahti
Research Officer
firstname.lastname [at] uta.fi

Niko Koski
Research Assistant
firstname.lastname [at] uta.fi


1 Schuman, Howard & Stanley Presser (1996), Questions and Answers in Attitude Surveys: Experiments on Question Form, Wording, and Context. Thousand Oaks: SAGE
2 Lolle, Henrik Lauridsen & Jørgen Goul Andersen (2015), "Measuring Happiness and Overall Life Satisfaction: A Danish Survey Experiment on the Impact of Language and Translation Problems", Journal of Happiness Studies 17 (4): 1337-1350.

This blog entry is also available in Finnish:
Suomenkielisten tutkimusaineistojen kääntämisestä ja kansainvälisestä jatkokäytöstä.

Suomenkielisten tutkimusaineistojen kääntämisestä ja kansainvälisestä jatkokäytöstä

Tietoarkisto palvelee avoimen tieteen edistämiseksi myös tutkijoita ja opiskelijoita, jotka eivät puhu suomea. Käytännössä tämä tarkoittaa sitä, että Suomessa tai ulkomailla asuville vieraskielisille asiakkaille tarjotaan mahdollisuus saada käyttöönsä kvantitatiiviset tutkimusaineistot englanninkielisinä. Lisäksi tuotamme kaikista arkistoon toimitetuista aineistoista kuvailut englanniksi, jotta kansainvälinen yleisö löytäisi tarvitsemansa aineistot.

Aineiston muuttujien eli tutkimuksissa esitettyjen kysymysten ja niiden vastausvaihtoehtojen kääntäminen poikkeaa varsin paljon muiden tekstien kääntämisestä. Kaunokirjallisten tekstien kääntäjällä on suuri vapaus ilmaista asia toisella kielellä. Kaunokirjallisuuden kääntämisen haasteena on usein alkuperäisen tekstin moniselitteisyys ja tämän välittäminen kohdekielelle. Asiatekstikääntäminen taas vaatii yksiselitteisempää ilmaisutapaa, vaikka tekstilajista riippuen myös asiatekstikäännöksissä on paikoitellen ilmaisunvapautta.

Tasapainottelua vastaavuuden ja selkeyden välillä

Tutkimusaineistojen kysymysten kääntäminen sijoittuu ilmaisutavan puolesta asiatekstien tiukempaan päähän. Asenteita tutkittaessa muuttujien jakaumiin voivat vaikuttaa paitsi kysymysten ajatuksellinen sisältö myös niiden esitystapa.1 Käännettyjen tutkimusaineistojen käyttäjien on voitava luottaa siihen, että käännetyt kysymykset vastaavat sisällöltään ja esitystavaltaan mahdollisimman läheisesti tutkittaville esitettyjä. Tutkijat voivat tehdä pitkällekin meneviä johtopäätöksiä käännettyjen kysymysten perusteella. Siksi on tärkeää, että ulkomaalainen tutkija saa oikean käsityksen siitä, mitä vastaajilta on kysytty suomeksi.

Eräänä haasteena uskollisen muuttujakäännöksen tuottamiselle ovat alkuperäisissä teksteissä silloin tällöin esiintyvät virheet ja epäjohdonmukaisuudet. Pahimmillaan suomenkielisessä kysymyksessä esiintynyt virhe on voinut vaikuttaa siihen, miten tutkittavat ovat vastanneet kysymykseen, ja muun kielinen jatkokäyttäjä voi ihmetellä, mistä epäuskottavat frekvenssijakaumat mahtavat johtua. Kääntäjän onkin tällaisissa tilanteissa punnittava, kuinka merkittävä virhe on ja onko se saattanut vaikuttaa kysymyksen tulkintaan. Tämän lisäksi on mietittävä, kuinka tulkintaan mahdollisesti vaikuttanut virhe ilmaistaan tutkimusaineistoa käyttävälle asiakkaalle. Virheen toistaminen käännöksessä on harvoin hyvä vaihtoehto, sillä asiakas ei voi tietää, onko kyseessä kääntäjän vai alkuperäistekstin virhe.

Me Tietoarkiston kääntäjät olemme siinä mielessä onnellisessa asemassa, että meillä on mahdollisuus liittää kääntämiemme aineistojen yhteyteen lisätietoja käännöksistä. Lisätiedot kootaan yleensä erilliseen tekstitiedostoon, johon kääntäjät voivat myös kommentoida terminologiavalintojaan ja käyttämiään käännösstrategioita.

Kulttuurisidonnaiset ilmaisut vaativat pohdintaa

Yleisesti ottaen kääntäjän on vältettävä tulkitsemasta muuttujia omasta näkökulmastaan ja pyrittävä mahdollisimman neutraaliin käännökseen. Tämä ei kuitenkaan tarkoita, että tutkimusaineisto käännettäisiin suoraan sanasta sanaan, vaan etusijalla ovat aina tekstin ymmärrettävyys ja tekstin ajatuksen välittäminen kielestä ja kulttuurista toiseen. Tutkimusaineistojen kääntämisessä ollaan lopulta samankaltaisten haasteiden äärellä kuin muidenkin tekstien kääntämisessä, eli kuinka ilmaista toisesta kielestä tai kulttuurista kokonaan puuttuva käsite tai ilmaus ja kuinka siirtää lähtötekstin vivahteet toiselle kielelle.

Tutkimuksissa esitetyt kysymykset sisältävät usein kulttuurisidonnaisia elementtejä, joille ei ole olemassa termejä englanniksi. Tällöin termien käsitesisällöt täytyy selittää auki ulkomaalaiselle jatkokäyttäjälle. Esimerkiksi eräässä aineistossa vastaajilta kysyttiin sitä, kuuluvatko "punaiset tuvat ja perunamaat" suomalaiseen maaseutumaisemaan. Ilmaus on hyvin kulttuurisidonnainen, ja vaikka sille löytyisikin vastineita joistakin kulttuureista, on otettava huomioon, että asiakkaamme voivat olla mistä päin maailmaa tahansa. Siksi kysymyksen niin sanottu kotouttaminen yhteen kulttuuriin tai maahan, vaikkapa yhdysvaltalaisille tutulla kielikuvalla, ei ole suositeltavaa. Myös tässä tapauksessa on suureksi avuksi, että voimme toimittaa asiakkaalle lisätietoja käännöksestä ja selittää esimerkiksi, että punainen tupa ja perunamaa ymmärretään Suomessa usein eräänlaisena maalaisidyllinä.

Tietoarkiston käännösprosessi vie aineiston koosta ja kääntäjien työmäärästä riippuen yleensä muutaman viikon, jonka jälkeen aineisto on muidenkin englanninkielistä aineistoa tarvitsevien käytössä Aila-palvelun kautta. Tämän vuoksi aineistot käännetään aina huolellisesti kokonaan.

Kyselylomakkeita ei kannata kääntää hätäillen

Joidenkin mielestä käännöksellä ei koskaan päästä niin lähelle alkuperäisen tekstin merkitystä, että erikielisten muuttujien vertailu tutkimuksessa olisi mielekästä. Eräät tutkijat ovat esimerkiksi huomauttaneet, että usein käytetyt hyvinvoinnin mittarit mittaavat itse asiassa eri asioita eri kielillä.2 Täydellistä kielten välistä vastaavuutta tuskin saavutetaan käännöksellä juuri koskaan, ja se on harvoin kääntämisen tavoite. On hyvä muistaa, että kieli rakentuu erilaisten tulkintojen varaan. Kyselytutkimuksissa mitataan yleensä vastaajien asenteita ja näkemyksiä, ja samaa kieltä puhuvatkin voivat ymmärtää saman kysymyksen eri tavoin.

Aina kyselylomakkeiden huolellista laatimista ja kääntämistä ei nähdä tutkimuksen kannalta oleellisena, vaikka oikein muotoilluilla kysymyksillä on merkitystä kyselyn tulosten validiteetin kannalta. Kansainvälisissä vertailuaineistoissa on erityisen tärkeää, että eri kielillä käytettävissä kyselylomakkeissa kysytään mahdollisimman tarkasti samoja asioita. Kyselylomakkeiden käännättäminen ammattikääntäjällä kannattaa ottaa huomioon jo aineistonkeruuta suunnitellessa, jos kyselylomakkeita aiotaan käyttää muulla kielellä kuin suomeksi. Suomeksikin kysymysten kieliasu kannattaa tarkistuttaa, jotta heikko tai epäjohdonmukainen kieli ei vaaranna tutkimuksen tavoitteita.

Kysymysten muotoilussa täytyy siis olla tarkka ja huolellinen niin suomeksi kuin englanniksikin. Pyörää ei tarvitse kuitenkaan keksiä uudelleen; suomeksi kysymyslomakkeita muotoillessa kannattaa käyttää hyväksi palveluportaali Ailan muuttujahakua ja etsiä esimerkkejä aiemmin käytetyistä kysymyksistä, ja englanniksi voi hyödyntää esimerkiksi UKDS:n kysymyspankkia sekä CESSDAn tulevaa Euro Question Bankia.

Henri Ala-Lahti
tutkimusamanuenssi
etunimi.sukunimi [at] uta.fi

Niko Koski
tutkimusapulainen
etunimi.sukunimi [at] uta.fi


1 Schuman, Howard & Stanley Presser (1996), Questions and Answers in Attitude Surveys: Experiments on Question Form, Wording, and Context. Thousand Oaks: SAGE
2 Lolle, Henrik Lauridsen & Jørgen Goul Andersen (2015), "Measuring Happiness and Overall Life Satisfaction: A Danish Survey Experiment on the Impact of Language and Translation Problems", Journal of Happiness Studies 17 (4): 1337-1350.

Tämä blogikirjoitus on luettavissa myös englanniksi:
Translation and international use of research data.

20. syyskuuta 2018

Ailassa nyt tallennustyökalu aineistojen arkistointiin

Tietoarkisto on ottanut palveluportaali Ailassa käyttöön aineistojen tallennustyökalun. Tavoitteena on saada tulevaisuudessa kaikki aineistot arkistoitavaksi Tietoarkistoon Ailan kautta. Palvelu on helppokäyttöinen ja tietoturvallinen. Toivomme sen myös tehostavan aineistojen toimittamista Tietoarkistoon.

Siirtämällä datan Ailaan asiakas ei julkaise aineistoa itsenäisesti. Kyseessä ei siis ole itsearkistointi. Tietoarkiston asiakaspalvelu tarkistaa saadun materiaalin ja arvioi arkistointikelpoisuuden sekä prosessoi ja kuvailee datan Tietoarkiston käytäntöjen mukaan. Aineisto tulee Ailan aineistoluetteloon vasta tämän jälkeen - aivan kuten tähänkin asti.

Asiakkaalle uusi työkalu näkyy, jos hän on sopinut Tietoarkiston kanssa aineiston arkistoinnista ja hyväksynyt käsittelysopimuksen. Käytännössä aineistopalvelu luo Ailaan työtilan sovittua aineistonluovutusta varten ja lähettää kirjautumiskutsun. Luovutus on asiakkaan käytettävissä, kunnes hän on siirtänyt kaiken tarvittavan materiaalin Ailaan ja merkinnyt luovutuksensa valmiiksi. Sen jälkeen asiakaspalvelu ottaa datan käsiteltäväkseen. Tutkija voi siirtää joko kaikki tiedostot kerralla tai tarkastella ja täydentää luovutustaan myöhemmin jättäen luovutuksensa aktiiviseksi. Aineistoja ei kuitenkaan säilytetä luovutustyökalun työtilassa pysyvästi. Tiedostot poistetaan viimeistään, kun arkistointi on valmis.

Uusi palvelu varmistaa turvallisen datan siirron

Tutkijat ovat tottuneet toimittamaan dataa Tietoarkistoon sähköpostin liitteenä tai joissakin tapauksissa postitse erilaisilla tallennusvälineillä. Tietoarkistolla ei ole kummassakaan tapauksessa mahdollisuutta varmistaa datan siirron tietoturvallisuutta. Voimme pelkästään ohjeistaa asiakasta. Kun luovutustyökalu on käytössä, nämä huolet vähenevät, vaikka kanta-asiakkailla voikin kulua tovi uuden tavan oppimisessa.

Uudistuksen myötä arkistoinnin henkilöriippuvuus siirtyy toivottavasti myös historiaan. Luovutustyökalua käyttämällä tieto Ailaan siirretystä aineistosta tulee ajantasaisesti asiakaspalveluun, ja aineiston käsittelyprosessikin voi tästä vauhdittua. Vaikka saattaa tuntua kätevämmältä lähettää tiedostot sähköpostitse tutulle henkilölle, kannustan Ailan luovutustyökalun käyttämiseen.

Uusi palvelu joutuu testiin syksyn aikana toivottavasti monien asiakkaiden käytössä. Jos suunnittelet aineiston arkistointia Tietoarkistoon, ota yhteyttä Tietoarkistoon ja tutustu myös Aineiston luovuttaminen Ailassa -ohjeeseen.

Käyttäjäpalaute palvelun toimivuudesta ja mahdolliset kehitysehdotukset ovat tervetulleita.

Tietoarkisto on rakentanut luovutustyökalun Suomen Akatemian infrastruktuurirahoituksella.

Lisätietoa:

» Aineiston luovuttaminen Ailassa -ohje
» asiakaspalvelu.fsd [at] uta.fi

Helena Laaksonen
johtaja
etunimi.sukunimi [at] uta.fi

15. syyskuuta 2016

Data Service Portal Aila: accessibility and practicality for non-Finnish speakers

The Finnish Social Science Data Archive (FSD) is one of the most important national resources for the collection and storing of social research data. Among the many services they offer, they aim to make research data available to everyone, free of charge. In order to be able to make data accessible not only to Finnish people, but also to international researchers or students involved in research projects, they provide datasets translated into English.

Their Data Service Portal is called Aila and is easily accessible for international users from the FSD English Website. It contains a list of more than 1,200 datasets, many of which are available in English that can be conveniently searched through by using the feature "Search". This allows users to find data suitable for their project easily, a process that would otherwise be extremely time-consuming and which could also be inconclusive. Access conditions apply to most datasets, some of which are only available for research purposes and others only for research, teaching and study purposes. A small percentage can only be used upon permission from the depositor or creator of the data.

As a placement student at the FSD, who is not familiar with the content of their digital archive, I was asked to assess how easy it is to find and access data in English through Aila. For this purpose, I first started by researching a specific dataset. By using "Data Search" finding the dataset was quick and simple. The results included not only the specific year of the survey I was looking for, but also all of the previous waves. This is useful when one is interested in carrying out a study that compares data over time.

Although the process seems to be very straight forward, one needs to be careful before downloading a dataset, as not all of them contain data that has been translated into English. In fact, the portal Aila includes study descriptions in English for all of the studies in the archive, but this does not imply that all of the data has been translated. To make sure that the data is in English one should double-click on the dataset to open the description page and check on the yellow box on the right-side that it contains related files in English (e.g. the codebook).

Still, even if related files are not currently available in English, users can request for the dataset to be translated, a service offered by the FSD free of charge. This is almost exclusively done for quantitative studies, as the amount of text contained in qualitative studies would require a much more demanding process. Only less than 15% of the datasets are qualitative, however. This means that a translation can be requested for the vast majority of the data.

Many users may also have a specific topic to research, but may still not know the specific name of a dataset available for them to use. With this idea in mind, and focusing on specific terminology from the final project for university that I am currently working on, I used the "Variable Search" tool. As the topic I was searching for was quite niche, I was very surprised to find out that Aila contains some feasible data. This clearly indicates that the archive is truly rich in content. "Variable Search" highlights the exact variables that contain the terms searched for, within all of the datasets available in the archive. This is a quick way to find datasets that have already been translated into English.

In conclusion, the Data Service Portal Aila is an extremely useful tool not only for Finnish people, but also for those looking for data in English. It is accessible to everyone, easy to use and does not require extremely complicated procedures to obtain data. Perhaps requesting the translation of a specific dataset would involve a longer process, however it is certainly undeniable that the FSD succeeds in its aim to make research data available and accessible to everyone.

Laura Chieri
Q-Step Student

26. elokuuta 2016

Miten aineistot arkistoituvat Tietoarkistoon?

Kun tutkija tai tutkijaryhmä on lähettänyt tutkimusaineistonsa Tietoarkistoon arkistoitavaksi, varsinainen aineiston käsittelyprosessi vasta alkaa. Arkistoitavaksi toimitettu aineisto kulkee aina aineistonkäsittelijän sormien läpi ennen kuin se julkaistaan palveluportaali Ailassa jatkokäyttöä varten.

Erilaiset tietokoneohjelmat helpottavat, nopeuttavat ja virtaviivaistavat aineiston käsittelyä, mutta loppujen lopuksi aineiston käsittelyyn liittyvän työn tekevät ihmiset eivätkä koneet. Näin pystymme varmistamaan, että mitä moninaisimmat aineistot ovat tulevaisuudessakin tutkimusmaailman käytettävissä yhdenmukaiseksi suunniteltujen ohjeidemme mukaisesti.

Aineistonkäsittelijäntyö on Tietoarkiston ydintyötä, jota ilman Ailassa ei olisi jatkokäyttökelpoisia aineistoja. Tietoarkiston pitkäaikaiset tutkimusapulaiset Eliisa Haanpää (kvantitatiivisten aineistojen käsittely) ja Annika Sallinen (kvalitatiivisten aineistojen käsittely) kertovat, minkälaista aineistonkäsittelijän työ on, ja minkälaisen prosessin aineistot käyvät läpi ennen kuin ne ilmestyvät Ailaan.

Kyselytutkimukset arkistoituvat muuttuja muuttujalta

Eliisa

Aloitan kvantitatiivisen aineiston käsittelyn aina tutustumalla aineistoon, siihen sisältyviin muuttujiin sekä aineistoon liittyvään tutkimusraporttiin ja lisämateriaaliin. Avattuani datatiedoston, tarkastan ensimmäisenä kaikki muuttujat ja varmistan, että käsiteltävä data vastaa kyselylomaketta. Nimeän muuttujat kyselylomakkeen mukaisesti, mihin perustuen määrittelen myös muuttujien selitteet.

Tämän jälkeen arvioin aineiston tunnisteellisuutta ja arkaluontoisuutta, jonka jälkeen teen tarvittavat toimet vastaajien anonymiteetin säilyttämiseksi. Tässä vaiheessa apunani ovat usein Tilastokeskuksen erilaiset alue-, toimiala- ja tieteenalaluokitukset. Lopuksi vielä varsinaista dataa käsitellessäni tarkistan muuttujien frekvenssit suhteessa tutkimusraporttiin.

Käsittelen dataa SPSS:n syntaksin avulla. Numeroista ja loogisesta päättelystä pitävänä ihmisenä syntaksin työstäminen on mielestäni palkitsevaa puuhaa. Syntaksin tekemiseen sisältyy monia yksin ja yhdessä kollegojen kanssa pohdittavia haasteita, useita onnistumisen kokemuksia, kun komennot toimivat toivomallani tavalla ja tietysti työni kannalta tärkein tuotos, jatkokäyttöön valmistuva datatiedosto.

Varsinaisen datan valmistuttua siirryn aineiston kuvailuun, johon kuuluu muuttujien kuvailu sekä aineiston sisällöllinen kuvailu. Tietopankkina sisällöllistä kuvailua tehdessäni käytän tutkimusraporttia ja sieltä löytyviä aineistonkeruuseen liittyviä tietoja. Aineiston (eli datan sekä aineiston kuvailun) käsittelyn valmistuttua kirjaan tietokantaamme "data valmis"-komennon, jonka jälkeen aineisto julkaistaan palveluportaali Ailassa.

Aineistoja käsitellessäni olen oppinut paljon paitsi tilastollisista menetelmistä ja kyselytutkimuksista, myös eri tieteenalojen tutkimusteemoista. Olen tähän mennessä käsitellyt aineistoja liittyen muun muassa lasten ja nuorten mediakäyttäytymiseen, lasten uhrikokemuksiin, suomalaisten hyvinvointiin, eduskuntavaaleihin, asumiseen ja kaupunkikuvaan, opiskeluun sekä vapaaehtoistoimintaan.

Aineiston käsittelyn eri vaiheissa olen yhteydessä yhteen tai useampaan tutkijaan, mikäli tarvitsen aineistosta lisätietoja. Yhteistyö sekä tutkijoiden suuntaan että kollegoiden kanssa on erittäin merkittävässä osassa työskentelyssäni aineistojen parissa.

Kvalitatiivisessa aineistossa tallentuu aina pala aikaa

Annika

Kvalitatiivisten aineistojen arkistointi poikkeaa kvantitatiivisten aineistojen arkistoinnista sikäli, ettei siinä tarvitse pohtia syntaksin komentoja, mutta lukulihaksia työ vaatii senkin edestä. Luemme tänne toimitetuista haastatteluista ja kirjoituksista jokaisen sivun. Tämä täytyy tehdä huolellisesti, että ihmisten tunnistetietoja ei jää luovutettavaan aineistoon. Tekstimassaa saattaa olla yhdessä aineistossa jopa lähes tuhat sivua.

Kvalitatiivisten aineistojen tarkastaminen on siis välillä uppoutumista lukemiseen, mutta työ sisältää myös järjestelmällistä tiedon poimimista sekä järjestelyä ja tietokoneohjelmien kanssa kikkailua - mikä on aina oma taiteenlajinsa.

Dokumentit nimetään järjestelmällisesti. Aineistojen taustatiedot järjestetään yhdenmukaisiksi ja niistä tehdään taustatietohakemisto jatkokäyttäjälle. Työssä käytetään lukuisia ohjelmia, joista tekninen palvelu keskustelee mm. termeillä DDI, HTML ja Python - minä keskityn opettelemaan konkreettisen käytön.

Koko arkistointiprosessin ajan teen muistiinpanoja eteen tulleista ongelmakohdista, niiden ratkaisuista ja vielä tehtävistä vaiheista. Listalla voi olla selvitettävänä, mitä tutkijan kryptinen merkintä muistiinpanoissa tarkoittaa, mihin teollisuusalaan karkeistetaan Suomussalmen Hallan lihajalostamo, sisältävätkö dokumentit piilodataa ja saisiko 400 erillisen tiedoston nimet muutettua automaattisesti toiseen muotoon, jotta kaikkea ei tarvitsisi tehdä käsin.

Kaikkeen löytyy yleensä vastaus, joko kollegoilta, tutkijoilta tai yhdeltä tärkeältä työkaverilta - internetistä. Netti on ollut oiva apu esimerkiksi tilanteessa, jossa oman pään kapasiteetti keksiä suomalaista naisten nimiä on tullut tiensä päätökseen.

Minun mielestäni kvalitatiivisten aineistojen arkistointi on erittäin mielenkiintoista, sillä tutkimusaineistoon perehtyminen on aina oma matkansa jonkin tieteenalan ja alueen tutkimuksen pariin. Aineistoja läpi kahlatessa oppii uusia käsitteitä ja ymmärtää taas elämää eri näkökulmista ehkä hitusen paremmin. Tutkittavat kertovat tutkijalle elämästään asioita, joita eivät muille välttämättä kerro. Työ sisältää myös varjopuolia. Koska kaikki työvaiheet vaativat tarkkuutta ja keskittymistä, silmien ja lukuhermojen ajoittaiselta väsymisiltä ei voi välttyä.

Arkistoinnin loppusuoralla kirjoitetaan vielä nettisivuille tuleva kuvaus aineistosta ja hiotaan aineiston yksityiskohtia. Esimerkiksi taustatietoihin tulee helposti virheitä. Minun tulee myös tarkastaa, että aineistoon on liitetty mukaan tutkimuskutsut, haastattelukysymykset ja muut tarvittavat dokumentit. Lisäksi haastattelukysymykset tulee tallentaa Aila-hakuun. Julkaisun jälkeen menen vielä nettisivuille katsomaan, että aineisto näyttää siellä siltä, miltä sen pitääkin!

Lisätietoa:
» Palveluportaali Aila

Annika Sallinen, tutkimusapulainen, etunimi.sukunimi [at] uta.fi
Eliisa Haanpää, tutkimusapulainen, etunimi.sukunimi [at] uta.fi

20. marraskuuta 2015

Arkistoinnista poliittiseen päätöksentekoon

Tutkimusaineistojen arkistointi parantaa yhteiskunnasta kaikki taudit ja vaivat. Ei ole niin pientä tai isoa huolta, ettei siihen löytyisi helpotusta jo arkistoidusta aineistosta. Vai kuinka se nyt menikään? Ehkä on sittenkin syytä palata vähän taaksepäin ja aloittaa alusta.

Terveydenhuoltotutkimuksen päivillä Liina-Kaisa Tynkkynen Tampereen yliopistosta piti erinomaisen esitelmän aiheesta, miten saada tutkimustulokset nousemaan akateemisen kiinnostuksen tasolta poliittisen päätöksenteon pohjatiedoksi. Erityisesti nyt, kun yhteiskunnassa tehdään isoja muutoksia rakenteisiin, soisi päätösten pohjautuvan tutkittuun tietoon, ei pelkästään poliittisiin agendoihin.

Tärkein viesti Tynkkysen puheessa oli tutkimustiedon esiin tuomisen oikea ajankohta. Jokaisessa päätösprosessissa on olemassa tietty vaihe, mahdollisuuksien ikkuna, jonka aikana päättäjille tuotu tieto vaikuttaa.

Tärkeää on myös osata viestiä asiastansa oikein. Viestin sisältöä pohtiessa on syytä kiinnittää huomiota siihen, mikä viesti itse asiassa on. Keneen halutaan vaikuttaa: poliittisiin päättäjiin, yleiseen mielipiteeseen vai esimerkiksi terveydenhuollon tuottajiin? Entä mikä olisi hyvä viestintäkanava, ja kenen kannattaisi viedä viestiä päättäjille? Tutkija itse ei ole aina paras mahdollinen valinta. Olennaista on myös tehdä itsellensä selväksi, mitä haluaa saada aikaan: onko tarkoitus tarjota ratkaisuja tai antaa päätöksentekoprosessiin uutta tietoa vai tuoda päättäjille esiin ongelma?

Toki tutkijan vaikuttamisen tiellä on monia haasteita. Esimerkiksi poliittinen ilmapiiri ei ehkä juuri nyt ole kaikkein otollisin - Suomessa tuntuu olevan vallalla kulttuuri, jossa tehdään mieluummin kokeiluja kuin tutkimustietoon nojaavia päätöksiä. Realisti ymmärtää, että yksittäisellä tutkimuksella tuskin pystyy muuttamaan politiikan suuntaa. Toisaalta kannattaa muistaa, että mitä enemmän luotettavaa tutkimustietoa kertyy, sitä vahvempi paino sillä on.

Ja miten tämä kaikki taas liittyy tutkimusaineistojen arkistointiin? Tutkimuksen ei tarvitse jäädä yksittäiseksi tähdenlennoksi, jonka mahdollisuus päästä vaikuttamaan asioihin jää pieneksi, vaan tutkimusaineiston voi arkistoida ja saattaa muiden tutkijoiden käyttöön. Tällöin kenties toinen, samaa ilmiötä tutkiva henkilö, voi käyttää sitä oman aineistonsa lisänä tai löytää ilmiöön uuden tutkimusnäkökulman, ja viesti pääsee vahvistumaan. Myös jo unohtuneet tutkimustulokset voidaan ottaa vertailukohdaksi ja parhaimmillaan kahden aineiston avulla verrata tilannetta ennen ja jälkeen tapahtuneen muutoksen.

Tietoarkistokin muuten oli esillä Terveydenhuoltotutkimuksen päivillä. Ensimmäisen päivän rinnakkaissessiossa pääsin itse pitämään esitelmän terveystietoja sisältävien aineistojen arkistoinnista. Lisäksi tapahtumassa oli esillä Tietoarkiston palveluportaali Ailasta kertova rollup.

Lisätietoa:
» Terveydenhuoltotutkimuksen päivät 2015
» Tietoarkiston palveluportaali Aila

Annaleena Okuloff
tieteenala-asiantuntija
etunimi.sukunimi [at] uta.fi