NST dansk ATG-database (16 kHz) – reorganisert

Denne databasen er laget av Nordisk språkteknologi som datagrunnlag for talegjenkjenning og diktering på dansk. I denne versjonen er dataene strukturert på nytt, slik at databasen enklere kommer til anvendelse.

I den opprinnelige versjonen av materialet var filene organisert i en bestemt mappestruktur der mappenavnene var meningsbærende. Filnavnene var imidlertid ikke meningsbærende, og det fantes også tilfeller av filer med samme navn i forskjellige mapper. Dette viste seg å være upraktisk, siden brukere måtte beholde den opprinnelige mappestrukturen for å kunne benytte seg av dataene.

Filene er derfor navngitt på nytt, slik at filnavnene er unike og meningsbærende uavhengig av mappestrukturen. De opprinnelige metadatafilene var i spl-format; disse er konvertert til JSON-format. Metadatafilene er anonymisert, og tekstkodingen er endret fra ANSI til UTF-8. Metadata og transkripsjoner foreligger også som CSV-filer.

Se dokumentasjonsfilen for en full beskrivelse av dataene og endringene som er gjort.

Last ned ressurser

Utvidet metadata

Last ned metadata (CMDI XML)

Last ned metadata (CMDI XML) https://www.nb.no/sprakbanken/oai?verb=GetRecord&identifier=oai:nb.no:sbr-55&metadataPrefix=cmdi

dc:type	corpus
dc:title	NST dansk ATG-database (16 kHz) – reorganisert
dc:identifier	oai:nb.no:sbr-55
dc:description	Denne databasen er laget av Nordisk språkteknologi som datagrunnlag for talegjenkjenning og diktering på dansk. I denne versjonen er dataene strukturert på nytt, slik at databasen enklere kommer til anvendelse. I den opprinnelige versjonen av materialet var filene organisert i en bestemt mappestruktur der mappenavnene var meningsbærende. Filnavnene var imidlertid ikke meningsbærende, og det fantes også tilfeller av filer med samme navn i forskjellige mapper. Dette viste seg å være upraktisk, siden brukere måtte beholde den opprinnelige mappestrukturen for å kunne benytte seg av dataene. Filene er derfor navngitt på nytt, slik at filnavnene er unike og meningsbærende uavhengig av mappestrukturen. De opprinnelige metadatafilene var i spl-format; disse er konvertert til JSON-format. Metadatafilene er anonymisert, og tekstkodingen er endret fra ANSI til UTF-8. Metadata og transkripsjoner foreligger også som CSV-filer. Se dokumentasjonsfilen for en full beskrivelse av dataene og endringene som er gjort.
dc:publisher
dc:format	downloadable
dc:date	1998-01-05
dc:date	2022-03-11
dc:rights	Public
dc:rights	Creative Commons (CC)
dc:rights	Creative_Commons-ZERO (CC-ZERO)
dc:rights	https://creativecommons.org/publicdomain/zero/1.0/
dc:creator	Nordisk språkteknologi AS
dc:creator	Lars Johnsen
dc:creator	Per Erik Solberg
dc:creator	Peter Sletten
dc:lang	dansk

NST dansk ATG-database (16 kHz) – reorganisert

Last ned ressurser

Utvidet metadata

Dublin Core (DC)

Last ned metadata (CMDI XML)