- Definisjon av tidsserier er datasett samlet inn med jevne mellomrom for å forutsi fremtidige trender.
- Fordeling av grunnleggende komponenter: trend, sesongvariasjoner, sykluser og tilfeldig støy.
- En sammenligning mellom de ulike modelleringsmetodene, fra klassiske og ARIMA-metoder til dyp læring og AI.
- Praktiske anvendelser i kritiske sektorer som helsevesen, finans, energi og e-handel.

Du har sikkert lurt på hvordan noen selskaper ser ut til å forutsi fremtiden, eller hvordan de vet nøyaktig når det vil være en topp i etterspørselen etter et produkt. Det er ikke magi eller en krystallkule; de bruker tidsserieanalyse , et kraftig verktøy for å forstå hvordan data utvikler seg over tid og forutse hva som kommer.
I bunn og grunn snakker vi om å samle inn data med jevne mellomrom, for eksempel daglig nedbør eller månedlig salg. Det interessante her er at vi ikke behandler dataene som isolerte deler, men heller forstår at fortiden direkte påvirker fremtiden , slik at vi kan oppdage mønstre som ellers ville gått ubemerket hen gjennom datautvinning.
Hvordan er en tidsseriemodell strukturert?

For å unngå forvirring er det viktig å forstå at en tidsserie kan deles inn i flere komponenter. I en additiv modell sier vi for eksempel at verdien på et gitt tidspunkt er summen av trenden, sesongmessigheten og tilfeldigheten . Hvis oppførselen er mer kompleks, kan det hende vi trenger en multiplikativ modell der disse elementene forsterker hverandre.
- Trend: Det er den generelle retningen. Den forteller oss om ting går opp, ned, eller om de vil forbli stabile på lang sikt.
- Sesongvariasjoner: Dette er mønstre som gjentar seg med jevne mellomrom. For eksempel å selge flere skjerf om vinteren eller at strømforbruket øker i løpet av dagen.
- Syklus: I motsetning til sesongmessighet er sykluser repetisjoner som ikke har en fast periode og analyseres fra et mer globalt perspektiv.
- Tilfeldig variasjon eller støy: Det er de uforutsigbare hendelsene. motstridende data eller feil som ikke følger noen regler og som gjør det vanskelig å forutsi.
Klassifiseringsmetoder og -tilnærminger

Avhengig av hva vi leter etter, kan vi nærme oss problemet fra forskjellige vinkler. Å ønske et raskt estimat er ikke det samme som å bygge et hypernøyaktig prediksjonssystem basert på kunstig intelligens og dyp AI-resonnement.
Klassiske og ikke-parametriske modeller
Her finner vi verktøy som glidende gjennomsnitt, som brukes til å evaluere kortsiktige svingninger ved å beregne gjennomsnittet av et gitt intervall. Det finnes også tidsutjevning, som gir mer vekt til nyere data for å bedre gjenspeile den umiddelbare trenden. Disse metodene er vanligvis ikke-parametriske, ettersom de fokuserer på å estimere trenden uten å anta at prosessen har en fast struktur.
Autoregressive integrerte modeller (ARIMA)
Når ting blir mer alvorlige, kommer ARIMA-modeller inn i bildet. Disse kombinerer autoregresjon, differensiering og glidende gjennomsnitt. Det er en mye kraftigere tilnærming for å håndtere komplekse data og ikke-stasjonære serier, slik at dataene kan transformeres til de blir stabile og forutsigbare.
Dyp læring og nevrale nettverk
Med AI-boomen bruker vi nå tilbakevendende nevrale nettverk og modeller for langtidsminne (LTSM) . Disse maskinene er i stand til å behandle enorme mengder informasjon og forstå hvordan nevrale nettverk lærer å plukke opp utrolig komplekse mønstre som en klassisk modell ikke engang ville komme i nærheten av å gjenkjenne, selv om de selvfølgelig krever mye mer datakraft.
Avanserte tekniske klassifiseringer

For å bli mer teknisk deler faglitteraturen disse teknikkene inn i flere grupper. På den ene siden finnes det frekvensdomenemetoder (som wavelet-analyse) og tidsdomenemetoder (som krysskorrelasjon). Det skilles også mellom parametriske metoder, som bruker noen få parametere for å beskrive prosessstrukturen, og ikke-parametriske metoder, som ikke antar noen forhåndsstruktur.
Videre kan vi diskutere lineære eller ikke-lineære modeller, og om de er univariate eller multivariate , avhengig av hvor mange variabler vi analyserer samtidig. I kritiske situasjoner, som for eksempel Covid-19-pandemien, har en robust tidsseriebasert metode noen ganger vist seg å være å foretrekke fremfor spesifikke modeller (som SIR-modellen), ettersom den tillater oppdatering av antagelser underveis med nye data.
Virkelige applikasjoner på arbeidsplassen

Denne modelleringen er ikke bare matematisk teori; den brukes i sektorer som håndterer millioner av euro og redder liv. I helsesektoren bidrar den til å forutsi epidemier og administrere sykehusressurser før en krise inntreffer. I finans- og handelsverdenen er det nøkkelverktøyet for å forutse aksjekurser eller kryptovalutabevegelser.
I energisektoren er det viktig å unngå ressurssløsing ved å beregne vinterenergibehov basert på data fra tidligere år . På den annen side bruker e-handel og markedsføring det til å optimalisere varelager og designe reklamekampanjer som når brukerne nøyaktig når de har tenkt å kjøpe, og dermed forbedre kundeopplevelsen og lojaliteten.
Evnen til å transformere historiske data til en veikart lar enhver organisasjon, fra en liten nettbutikk til en offentlig forvaltning, minimere risikoer og optimalisere planleggingen av sine menneskelige og materielle ressurser, og gjøre morgendagens usikkerhet om til en strategi basert på statistisk og beregningsmessig bevis.