<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Nedlasting av data om kjøretøy]]></title><description><![CDATA[<p dir="auto">Når man prøver å laste ned csv-data om kjøretøy så får man så store filer at mine verktøy ikke greier å behandle dem (flere GB).<br />
Løsningen ser ikke ut til å støtte at man kun laster ned de dataene man spesifiserer i filteret på visningssiden? Noen tips til hvordan dette kan løses?</p>
<p dir="auto"><a href="https://data.norge.no/datasets/a8533876-cca7-4417-90be-b368f7d9542c" rel="nofollow ugc">https://data.norge.no/datasets/a8533876-cca7-4417-90be-b368f7d9542c</a><br />
<img src="/assets/uploads/files/1641635547253-2022-01-05_13-32-40-kj%C3%B8ret%C3%B8y.png" alt="2022-01-05_13-32-40-kjøretøy.png" class=" img-fluid img-markdown" /></p>
]]></description><link>https://datalandsbyen.norge.no/topic/130/nedlasting-av-data-om-kjøretøy</link><generator>RSS for Node</generator><lastBuildDate>Tue, 21 Jul 2026 00:55:26 GMT</lastBuildDate><atom:link href="https://datalandsbyen.norge.no/topic/130.rss" rel="self" type="application/rss+xml"/><pubDate>Sat, 08 Jan 2022 09:52:48 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Sun, 28 Jan 2024 18:33:27 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/sven_bruun" aria-label="Profile: sven_bruun">@<bdi>sven_bruun</bdi></a> Bruker linken <a href="https://hotell.difi.no/download/vegvesen/kjoretoyinfo?download" rel="nofollow ugc">https://hotell.difi.no/download/vegvesen/kjoretoyinfo?download</a> til å analysere bilparken, men det ser ikke ut til at denne informasjonen er vedlikeholdt lenger. Hvor kan jeg finne fila med alle biler?</p>
]]></description><link>https://datalandsbyen.norge.no/post/968</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/968</guid><dc:creator><![CDATA[[[global:former-user]]]]></dc:creator><pubDate>Sun, 28 Jan 2024 18:33:27 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Thu, 15 Dec 2022 13:54:09 GMT]]></title><description><![CDATA[<p dir="auto">@robert-sasak sa i <a href="/post/264">Nedlasting av data om kjøretøy</a>:</p>
<blockquote>
<p dir="auto">Jeg kan ambefalle q (<a href="http://harelba.github.io/q/" rel="nofollow ugc">http://harelba.github.io/q/</a>) som en enkelt SQL databasen direkte mot CSV filen. Som sagt vi jobber mye med kjøretøy databasen og har flere interne API. Kanskje vi kan hjelpe med.</p>
</blockquote>
]]></description><link>https://datalandsbyen.norge.no/post/627</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/627</guid><dc:creator><![CDATA[[[global:former-user]]]]></dc:creator><pubDate>Thu, 15 Dec 2022 13:54:09 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Wed, 09 Feb 2022 09:27:23 GMT]]></title><description><![CDATA[<p dir="auto">Jeg har brukt Go med kun standard-biblioteket en del de siste årene for første behandling av store CSV-filer (og sammenstillng av Excel gjennom excelize biblioteket).  Go er minne-effektivt med utf-8 internt, og med litt parallell kjøring kan man iterere relativt hurtig på noen GB. I senere tid er  Copilot tjenesten til github nyttig og gjør at man kan skrive kommentarer som "UFT-16 with BOM transformer encoding" fremfor å lete i dokumentasjonen (Men, det blir jo litt kodelinjer, så det er ikke noe man alltid ønsker å dra frem)</p>
<p dir="auto">Dette er egentlig ikke noen erstatning for Pandas i python eller tidyverse i R.</p>
<p dir="auto">Google BigQuery er ganske rimelig når datasettet blir stort.</p>
]]></description><link>https://datalandsbyen.norge.no/post/305</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/305</guid><dc:creator><![CDATA[tov.are.jacobsen]]></dc:creator><pubDate>Wed, 09 Feb 2022 09:27:23 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Tue, 08 Feb 2022 10:07:35 GMT]]></title><description><![CDATA[<p dir="auto">Eg spurte også på Twitter om tips til korleis jobbe med store CSV-filer og fekk mange svar:<br />
<a href="https://twitter.com/livarb/status/1480534725429276672" rel="nofollow ugc">https://twitter.com/livarb/status/1480534725429276672</a></p>
<p dir="auto">Har ikkje rukke å oppsummere svara her - endå.</p>
]]></description><link>https://datalandsbyen.norge.no/post/303</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/303</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Tue, 08 Feb 2022 10:07:35 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Fri, 04 Feb 2022 12:39:32 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/sven_bruun" aria-label="Profile: sven_bruun">@<bdi>sven_bruun</bdi></a> sa i <a href="/post/282">Nedlasting av data om kjøretøy</a>:</p>
<blockquote>
<p dir="auto">Prøvde med et semikolon der først, men da fikk jeg feilmeldingen:<br />
Delimiter must be one character only</p>
</blockquote>
<p dir="auto">Det ein må gjere er å oppgje semikolon som separator i q-kommandoen. Eg køyrte kommandoen på min Macbook, og måtte nytte skråstrek for å unnsleppe (escape) semikolon som <a href="https://stackoverflow.com/a/27577487" rel="nofollow ugc">fungerer som skilje mellom to separate kommandoar</a>. Ut frå feilmeldinga frå q som du nemner, så har tydelegvis q fått inn meir enn eitt teikn. Har ikkje noko godt råd for korleis å få det til hos deg om det ikkje fungerer med kun semikolon eller med skråstrek i tillegg.</p>
]]></description><link>https://datalandsbyen.norge.no/post/297</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/297</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Fri, 04 Feb 2022 12:39:32 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Thu, 27 Jan 2022 16:58:40 GMT]]></title><description><![CDATA[<p dir="auto">Prøvde med et semikolon der først, men da fikk jeg feilmeldingen:<br />
Delimiter must be one character only</p>
]]></description><link>https://datalandsbyen.norge.no/post/282</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/282</guid><dc:creator><![CDATA[[[global:former-user]]]]></dc:creator><pubDate>Thu, 27 Jan 2022 16:58:40 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Thu, 27 Jan 2022 14:29:06 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/sven_bruun" aria-label="Profile: sven_bruun">@<bdi>sven_bruun</bdi></a> sa i <a href="/post/280">Nedlasting av data om kjøretøy</a>:</p>
<blockquote>
<p dir="auto">Fungerer dessverre ikke hos meg. Får feilmelding. Kan det være fordi det ser ut til å være noe grums i starten av csv filen?<br />
<img src="/assets/uploads/files/1643282035239-2022-01-27_12-12-41.png" alt="2022-01-27_12-12-41.png" class=" img-fluid img-markdown" /></p>
</blockquote>
<p dir="auto">Ser ut til at det manglar semikolon på delimiter-parameteret. Kan dette vere feilen?<br />
«--delimiter=\» skal vere «--delimiter=\;»</p>
<p dir="auto">Om det ikkje fungerer, så kan du prøve å laste ned fila utan BOM.<br />
Dersom ein brukar parameteret "?download" ved nedlasting av heile datasettet frå Datahotellet, så får ein med BOM (Byte Order Mark). Å ha med BOM ser ut til å hjelpe dersom ein vil opne fila direkte i Excel. Dersom ein ikkje har behov for BOM, så bør ein laste ned utan.</p>
<p dir="auto">Dei to alternative nedlastinglenkene er:<br />
<a href="https://hotell.difi.no/download/vegvesen/kjoretoy?download" rel="nofollow ugc">https://hotell.difi.no/download/vegvesen/kjoretoy?download</a> - med BOM<br />
<a href="https://hotell.difi.no/download/vegvesen/kjoretoy" rel="nofollow ugc">https://hotell.difi.no/download/vegvesen/kjoretoy</a> - utan BOM</p>
]]></description><link>https://datalandsbyen.norge.no/post/281</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/281</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Thu, 27 Jan 2022 14:29:06 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Thu, 27 Jan 2022 11:14:19 GMT]]></title><description><![CDATA[<p dir="auto">Fungerer dessverre ikke hos meg. Får feilmelding. Kan det være fordi det ser ut til å være noe grums i starten av csv filen?<br />
<img src="/assets/uploads/files/1643282035239-2022-01-27_12-12-41.png" alt="2022-01-27_12-12-41.png" class=" img-fluid img-markdown" /></p>
<p dir="auto">query error: no such column: tekn_merkenavn<br />
Warning - There seems to be a "no such column" error, and -H (header line) exists.<br />
Please make sure that you are using the column names from the header line and not the default (cXX) column names. Another issue might be that the file contains a BOM. Files that are encoded with UTF8 and contain a BOM can be read by specifying -e utf-9-sig in the command line. Support for non-UTF8 encoding will be provided in the future.</p>
<p dir="auto">Har så prøvd med<br />
<img src="/assets/uploads/files/1643282044557-2022-01-27_12-12-59.png" alt="2022-01-27_12-12-59.png" class=" img-fluid img-markdown" /></p>
<p dir="auto">men da får jeg feilmelding: Encoding utf-9-sig could not be found</p>
]]></description><link>https://datalandsbyen.norge.no/post/280</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/280</guid><dc:creator><![CDATA[[[global:former-user]]]]></dc:creator><pubDate>Thu, 27 Jan 2022 11:14:19 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Wed, 09 Feb 2022 08:16:48 GMT]]></title><description><![CDATA[<p dir="auto">Her er oppskrift på korleis du filtrerer ut ei delmengde av datasettet ved hjelp av <a href="http://harelba.github.io/q/" rel="nofollow ugc">q</a>, så du kan jobbe vidare med det i andre verktøy.</p>
<p dir="auto">Forutsetningar: q er installert og du har lasta ned kjøretøy-datasettet (kjoretoy.csv)</p>
<p dir="auto">Først kan du sjekke kor mange rader utvalget gir. Her med merkenamn = "BMW", som i skjermbildet i første posten din.</p>
<pre><code>q -C readwrite -H -O --delimiter=\; "SELECT COUNT(*) FROM kjoretoy.csv WHERE tekn_merkenavn = 'BMW'"
</code></pre>
<p dir="auto">Svaret er 286 833 treff, og det er godt under grensa på ca. 1 million rader i Excel.</p>
<p dir="auto">Neste steg er å lagre delmengda til ei ny fil (kjoretoy_bmw.csv):</p>
<pre><code>q -C read -H -O --delimiter=\; "SELECT * FROM kjoretoy.csv WHERE tekn_merkenavn = 'BMW'" &gt; kjoretoy_bmw.csv
</code></pre>
<p dir="auto">I første kommandoen opprettar ein også ei cache-fil (parameter: -C readwrite) som gjer at vidare kommandoar på samme datasett går mykje fortare ved bruk av cache (parameter: -C read). Første kommandoen tok ca. 10 minutt hos meg, mens 2. kommando tok eit halvt minutt. Dersom eg køyrer første kommandoen på nytt med cache, så tar det rundt 5 sekund.</p>
<p dir="auto">Cache-fila tar ein del diskplass - om lag like mykje som sjølve datasettet.</p>
<p dir="auto"><strong>OBS</strong>! Dersom ein opnar ei CSV-fil direkte i Excel, så vil Excel gjette kva datatypar det enkelte felt/kolonne har. Det kan føre til at data blir endra til feil datatype (f.eks. tal blir datoar). For å unngå at Excel rotar til dataene, kan ein først opne Excel, og deretter importere CSV-fila. Brønnøysundregistrene har skrive <a href="https://www.brreg.no/produkter-og-tjenester/apne-data/register-offentlig-stotte/om-tjenesten/" rel="nofollow ugc">tips om dette på sine nettsider (under "Korrigere formatfeil i CSV-dokumentet")</a>.</p>
]]></description><link>https://datalandsbyen.norge.no/post/274</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/274</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Wed, 09 Feb 2022 08:16:48 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Sat, 22 Jan 2022 10:15:28 GMT]]></title><description><![CDATA[<p dir="auto">Målet er å lage noe statistikk rundt enkelte kjøretøymodeller. Har brukt Microsoft Access og Excel, og begge har begrensning på antall rader. Å kjøre filen gjennom grep er en mulighet for å gjøre dem mindre før import, men filtreringen der er jo ganske simpel.</p>
]]></description><link>https://datalandsbyen.norge.no/post/271</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/271</guid><dc:creator><![CDATA[[[global:former-user]]]]></dc:creator><pubDate>Sat, 22 Jan 2022 10:15:28 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Sun, 16 Jan 2022 17:16:15 GMT]]></title><description><![CDATA[<p dir="auto">Jeg kan ambefalle q (<a href="http://harelba.github.io/q/" rel="nofollow ugc">http://harelba.github.io/q/</a>) som en enkelt SQL databasen direkte mot CSV filen. Som sagt vi jobber mye med kjøretøy databasen og har flere interne API. Kanskje vi kan hjelpe med.</p>
]]></description><link>https://datalandsbyen.norge.no/post/264</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/264</guid><dc:creator><![CDATA[robert.sasak]]></dc:creator><pubDate>Sun, 16 Jan 2022 17:16:15 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Tue, 11 Jan 2022 13:00:53 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/sven_bruun" aria-label="Profile: sven_bruun">@<bdi>sven_bruun</bdi></a> sa i <a href="/post/259">Nedlasting av data om kjøretøy</a>:</p>
<blockquote>
<p dir="auto">Når man prøver å laste ned csv-data om kjøretøy så får man så store filer at mine verktøy ikke greier å behandle dem (flere GB).<br />
Løsningen ser ikke ut til å støtte at man kun laster ned de dataene man spesifiserer i filteret på visningssiden? Noen tips til hvordan dette kan løses?</p>
</blockquote>
<p dir="auto">Kan du seie meir om kva du vil gjere med dataene?</p>
<p dir="auto">Tenker det er to måtar å angripe dette på:</p>
<ol>
<li>
<p dir="auto">Gjere det du ønskjer med dataene i andre verktøy enn dei du vanlegvis brukar</p>
</li>
<li>
<p dir="auto">Bruke andre verktøy til å hente ut ein del av datasettet som er så liten at den går an å jobbe med i dei vanlege verktøya.</p>
</li>
</ol>
]]></description><link>https://datalandsbyen.norge.no/post/263</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/263</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Tue, 11 Jan 2022 13:00:53 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Mon, 10 Jan 2022 13:35:13 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/sven_bruun" aria-label="Profile: sven_bruun">@<bdi>sven_bruun</bdi></a><br />
Kva verktøy er det du brukar? Det er gjerne ulike begrensingar frå verktøy til verktøy.<br />
Begrensinga mange møter på er i <a href="https://support.microsoft.com/en-us/office/excel-specifications-and-limits-1672b34d-7043-467e-8e27-269d656771c3" rel="nofollow ugc">Excel, som ikkje kan jobbe med meir enn litt over 1 million rader</a>.</p>
<p dir="auto"><strong>Støtte i dagens datahotell</strong><br />
Det stemmer at datahotellet ikkje har støtte for å laste ned utsnitt av datasett. Dersom ein gjer utsnitt (filtrerer), så kan ein via API-et hente ut 100 oppføringar om gangen, men for så store datasett egnar ikkje dette seg.</p>
<p dir="auto">Grunnen til at dagens datahotell ikkje støtter dette er på den eine sida at det ville vere ressurskrevjande for datahotellet å ha ein slik funksjon, og at dagens datahotell ikkje har hatt noko vesentleg utvikling på mange år. I <a href="https://datafabrikken.norge.no/" rel="nofollow ugc">Datafabrikken</a> jobbar vi med ny infrastruktur som skal erstatte dagens datahotell på sikt.</p>
<p dir="auto"><strong>Moglege verktøy å bruke</strong></p>
<p dir="auto"><a href="https://github.com/variar/klogg" rel="nofollow ugc">Klogg</a> er eit verktøy for å opne svært store filer. Nyttig for å opne og sjå på store reine tekstfiler (som CSV) som ein ikkje elles får opna i vanlege tekst-editorar. Ein kan gjere fritekst-søk i filene, men det har ikkje noko spesiell støtte for CSV-filer.</p>
<p dir="auto"><a href="https://www.moderncsv.com/" rel="nofollow ugc">Modern CSV</a> er eit skrivebordsprogram for å jobbe med CSV-filer, og ser ut til å ha støtte for store filer. For å jobbe med store filer ser det ut til at ein treng betal-versjonen.</p>
<p dir="auto"><a href="http://harelba.github.io/q/" rel="nofollow ugc">q</a> er eit verktøy for kommandolinja som lar ein skrive SQL-spørringar på filer. Muleg q kan oppfylle behovet, eller at ein ved hjelp av q kan filtrere datasettet ned til ein størrelse som gjer at ein kan jobbe vidare med det i ditt foretrukne verktøy.</p>
<p dir="auto">Har ikkje prøvd dei to sistnemde med dette datasettet. Skal prøve det ut og oppdatere posten.</p>
]]></description><link>https://datalandsbyen.norge.no/post/261</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/261</guid><dc:creator><![CDATA[livar.bergheim]]></dc:creator><pubDate>Mon, 10 Jan 2022 13:35:13 GMT</pubDate></item><item><title><![CDATA[Reply to Nedlasting av data om kjøretøy on Sun, 09 Jan 2022 19:30:06 GMT]]></title><description><![CDATA[<p dir="auto">Jeg har ikke svaren. <a href="https://bileier.app" rel="nofollow ugc">https://bileier.app</a> jobber med kjøretøy data og kanskje vi kan hjelpe deg. robert@bileier.app</p>
]]></description><link>https://datalandsbyen.norge.no/post/260</link><guid isPermaLink="true">https://datalandsbyen.norge.no/post/260</guid><dc:creator><![CDATA[robert.sasak]]></dc:creator><pubDate>Sun, 09 Jan 2022 19:30:06 GMT</pubDate></item></channel></rss>