Przetwarzanie danych w wierszu poleceń
Susan Sun
Data Person
csvkit:
Instalacja csvkit przy użyciu menedżera pakietów pip:
pip install csvkit
Aktualizacja csvkit do najnowszej wersji:
pip install --upgrade csvkit
Pełna instrukcja:
Dokumentacja online: https://csvkit.readthedocs.io/en/latest/tutorial.html

Dokumentacja online:
https://csvkit.readthedocs.io/en/latest/scripts/in2csv.html
Dokumentacja wiersza poleceń:
in2csv --helpin2csv -h
usage: in2csv [-h] [-d DELIMITER] [-t] [-q QUOTECHAR] [-u {0,1,2,3}] [-b]
[-p ESCAPECHAR] [-z FIELD_SIZE_LIMIT] [-e ENCODING] [-L LOCALE]
[-S] [--blanks] [--date-format DATE_FORMAT]
[--datetime-format DATETIME_FORMAT] [-H] [-K SKIP_LINES] [-v]
Składnia:
in2csv SpotifyData.xlsx > SpotifyData.csv
Wyświetla pierwszy arkusz Excela w konsoli bez zapisywania
in2csv SpotifyData.xlsx
> przekierowuje wynik i zapisuje go jako nowy plik SpotifyData.csv
> SpotifyData.csv
Użyj opcji --names lub -n, aby wyświetlić wszystkie nazwy arkuszy w SpotifyData.xlsx.
in2csv -n SpotifyData.xlsx
Worksheet1_Popularity
Worksheet2_MusicAttributes
Użyj opcji --sheet z nazwą arkusza "Worksheet1_Popularity" do konwersji.
in2csv SpotifyData.xlsx --sheet "Worksheet1_Popularity" > Spotify_Popularity.csv
in2csv nie wyświetla logów w konsoli.
in2csv SpotifyData.xlsx --sheet "Worksheet1_Popularity" > Spotify_Popularity.csv
Weryfikacja:
ls
SpotifyData.xlsx Spotify_Popularity.csv backup bin
csvlook: wyświetla plik CSV w terminalu w formacie Markdown o stałej szerokości kolumn
Dokumentacja:
csvlook -h
usage: csvlook [-h] [-d DELIMITER] [-t] [-q QUOTECHAR] [-u {0,1,2,3}] [-b]
[-p ESCAPECHAR] [-z FIELD_SIZE_LIMIT] [-e ENCODING] [-L LOCALE]
[-S] [--blanks] [--date-format DATE_FORMAT]
Składnia:
csvlook Spotify_Popularity.csv
| track_id | popularity |
| ---------------------- | ---------- |
| 118GQ70Sp6pMqn6w1oKuki | 7 |
| 6S7cr72a7a8RVAXzDCRj6m | 7 |
| 7h2qWpMJzIVtiP30E8VDW4 | 7 |
| 3KVQFxJ5CWOcbxdpPYdi4o | 7 |
| 0JjNrI1xmsTfhaiU1R6OVc | 7 |
| 3HjTcZt29JUHg5m60QhlMw | 7 |
csvstat: wyświetla opisowe statystyki podsumowujące dla wszystkich kolumn pliku CSV (np. średnia, mediana, liczba unikalnych wartości)
Dokumentacja:
csvstat -h
usage: csvstat [-h] [-d DELIMITER] [-t] [-q QUOTECHAR] [-u {0,1,2,3}] [-b]
[-p ESCAPECHAR] [-z FIELD_SIZE_LIMIT] [-e ENCODING] [-S] [-H]
[-K SKIP_LINES] [-v] [-l] [--zero] [-V] [--csv] [-n]
Składnia:
csvstat Spotify_Popularity.csv
1. "track_id"
Type of data: Text
Contains null values: False
Unique values: 24
Longest value: 22 characters
Most common values: 118GQ70Sp6pMqn6w1oKuki (1x)
6S7cr72a7a8RVAXzDCRj6m (1x)
Przetwarzanie danych w wierszu poleceń