
Czytaj plik Excel w Python bez pandas (brak potrzeby Interop)
Odczytywanie plików Microsoft Excel w języku Python jest niezbędną umiejętnością przy wykonywaniu różnych zadań związanych z danymi i stało się standardową praktyką w takich dziedzinach, jak nauka o danych, analiza danych, analityka biznesowa i automatyzacja. Excel jest jednym z najczęściej używanych narzędzi do przechowywania i organizowania danych ze względu na przyjazny interfejs i bogaty zestaw funkcji. Podczas pracy z Microsoft Excel, pandas to pierwsza biblioteka, która przychodzi na myśl, ale istnieją inne solidne biblioteki jak IronXL, które oferują wydajność i szybkość.
IronXL dla Python jest solidną biblioteką zaprojektowaną do pracy z plikami Excel. Pozwala programistom na płynne tworzenie, odczytywanie, analizowanie danych oraz manipulowanie arkuszami kalkulacyjnymi Excel. Główne zalety korzystania z IronXL to łatwość obsługi, zaawansowane funkcje oraz fakt, że nie wymaga on instalacji programu Microsoft Excel na serwerze.
Jak odczytać plik Excel w Pythonie bez Pandas przy użyciu IronXL
Krok 1: Zaimportuj bibliotekę IronXL.
Krok 2: Dodaj klucz licencyjny.
Krok 3: Załaduj plik Excel.
Krok 4: Odczytuj pliki Excel za pomocą IronXL.
Przedstawiamy IronXL

IronXL oferuje solidne funkcje do obsługi plików Excel, w tym obsługę wielu arkuszy, formatowanie komórek, czytanie i zapisywanie różnych formatów plików (jak .xlsx i .xls) oraz pracę z dużymi zestawami danych, co czyni ją wszechstronnym narzędziem do zadań manipulacji danymi.
Najważniejsze cechy biblioteki IronXL for Python
- Łatwa obsługa plików Excel: IronXL upraszcza proces odczytu, zapisu i edycji plików Excel w języku Python. Korzystając z IronXL, można z łatwością edytować pliki Excel i je zapisywać. Obsługuje również pliki CSV i XLS.
- Obsługa wielu arkuszy: IronXL może z łatwością odczytywać i zapisywać dane w wielu arkuszach w ramach jednego skoroszytu programu Excel. Jest to idealne rozwiązanie w przypadku plików Excel zawierających różne typy danych lub raportów w różnych arkuszach.
- Odczyt i zapis danych:
- Odczytywanie danych: IronXL umożliwia dostęp do poszczególnych komórek lub całych wierszy i kolumn w pliku Excel. Obsługuje odczytywanie wartości ze wszystkich typów komórek, w tym tekstu, liczb i dat.
- Zapisywanie danych: Biblioteka obsługuje zapisywanie plików Excel, niezależnie od tego, czy chcesz zaktualizować istniejące komórki, czy dodać nowe dane do pliku. Obsługuje również format CSV bez konieczności importowania modułu CSV oraz pliki XLSX.
- Formatowanie komórek: IronXL umożliwia formatowanie komórek w programie Excel. W skrypcie w języku Python można bezpośrednio ustawić kolor tekstu, rozmiar czcionki, obramowania i inne style wizualne. Jest to przydatne do tworzenia raportów o określonym formatowaniu lub gdy trzeba wyróżnić pewne punkty danych.
- Kompatybilność z różnymi formatami Excel: IronXL może obsługiwać wiele formatów plików Excel, w tym format pliku .xlsx, format pliku .xls i format pliku .csv. To sprawia, że jest to wszechstronny wybór do pracy z plikami Excel udostępnianymi lub eksportowanymi z różnych systemów.
- Obsługa dużych plików: IronXL jest zoptymalizowany do obsługi dużych plików Excel zawierających wiele wierszy i kolumn, dzięki czemu nadaje się do zadań związanych z analizą danych obejmujących ogromne zbiory danych.
- Cross-Platform: Chociaż IronXL jest zbudowany na technologiach .NET, jest cross-platformowy i może być używany na Windows, macOS i Linux poprzez Python.
Krok 1: Zaimportuj bibliotekę IronXL
Importuj IronXL używając menadżera pakietów Python do czytania danych z arkuszy kalkulacyjnych Excel.
pip install ironxl
Następnie zaimportuj niezbędne biblioteki z IronXL:
from ironxl import License, WorkBook, WorkSheet
Krok 2: Dodaj klucz licencyjny
IronXL wymaga klucza licencyjnego. Pobierz bezpłatną licencję tutaj i umieść ją na początku kodu.
License.LicenseKey = "Your Key"
Krok 3: Załaduj plik Excel
Załaduj plik Excel używając funkcji WorkBook.Load(). Ta metoda zwraca obiekt Workbook, który reprezentuje cały plik Excel.
# Load the workbook
workbook = WorkBook.Load('sample.xlsx')
Krok 4: Odczyt plików Excel za pomocą IronXL
Teraz użyj obiektu skoroszytu, aby odczytać arkusze, a następnie odczytaj dane w arkuszach.
# Iterate over all worksheets
for sheet in workbook.WorkSheets:
print(f"Sheet Name: {sheet.Name}")
for row in sheet.Rows:
# Print each row's values
print([cell.Value for cell in row]) # excel data
Pełny kod
Plik Excel do przetworzenia

from ironxl import License, WorkBook, WorkSheet
# Set the IronXL license key
License.LicenseKey = "Your Key"
# Load the Excel workbook
workbook = WorkBook.Load('sample.xlsx')
# Iterate through the sheets in the workbook
for sheet in workbook.WorkSheets:
# Print the name of each sheet
print(f"Sheet Name: {sheet.Name}")
# Iterate through the rows in the current sheet
for row in sheet.Rows:
# Print each row's values as a list
print([cell.Value for cell in row])
Wyjaśnienie kodu
Podany kod pokazuje, jak używać IronXL do odczytu danych z pliku Excel zawierającego wiele arkuszy. Oto wyjaśnienie kodu krok po kroku:
1. Konfiguracja klucza licencyjnego
Pierwsza linia kodu ustawia licencję IronXL, określając klucz licencyjny za pomocą właściwości License.LicenseKey. Jest to wymagane do aktywacji biblioteki IronXL i zapewnienia możliwości korzystania z niej bez ograniczeń.
2. Ładowanie skoroszytu Excel
Druga linia używa metody WorkBook.Load() do załadowania pliku Excel (sample.xlsx) do obiektu WorkBook. Ten obiekt reprezentuje cały skoroszyt (tj. plik Excel) i zawiera wszystkie arkusze oraz dane znajdujące się w pliku.
3. Przeglądanie arkuszy
Następnie kod rozpoczyna pętlę przechodzącą przez arkusze w skoroszycie. Właściwość WorkBook.WorkSheets daje dostęp do wszystkich arkuszy w załadowanym skoroszycie. Dla każdego arkusza, drukuje nazwę arkusza używając sheet.Name. Jest to przydatne do identyfikacji arkusza, który jest przetwarzany, zwłaszcza podczas pracy z wieloma arkuszami.
4. Odczytywanie i drukowanie danych z każdego arkusza
W każdym arkuszu, kod iteruje przez każdy wiersz używając sheet.Rows. Każdy wiersz stanowi zbiór komórek w tym konkretnym wierszu. Następnie kod wyciąga wartość każdej komórki w wierszu używając cell.Value i drukuje ją jako listę dla każdego wiersza.
Wynik

Licencja IronXL (dostępna wersja próbna)
IronXL działa na podstawie prawidłowego klucza licencyjnego zawartego w kodzie. Użytkownicy mogą łatwo uzyskać Licencję Trial na stronie licencji. Aby skorzystać z licencji, umieść ją w dowolnym miejscu w kodzie, tak jak pokazano poniżej, przed użyciem biblioteki IronXL.
ironxl.License.LicenseKey = "Your License Key"
Wnioski
IronXL jest najlepszą alternatywą dla modułu pandas jeśli chodzi o obsługę plików Excel. Zapewnia to potężny i prosty sposób obsługi plików Excel w języku Python bez konieczności importowania biblioteki pandas. Obsługuje różne formaty Excel, co czyni go doskonałym wyborem dla programistów pragnących zautomatyzować przetwarzanie danych i zadania związane z raportowaniem. Programiści szukający alternatywy dla pandas mogą łatwo zacząć używać IronXL, który ma pełne wsparcie dla czytania, zapisywania i manipulowania arkuszami Excel.

Curtis Chau posiada tytuł licencjata z informatyki (Uniwersytet Carleton) i specjalizuje się w front-endowym rozwoju, z ekspertką w Node.js, TypeScript, JavaScript i React. Pasjonuje się tworzeniem intuicyjnych i estetycznie przyjemnych interfejsów użytkownika, Curtis cieszy się pracą z nowoczesnymi frameworkami i tworzeniem dobrze zorganizowanych, atrakcyjnych wizualnie podręczników.
Powiązane artykuły


