Pertanyaan yang diberi tag «pandas»

Pandas adalah pustaka Python untuk manipulasi dan analisis data, misalnya kerangka data, rangkaian waktu multidimensi, dan kumpulan data cross-sectional yang biasa ditemukan dalam statistik, hasil sains eksperimental, ekonometrik, atau keuangan. Panda adalah salah satu pustaka sains data utama di Python.

6
Cari "tidak-mengandung" pada DataFrame di panda
Saya telah melakukan pencarian dan tidak tahu cara memfilter dataframe df["col"].str.contains(word), namun saya bertanya-tanya apakah ada cara untuk melakukan yang sebaliknya: filter dataframe dengan pujian set itu. misalnya: untuk efek !(df["col"].str.contains(word)). Bisakah ini dilakukan melalui DataFramemetode?
142 python  pandas  contains 


6
Panda: Pengaturan no. dari baris maks
Saya memiliki masalah melihat yang berikut ini DataFrame: n = 100 foo = DataFrame(index=range(n)) foo['floats'] = np.random.randn(n) foo Masalahnya adalah ia tidak mencetak semua baris per default di notebook ipython, tapi saya harus mengiris untuk melihat baris yang dihasilkan. Bahkan opsi berikut tidak mengubah output: pd.set_option('display.max_rows', 500) Apakah ada yang …

7
Temukan kolom yang namanya berisi string tertentu
Saya memiliki kerangka data dengan nama kolom, dan saya ingin menemukan yang berisi string tertentu, tetapi tidak sama persis dengan itu. Aku mencari 'spike'di kolom nama seperti 'spike-2', 'hey spike', 'spiked-in'(yang 'spike'bagian selalu terus-menerus). Saya ingin nama kolom dikembalikan sebagai string atau variabel, jadi saya mengakses kolom nanti dengan df['name']atau …

5
Bingkai data panda mendapatkan baris pertama dari setiap grup
Saya punya panda DataFrameseperti berikut. df = pd.DataFrame({'id' : [1,1,1,2,2,3,3,3,3,4,4,5,6,6,6,7,7], 'value' : ["first","second","second","first", "second","first","third","fourth", "fifth","second","fifth","first", "first","second","third","fourth","fifth"]}) Saya ingin mengelompokkan ini berdasarkan ["id", "value"] dan mendapatkan baris pertama dari setiap grup. id value 0 1 first 1 1 second 2 1 second 3 2 first 4 2 second 5 3 first …
137 python  pandas  dataframe 

6
panda dataframe kolom scaling dengan sklearn
Saya memiliki kerangka data panda dengan kolom tipe campuran, dan saya ingin menerapkan min_max_scaler sklearn ke beberapa kolom. Idealnya, saya ingin melakukan transformasi ini di tempat, tetapi belum menemukan cara untuk melakukan itu. Saya telah menulis kode berikut yang berfungsi: import pandas as pd import numpy as np from sklearn …




6
Bagaimana cara memuat file tsv ke dalam Pandaf DataFrame?
Saya baru mengenal python dan panda. Saya mencoba untuk mendapatkan tsvfile yang dimuat ke dalam panda DataFrame. Inilah yang saya coba dan kesalahan yang saya dapatkan: >>> df1 = DataFrame(csv.reader(open('c:/~/trainSetRel3.txt'), delimiter='\t')) Traceback (most recent call last): File "<pyshell#28>", line 1, in <module> df1 = DataFrame(csv.reader(open('c:/~/trainSetRel3.txt'), delimiter='\t')) File "C:\Python27\lib\site-packages\pandas\core\frame.py", line 318, …
136 python  pandas  csv 

9
ImportError: Tidak ada modul bernama dateutil.parser
Saya menerima kesalahan berikut saat mengimpor pandasdalam suatu Pythonprogram monas-mbp:book mona$ sudo pip install python-dateutil Requirement already satisfied (use --upgrade to upgrade): python-dateutil in /System/Library/Frameworks/Python.framework/Versions/2.7/Extras/lib/python Cleaning up... monas-mbp:book mona$ python t1.py No module named dateutil.parser Traceback (most recent call last): File "t1.py", line 4, in <module> import pandas as pd …
135 python  pandas  pip 

8
Panda membagi kolom daftar menjadi beberapa kolom
Saya memiliki DataFrame panda dengan satu kolom: import pandas as pd df = pd.DataFrame( data={ "teams": [ ["SF", "NYG"], ["SF", "NYG"], ["SF", "NYG"], ["SF", "NYG"], ["SF", "NYG"], ["SF", "NYG"], ["SF", "NYG"], ] } ) print(df) Keluaran: teams 0 [SF, NYG] 1 [SF, NYG] 2 [SF, NYG] 3 [SF, NYG] 4 …
135 python  pandas 


8
panda menghargai beberapa kolom
df = pd.DataFrame({'Col1': ['Bob', 'Joe', 'Bill', 'Mary', 'Joe'], 'Col2': ['Joe', 'Steve', 'Bob', 'Bob', 'Steve'], 'Col3': np.random.random(5)}) Apa cara terbaik untuk mengembalikan nilai unik 'Col1' dan 'Col2'? Output yang diinginkan adalah 'Bob', 'Joe', 'Bill', 'Mary', 'Steve'


Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.