Pertanyaan yang diberi tag «pandas»

Pandas adalah pustaka Python untuk manipulasi dan analisis data, misalnya kerangka data, rangkaian waktu multidimensi, dan kumpulan data cross-sectional yang biasa ditemukan dalam statistik, hasil sains eksperimental, ekonometrik, atau keuangan. Panda adalah salah satu pustaka sains data utama di Python.

3
Mengapa menugaskan dengan [:] versus iloc [:] menghasilkan hasil yang berbeda dalam panda?
Saya sangat bingung dengan metode pengindeksan yang berbeda menggunakan ilocdi panda. Katakanlah saya sedang mencoba mengubah 1-d Dataframe menjadi 2-d Dataframe. Pertama saya memiliki Dataframe 1-d berikut a_array = [1,2,3,4,5,6,7,8] a_df = pd.DataFrame(a_array).T Dan saya akan mengubahnya menjadi 2-d Dataframe dengan ukuran 2x4. Saya mulai dengan menetapkan 2-d Dataframe sebagai …

1
Fungsi to_excel dari panda menghasilkan TypeError yang tidak terduga
Saya membuat kamus kerangka data panda: d[k] = pd.DataFrame(data=data[i]) Jadi saya berasumsi itu d[k]adalah kerangka data panda yang benar. Kemudian for k in d.keys(): d[k].to_excel (file_name) Maka saya memiliki kesalahan: TypeError: got invalid input value of type <class 'xml.etree.ElementTree.Element'>, expected string or Element Saya menggunakan Python 3.7, panda 0.25.3. Pembaruan …

3
Panda lambat DataFrame MultiIndex reindex
Saya memiliki DataFrame panda dalam bentuk: id start_time sequence_no value 0 71 2018-10-17 20:12:43+00:00 114428 3 1 71 2018-10-17 20:12:43+00:00 114429 3 2 71 2018-10-17 20:12:43+00:00 114431 79 3 71 2019-11-06 00:51:14+00:00 216009 100 4 71 2019-11-06 00:51:14+00:00 216011 150 5 71 2019-11-06 00:51:14+00:00 216013 180 6 92 2019-12-01 00:51:14+00:00 …

2
Hasilkan produk kartesian biner yang difilter
Pernyataan masalah Saya mencari cara yang efisien untuk menghasilkan produk kartesian biner penuh (tabel dengan semua kombinasi Benar dan Salah dengan sejumlah kolom), difilter oleh kondisi eksklusif tertentu. Sebagai contoh, untuk tiga kolom / bit n=3kita akan mendapatkan tabel lengkap df_combs = pd.DataFrame(itertools.product(*([[True, False]] * n))) 0 1 2 0 …

1
pandasUDF dan pyarrow 0.15.0
Saya baru-baru ini mulai mendapatkan banyak kesalahan pada sejumlah pysparkpekerjaan yang berjalan pada cluster ESDM. Para erro adalah java.lang.IllegalArgumentException at java.nio.ByteBuffer.allocate(ByteBuffer.java:334) at org.apache.arrow.vector.ipc.message.MessageSerializer.readMessage(MessageSerializer.java:543) at org.apache.arrow.vector.ipc.message.MessageChannelReader.readNext(MessageChannelReader.java:58) at org.apache.arrow.vector.ipc.ArrowStreamReader.readSchema(ArrowStreamReader.java:132) at org.apache.arrow.vector.ipc.ArrowReader.initialize(ArrowReader.java:181) at org.apache.arrow.vector.ipc.ArrowReader.ensureInitialized(ArrowReader.java:172) at org.apache.arrow.vector.ipc.ArrowReader.getVectorSchemaRoot(ArrowReader.java:65) at org.apache.spark.sql.execution.python.ArrowPythonRunner$$anon$1.read(ArrowPythonRunner.scala:162) at org.apache.spark.sql.execution.python.ArrowPythonRunner$$anon$1.read(ArrowPythonRunner.scala:122) at org.apache.spark.api.python.BasePythonRunner$ReaderIterator.hasNext(PythonRunner.scala:406) at org.apache.spark.InterruptibleIterator.hasNext(InterruptibleIterator.scala:37) at org.apache.spark.sql.execution.python.ArrowEvalPythonExec$$anon$2.<init>(ArrowEvalPythonExec.scala:98) at org.apache.spark.sql.execution.python.ArrowEvalPythonExec.evaluate(ArrowEvalPythonExec.scala:96) at org.apache.spark.sql.execution.python.EvalPythonExec$$anonfun$doExecute$1.apply(EvalPythonExec.scala:127)... Semua itu tampaknya …


9
buat matriks NxN dari satu panda kolom
Saya punya dataframe dengan setiap baris memiliki nilai daftar. id list_of_value 0 ['a','b','c'] 1 ['d','b','c'] 2 ['a','b','c'] 3 ['a','b','c'] saya harus menghitung skor dengan satu baris dan terhadap semua baris lainnya Untuk misalnya: Step 1: Take value of id 0: ['a','b','c'], Step 2: find the intersection between id 0 and …
11 python  pandas  numpy 



2
Bagaimana saya bisa membagi kolom dengan regex untuk memindahkan trailing CAPS ke kolom terpisah?
Saya mencoba untuk memecah kolom menggunakan regex, tetapi sepertinya tidak bisa mendapatkan pemisahan dengan benar. Saya mencoba untuk mengambil semua CAPS trailing dan memindahkannya ke kolom terpisah. Jadi saya mendapatkan semua CAPS yang 2-4 CAPS berturut-turut. Namun, itu hanya meninggalkan 'Name'kolom sementara 'Team'kolom kosong. Ini kode saya: import pandas as …
11 python  regex  pandas 




2
Pandas: Segmentasi data Zigzag berdasarkan minima-maxima lokal
Saya punya data deret waktu. Menghasilkan data date_rng = pd.date_range('2019-01-01', freq='s', periods=400) df = pd.DataFrame(np.random.lognormal(.005, .5,size=(len(date_rng), 3)), columns=['data1', 'data2', 'data3'], index= date_rng) s = df['data1'] Saya ingin membuat garis zig-zag yang menghubungkan antara maxima lokal dan minimum lokal, yang memenuhi syarat bahwa pada sumbu y, |highest - lowest value|setiap garis …

3
Ubah beberapa kolom kategori
Dalam set data saya, saya memiliki dua kolom kategori yang ingin saya hitung. Kedua kolom keduanya berisi negara, beberapa tumpang tindih (muncul di kedua kolom). Saya ingin memberikan nomor yang sama di kolom1 dan kolom2 untuk negara yang sama. Data saya terlihat seperti: import pandas as pd d = {'col1': …

Dengan menggunakan situs kami, Anda mengakui telah membaca dan memahami Kebijakan Cookie dan Kebijakan Privasi kami.
Licensed under cc by-sa 3.0 with attribution required.