এই নিবন্ধে, আমরা ডেটা ম্যানিপুলেশন এবং বিশ্লেষণের জন্য পাইথনের একটি জনপ্রিয় লাইব্রেরি পান্ডাস ডেটাফ্রেমে একটি নতুন কলাম যুক্ত করার প্রক্রিয়াটি অন্বেষণ করব। আমরা এই সমস্যার সমাধান নিয়ে আলোচনা করব, কোডের ধাপে ধাপে ব্যাখ্যা করব এবং পান্ডাস লাইব্রেরিতে কিছু সম্পর্কিত বিষয় এবং ফাংশন কভার করব। পান্ডাস একটি বহুল ব্যবহৃত লাইব্রেরি যেখানে উচ্চ-স্তরের ডেটা স্ট্রাকচার এবং টুল রয়েছে, দক্ষ ডেটা বিশ্লেষণ এবং কাজ পরিচালনার জন্য উপযুক্ত।
শুরুতে, ধরা যাক আমাদের কাছে একটি পান্ডাস ডেটাফ্রেম আকারে একটি ডেটাসেট আছে এবং আমরা এতে একটি নতুন কলাম যুক্ত করতে চাই। এটি ডেটা প্রস্তুতির পর্যায়ে একটি সাধারণ প্রয়োজন, যা প্রায়শই বৈশিষ্ট্য প্রকৌশলের জন্য বা বিদ্যমান কলামগুলির উপর ভিত্তি করে অতিরিক্ত তথ্য তৈরি করার জন্য প্রয়োজন হয়। আসুন কীভাবে এটি অর্জন করা যায় সেদিকে ডুব দেওয়া যাক।
একটি পান্ডাস ডেটাফ্রেমে একটি নতুন কলাম যোগ করা হচ্ছে
আমরা প্রয়োজনীয় লাইব্রেরি আমদানি করে এবং একটি নমুনা ডেটাফ্রেম তৈরি করে শুরু করব।
import pandas as pd
data = {'Name': ['Alex', 'Tom', 'Nick', 'Sam'],
'Age': [25, 28, 23, 22],
'City': ['NY', 'LA', 'SF', 'Chicago']}
df = pd.DataFrame(data)
এখন, আমাদের ডেটাফ্রেমে একটি ডিফল্ট মান সহ একটি নতুন কলাম 'দেশ' যোগ করা যাক, বলুন 'USA'।
df['Country'] = 'USA'
কোডের এই সাধারণ লাইনটি 'দেশ' নামে একটি নতুন কলাম যুক্ত করবে আমাদের বিদ্যমান ডেটাফ্রেম 'df'-এ এর সমস্ত সারিতে 'USA' মান সহ। আমাদের আপডেট করা DataFrame দেখতে এরকম হবে:
Name Age City Country 0 Alex 25 NY USA 1 Tom 28 LA USA 2 Nick 23 SF USA 3 Sam 22 Chicago USA
ধাপে ধাপে কোড ব্যাখ্যা
আসুন কোডটি ভাঙ্গুন এবং ধাপে ধাপে বুঝুন।
1. প্রথমে, আমরা স্ট্যান্ডার্ড ওরফে 'pd' ব্যবহার করে পান্ডাস লাইব্রেরি আমদানি করি। এটি আমাদের 'pd' উপসর্গ ব্যবহার করে Pandas ফাংশন এবং ক্লাস অ্যাক্সেস করতে দেয়।
import pandas as pd
2. এরপর, আমরা কিছু নমুনা ডেটা সম্বলিত একটি অভিধান 'ডেটা' তৈরি করি। অভিধানের প্রতিটি কী একটি কলামের নাম উপস্থাপন করে এবং এর সংশ্লিষ্ট মান হল সেই কলামের মানগুলির একটি তালিকা।
data = {'Name': ['Alex', 'Tom', 'Nick', 'Sam'],
'Age': [25, 28, 23, 22],
'City': ['NY', 'LA', 'SF', 'Chicago']}
3. তারপর আমরা এই অভিধানটিকে 'pd.DataFrame()' ফাংশন ব্যবহার করে একটি পান্ডাস ডেটাফ্রেম অবজেক্টে রূপান্তর করি।
df = pd.DataFrame(data)
4. অবশেষে, একটি নতুন কলাম যোগ করার জন্য, আমরা ডেটাফ্রেমের সাথে অ্যাসাইনমেন্ট অপারেটর “=” ব্যবহার করি, বর্গাকার বন্ধনীর মধ্যে নতুন কলামের নাম প্রদান করে এবং ডিফল্ট মান নির্দিষ্ট করে। আমাদের ক্ষেত্রে, আমরা ডিফল্ট মান 'USA' সহ 'দেশ' কলাম যুক্ত করেছি।
df['Country'] = 'USA'
পান্ডাস লাইব্রেরি এবং সম্পর্কিত ফাংশন
পান্ডাস একটি শক্তিশালী পাইথন লাইব্রেরি, যা বিশেষত ডেটা প্রসেসিং, ক্লিনিং এবং বিশ্লেষণের কাজের জন্য উপযুক্ত। এটি দুটি প্রধান ডেটা স্ট্রাকচার প্রদান করে: ডেটাফ্রেম এবং সিরিজ । ডেটাফ্রেম হলো লেবেলযুক্ত অক্ষ (সারি এবং কলাম) সহ একটি দ্বি-মাত্রিক সারণী ডেটা স্ট্রাকচার। অন্যদিকে, সিরিজ হলো একটি একমাত্রিক লেবেলযুক্ত অ্যারে যা যেকোনো ধরনের ডেটা ধারণ করতে সক্ষম।
ডেটাফ্রেমে কলাম যোগ, পরিবর্তন এবং মুছে ফেলার সাথে সম্পর্কিত কিছু সাধারণ পান্ডাস ফাংশন নিম্নরূপ:
- সন্নিবেশ (): একটি নির্দিষ্ট অবস্থানে একটি কলাম সন্নিবেশ করান।
- ড্রপ(): ডেটাফ্রেম থেকে একটি কলাম সরাতে।
- rename(): একটি DataFrame এর কলামের নাম পরিবর্তন করতে।
- বরাদ্দ (): একটি অভিব্যক্তির ফলাফলের উপর ভিত্তি করে একটি নতুন কলাম তৈরি করতে।
সুতরাং, একটি পান্ডাস ডেটাফ্রেমে একটি নতুন কলাম যোগ করা সহজ এবং কার্যকর। এই নিবন্ধে, আমরা একটি ডিফল্ট মান সহ একটি নতুন কলাম যুক্ত করার প্রাথমিক পদ্ধতিটি কভার করেছি এবং জড়িত পদক্ষেপগুলির জন্য বিশদ ব্যাখ্যা প্রদান করেছি। আমরা পান্ডাসকে একটি শক্তিশালী ডেটা ম্যানিপুলেশন লাইব্রেরি হিসেবেও পরিচয় করিয়ে দিয়েছি এবং ডেটাফ্রেম কলাম পরিচালনার জন্য কিছু সম্পর্কিত ফাংশন নিয়ে আলোচনা করেছি। এই কৌশলগুলি আয়ত্ত করার মাধ্যমে, আপনি পাইথনে ডেটা প্রক্রিয়াকরণের বিস্তৃত কাজগুলি পরিচালনা করতে সুসজ্জিত হবেন।