ایکسل فائل (XLSX) کو CSV میں تبدیل کرنے کا مکمل عمل
یہ صفحہ ایکسل فائل (XLSX) اپ لوڈ کرنے کے بعد اسے ایک سادہ ٹیکسٹ فائل (CSV) میں تبدیل کرتا ہے۔ صارف پہلی ورک شیٹ سے ظاہر شدہ اقدار نکال کر، delimiter (کوما، سیمی کولن، یا ٹیب) منتخب کرتا ہے، اور پھر ڈاؤن لوڈ کے لیے CSV حاصل کرتا ہے۔ تمام کارروائی براؤزر میں ہوتی ہے — ڈیٹا کبھی بھی مشین سے باہر نہیں جاتا۔
XLSX اور CSV کے درمیان بنیادی ساختی فرق
ایکسل فائل (XLSX) ایک زپڈ XML ورک بک ہے جو متعدد شیٹس، فارمولوں، سیل ٹائپس (نمبر، تاریخ، بولین)، رنگ، فونٹس، اور ضم شدہ سیلز کو رکھ سکتی ہے۔ اس کے مقابلے میں CSV (Comma-Separated Values) ایک ننگا ٹیکسٹ فارمیٹ ہے جس میں صرف قطاروں اور کالموں میں تقسیم کردہ متن ہوتا ہے۔ CSV میں کسی بھی قسم کی فارمیٹنگ، ایک سے زیادہ شیٹس، یا فارمولوں کی گنجائش نہیں۔ یہ تبدیلی ہمیشہ نقصان دہ ہوتی ہے — معلومات کا ایک بڑا حصہ ضائع ہو جاتا ہے۔
صفحہ صرف پہلی ورک شیٹ کو استعمال کرتا ہے۔ باقی تمام شیٹس کو نظر انداز کر دیا جاتا ہے۔ فارمولوں کی دوبارہ گنتی نہیں ہوتی؛ ٹول وہی آخری محفوظ کردہ ظاہری ویلیو پڑھتا ہے۔ سیل کی قسم (نمبر، تاریخ، کرنسی) بھی ضائع ہو جاتی ہیں — تمام اقدار CSV میں صرف متن بن جاتی ہیں۔ سیل کے اندر موجود پہلے سے صفر (leading zeros) اس وقت تک مٹ جاتے ہیں جب تک کہ اصل سیل کی ویلیو بطور متن محفوظ نہ کی گئی ہو۔ مثال کے طور پر، اگر ایکسل سیل میں نمبر 00123 ہے اور وہ نمبر کے طور پر محفوظ ہے، تو CSV میں صرف 123 نظر آئے گا۔
کون سی معلومات ضائع ہوتی ہیں؟
اس تبدیلی میں کئی اہم عناصر مستقل طور پر ختم ہو جاتے ہیں:
- فارمولے: ہر فارمولے کی جگہ اس کا آخری شمار کردہ نتیجہ آ جاتا ہے۔ کوئی بھی ریاضی یا منطق CSV میں محفوظ نہیں رہتی۔
- سیل فارمیٹنگ: رنگ، فونٹ، بارڈرز، بولڈ/اٹالک، اور نمبر کے فارمیٹ (جیسے کرنسی $1,000.00) سب ختم ہو جاتے ہیں۔
- متعدد ورک شیٹس: صرف پہلی شیٹ استعمال ہوتی ہے۔ بقیہ شیٹس کو اگر ضرورت ہو تو الگ سے تبدیل کروانا پڑے گا۔
- ضم شدہ سیلز: ضم شدہ سیلز کو الگ الگ سیلوں میں تقسیم کیا جاتا ہے، لیکن ان کی اصل قدر صرف اوپری بائیں کونے والے سیل میں رہتی ہے، باقی خالی ہو جاتے ہیں۔
- ڈیٹا ٹائپس: نمبر، تاریخ، اور بولین سب متن میں بدل جاتے ہیں۔ تاریخ
2025-04-01جیسی ظاہری شکل میں رہ سکتی ہے، لیکن اصل عددی قدر (ایکسل سیریل نمبر) ضائع ہو جاتی ہے۔
کنارے کی صورتیں (Edge Cases) اور ان کا حل
CSV میں سرایت شدہ کوما، لائن بریک، اور پہلے سے صفر جیسے مسائل پیدا ہو سکتے ہیں۔ یہ ٹول ان سے نمٹنے کے لیے معیاری کوٹیشن کا طریقہ استعمال کرتا ہے:
- اگر کسی سیل میں وہی delimiter موجود ہو جو صارف نے منتخب کیا ہے (مثلاً کوما جب delimiter کوما ہو)، تو پوری ویلیو کو ڈبل کوٹس (
"...") میں لپیٹ دیا جاتا ہے۔ مثال:"Smith, John" - اگر سیل میں لائن بریک (نئی لائن) موجود ہو، تو بھی کوٹیشن لگائی جاتی ہے۔
- اگر پہلے سے صفر والا نمبر متن کے طور پر محفوظ ہو، تو وہ بغیر کسی تبدیلی کے آ جاتا ہے۔ لیکن اگر نمبر کی شکل میں ہو، تو صفر مٹ جاتے ہیں۔
مثال: ایکسل میں دو سیل — ایک 00123 (بطور متن) اور دوسرا 00123 (بطور نمبر) — CSV میں بالترتیب "00123" اور 123 بنیں گے۔
نکتہ: صارف کو نتیجے کا معائنہ کرنا چاہیے۔ اگر ڈیٹا میں کوما یا لائن بریک ہوں تو CSV درست طریقے سے پارس نہیں ہو سکتا اگر پروگرام کوٹیشن کو نہ سمجھے۔
ڈیٹا کو تیار کرنے کے بہترین طریقے
چونکہ CSV میں نیسٹڈ ڈیٹا (جیسے درجہ بندی والے فیلڈز) کا تصور نہیں ہے، اس لیے ایکسل فائل کو پہلے سے فلیٹ کرنا ضروری ہے:
- اگر آپ کے پاس ایک سے زیادہ ورک شیٹس ہیں، تو انہیں ایک ہی شیٹ میں ضبط کریں (merge) یا ایک ایک کر کے تبدیل کریں۔
- نیسٹڈ ڈیٹا (مثلاً ایک سیل میں پتہ جس میں شہر، علاقہ، کوڈ شامل ہوں) کو الگ الگ کالموں میں تقسیم کریں۔ مثال:
مکمل پتہکے بجائےشہر,ضلع,پوسٹل کوڈ۔ - اگر کسی کالم میں متن بہت لمبا ہے اور اس میں لائن بریک ہوں، تو انہیں ہٹا دیں یا ایک ہی سطر میں لائیں، ورنہ CSV قطاریں ٹوٹ سکتی ہیں۔
- ڈیلیمیٹر کا انتخاب: کوما سب سے عام ہے، لیکن اگر آپ کے ڈیٹا میں کوما کثرت سے آتا ہے تو سیمی کولن یا ٹیب استعمال کرنا بہتر ہے۔ کچھ سسٹم (جیسے کچھ ڈیٹا بیس) صرف کوما قبول کرتے ہیں، لہٰذا اس کا پہلے سے تعین کر لیں۔
ممکنہ خرابی کے پیغامات اور ان کے معنی
یہ ٹول مخصوص خرابیوں پر صارف کو پیغام دیتا ہے۔ ان پیغامات کو سمجھنا ضروری ہے:
| خرابی کا پیغام (اردو ترجمہ کے ساتھ) | وجہ |
|---|---|
| "پہلے ایک فائل منتخب کریں۔" | کوئی فائل اپ لوڈ نہیں کی گئی۔ |
| "صرف CSV، JSON یا XLSX فائل منتخب کریں۔" | غلط فارمیٹ کی فائل ڈالی گئی۔ |
| "یہ فائل بہت بڑی ہے۔ ‹زیادہ سے زیادہ› سے چھوٹی فائل استعمال کریں۔" | فائل کا سائز حد سے زیادہ ہے۔ |
| "یہ ایکسل فائل کھولی نہیں جا سکی۔" | فائل خراب ہے یا XLSX معیار کے مطابق نہیں۔ |
| "اس فائل میں کوئی ٹیبل قطاریں نہیں ہیں۔" | پہلی ورک شیٹ خالی ہے یا صرف عنوانات ہیں۔ |
| "اس جدول میں ‹زیادہ سے زیادہ› سے زیادہ قطاریں ہیں۔" | قطاروں کی تعداد حد سے تجاوز کر گئی۔ |
| "اس جدول میں ‹زیادہ سے زیادہ› سے زیادہ کالم ہیں۔" | کالموں کی تعداد حد سے زیادہ ہے۔ |
| "تبدیلی منسوخ کر دی گئی۔" | صارف نے عمل روک دیا۔ |
| "یہ تبدیلی بہت زیادہ وقت لے رہی ہے۔ چھوٹی فائل آزمائیں۔" | فائل بہت بڑی ہے یا پروسیسنگ میں مسئلہ ہے۔ |
سیکیورٹی اور پرائیویسی: ڈیٹا براؤزر میں رہتا ہے
اس صفحے کی ایک اہم خوبی یہ ہے کہ فائل کبھی بھی سرور پر اپ لوڈ نہیں ہوتی۔ تمام تبدیلیاں صارف کے براؤزر میں ہوتی ہیں (client-side processing)۔ اس کا مطلب ہے کہ حساس ڈیٹا (جیسے مالی معلومات، ذاتی ڈیٹا، یا کمپنی کے ریکارڈ) بیرونی مشین تک نہیں پہنچتا۔ یہ ان صارفین کے لیے خاص طور پر مفید ہے جو ڈیٹا پرائیویسی کے قوانین (جیسے GDPR) کی پابندی کرتے ہیں یا سرور پر بھروسہ نہیں کرتے۔
تکنیکی وضاحت: XLSX فائلیں دراصل زیپ آرکائیوز ہوتی ہیں جن میں XML فائلیں ہوتی ہیں۔ براؤزر JavaScript کے ذریعے ان فائلوں کو پڑھتا ہے، ورک شیٹ نکالتا ہے، اور پھر CSV تیار کرتا ہے — یہ سب کچھ بغیر کسی نیٹ ورک کی درخواست کے۔
عمومی سوالات (FAQ)
سوال 1: میرے پاس ایک ایکسل فائل ہے جس میں پانچ شیٹس ہیں۔ کیا یہ ٹول ان سب کو ایک CSV میں ملا سکتا ہے؟
جواب: نہیں، یہ ٹول صرف پہلی ورک شیٹ کو تبدیل کرتا ہے۔ باقی شیٹس کو الگ الگ تبدیل کرنے کے لیے آپ کو انہیں پہلے ایک شیٹ میں ضبط کرنا ہوگا، یا ہر شیٹ کے لیے الگ الگ فائل استعمال کرنی ہوگی۔
سوال 2: میرے ڈیٹا میں بہت لائن بریک ہیں، کیا CSV صحیح بنے گا؟
جواب: ٹول لائن بریک والے سیلز کو ڈبل کوٹس میں لپیٹ دیتا ہے، لیکن کچھ پروگرام اسے درست نہیں پڑھ سکتے۔ بہتر ہے کہ ایکسل میں لائن بریک پہلے ہٹا دیں یا انہیں خالی جگہ سے بدل دیں۔
سوال 3: اگر میرے کالم کے ناموں میں کوما ہوں تو کیا ہوگا؟
جواب: ٹول انہیں بھی کوٹ کر دے گا۔ مثال: "نام، پتہ", عمر۔ لیکن اگر آپ کا ہدف سسٹم کوٹیشن کو سمجھتا ہو تو کوئی مسئلہ نہیں۔ ورنہ سیمی کولن delimiter استعمال کرنا بہتر ہے۔
سوال 4: کیا یہ فارمولوں کی دوبارہ گنتی کرتا ہے؟
جواب: نہیں، یہ صرف فائل میں محفوظ کردہ آخری ظاہری قدر پڑھتا ہے۔ اگر آپ کو تازہ ترین شمار درکار ہے تو پہلے ایکسل میں فارمولوں کو اپ ڈیٹ کریں اور فائل محفوظ کریں، پھر تبدیل کریں۔
سوال 5: کیا میں CSV میں تاریخیں محفوظ کر سکتا ہوں؟
جواب: تاریخیں متن کے طور پر ظاہر ہوں گی۔ تاریخ کا فارمیٹ ایکسل میں جیسا دکھائی دیتا ہے ویسا ہی رہے گا، لیکن تاریخ کی اصل عددی قدر (ایکسل سیریل نمبر) ضائع ہو جاتی ہے۔ اگر آپ کو تاریخ کو عددی شکل میں چاہیے تو پہلے ایکسل میں اسے نمبر میں تبدیل کریں۔
سوال 6: کون سے ڈیلیمیٹر کا انتخاب کروں؟
جواب: کوما سب سے زیادہ عام ہے اور زیادہ تر سافٹ ویئر (جیسے ڈیٹا بیس، ایکسل خود، Python) اسے سمجھتے ہیں۔ اگر آپ کے ڈیٹا میں کوما کثرت سے ہیں تو سیمی کولن یا ٹیب آزمائیں۔ یاد رکھیں کہ ٹیب ایک بھی نظر نہ آنے والا حرف ہے، اس لیے بہتر ہے کہ پہلے چھوٹے نمونے پر آزمائش کریں۔