આંકડા ફરી ટાઇપ કરવાને બદલે PDFને CSVમાં શા માટે ફેરવવી?
PDFની અંદર ફસાયેલું કોષ્ટક વાંચી શકાય તેવું છે પણ જેમનું તેમ નકામું છે: તમે તેને સૉર્ટ, ફિલ્ટર કે તેમાં ફોર્મ્યુલા દાખલ કરી શકતા નથી. મૂલ્યો હાથે કૉપી કરવાં ધીમું અને ભૂલભરેલું છે, ખાસ કરીને સ્ટેટમેન્ટ, ઇન્વોઇસ કે નિકાસ કરેલી લાંબી યાદીઓમાં. PDFને CSVમાં ફેરવવાથી તમને કાચી ડેટા ફાઇલ મળે છે જ્યાં દરેક પંક્તિ અને દરેક કૉલમ તરત કામ કરવા તૈયાર છે.
CSV એક સાર્વત્રિક ફોર્મેટ છે: એકવાર તમારો ડેટા બહાર આવે, પછી તમે તેને Excel કે Google Sheetsમાં ખોલીને આંકડા સરવાળો કરો, શ્રેણીઓ સરખાવો કે ચાર્ટ બનાવો, અને એટલી જ સરળતાથી ડેટાબેઝ, હિસાબ પેકેજ કે વિશ્લેષણ સાધનમાં આયાત કરો. આ રીતે PDFમાંથી કોષ્ટક કાઢવાથી બધું ફરી ટાઇપ કરવાનું બચે છે અને આંકડા સ્રોતને વફાદાર રહે છે.
કૉલમ કેવી રીતે શોધાય છે (અને સ્કેન કરેલી PDFનો કિસ્સો)
શોધ ટેક્સ્ટ કેવી રીતે ગોઠવાયેલો છે તેના પર આધારિત છે: બે કે વધુ સ્પેસ, અથવા ટૅબથી અલગ પડેલાં ક્ષેત્રો અલગ કૉલમ તરીકે વંચાય છે. બીજા શબ્દોમાં, સારી રીતે સંરેખિત કોષ્ટક શ્રેષ્ઠ પરિણામ આપે છે, જ્યારે અનિયમિત ગોઠવણ કૉલમ ભેળવી શકે છે અને તમારી સ્પ્રેડશીટમાં થોડી સફાઈ માંગી શકે છે.
એક પ્રામાણિક નોંધ: સ્કેન કરેલી કે ફોટોગ્રાફ કરેલી PDF માત્ર એક છબી છે, જેમાં કૉલમમાં વહેંચવા વાસ્તવિક ટેક્સ્ટ નથી. શરૂ કરતાં પહેલાં તેને ocr સાધનમાંથી પસાર કરો, જે વાસ્તવિક ટેક્સ્ટ ફરી બનાવે છે. જો તમને ડેટાને બદલે લખાણ જોઈએ, તો pdf-to-word સાધન વધુ બંધબેસે છે, અને convert સાધન બાકીના આઉટપુટ ફોર્મેટ ભેગા કરે છે. ગોપનીયતા વિશે, pdfOutils ગોપનીયતાને વફાદાર રહે છે: પ્રક્રિયા પછી તમારી ફાઇલો આપોઆપ કાઢી નાખવામાં આવે છે અને કોઈ સાઇન-અપની જરૂર નથી.