OCR — ਟੈਕਸਟ ਕੱਢਣਾ
ਡਿਜੀਟਲ PDF ਵਿੱਚੋਂ ਟੈਕਸਟ ਕੱਢੋ, ਜਾਂ ਸਕੈਨ ਕੀਤੀਆਂ ਤਸਵੀਰਾਂ 'ਤੇ ਆਪਟੀਕਲ ਅੱਖਰ ਪਛਾਣ ਚਲਾਓ।
ਤੁਹਾਨੂੰ ਦਿਸਦੀ ਹੈ ਲਿਖਤ, ਕੰਪਿਊਟਰ ਨੂੰ ਦਿਸਦੇ ਹਨ ਨੁਕਤੇ। ਮੈਨੂੰ ਦੋਹਾਂ ਦੀ ਜਾਣ-ਪਛਾਣ ਕਰਾਉਣ ਦਿਓ।— Poulpi
ਡਿਜੀਟਲ PDF ਵਿੱਚੋਂ ਟੈਕਸਟ ਕੱਢੋ, ਜਾਂ ਸਕੈਨ ਕੀਤੀਆਂ ਤਸਵੀਰਾਂ 'ਤੇ ਆਪਟੀਕਲ ਅੱਖਰ ਪਛਾਣ ਚਲਾਓ।
ਤੁਹਾਨੂੰ ਦਿਸਦੀ ਹੈ ਲਿਖਤ, ਕੰਪਿਊਟਰ ਨੂੰ ਦਿਸਦੇ ਹਨ ਨੁਕਤੇ। ਮੈਨੂੰ ਦੋਹਾਂ ਦੀ ਜਾਣ-ਪਛਾਣ ਕਰਾਉਣ ਦਿਓ।— Poulpi
ਇੱਕ ਸਕੈਨ ਕੀਤਾ ਪੰਨਾ ਅਸਲ ਵਿੱਚ ਸਿਰਫ਼ ਇੱਕ ਫ਼ੋਟੋਗ੍ਰਾਫ਼ ਹੁੰਦਾ ਹੈ: ਤੁਹਾਡਾ PDF ਰੀਡਰ ਇੱਕ ਤਸਵੀਰ ਵੇਖਦਾ ਹੈ, ਸ਼ਬਦ ਨਹੀਂ। PDF OCR (ਆਪਟੀਕਲ ਕਰੈਕਟਰ ਰੀਕੋਗਨਿਸ਼ਨ) ਉਸ ਤਸਵੀਰ ਨੂੰ ਪੜ੍ਹਦਾ ਹੈ, ਹਰ ਅੱਖਰ ਦੀ ਪਛਾਣ ਕਰਦਾ ਹੈ ਅਤੇ ਇਸ ਨੂੰ ਅਸਲ, ਚੁਣਨਯੋਗ ਅਤੇ ਖੋਜਯੋਗ ਪਾਠ ਵਿੱਚ ਬਦਲ ਦਿੰਦਾ ਹੈ। ਇਹੀ ਗੱਲ ਕਿਸੇ ਜਮੇ ਹੋਏ ਦਸਤਾਵੇਜ਼ ਨੂੰ ਮੁੜ ਜੀਵਨ ਦਿੰਦੀ ਹੈ।
ਇਹ ਕਦਮ ਰੋਜ਼ਾਨਾ ਦੇ ਕੰਮ ਨੂੰ ਬਦਲ ਦਿੰਦਾ ਹੈ। ਇੱਕ ਵਾਰ ਪਾਠ ਪਛਾਣਿਆ ਜਾਵੇ, ਤੁਸੀਂ ਕੋਈ ਹਿੱਸਾ ਕਾਪੀ ਕਰ ਸਕਦੇ ਹੋ, ਪੂਰੀ ਫ਼ਾਈਲ ਵਿੱਚ ਕੋਈ ਸ਼ਬਦ ਖੋਜ ਸਕਦੇ ਹੋ ਅਤੇ ਕਿਸੇ ਕਾਗਜ਼ੀ ਦਸਤਾਵੇਜ਼ ਨੂੰ ਮੁੜ-ਟਾਈਪ ਕੀਤੇ ਬਿਨਾਂ ਮੁੜ-ਵਰਤ ਸਕਦੇ ਹੋ। ਇਸੇ ਕਰਕੇ ਤੁਸੀਂ ਕਿਸੇ ਸਕੈਨ ਕੀਤੀ PDF ਵਿੱਚੋਂ ਪਾਠ ਕੱਢਦੇ ਹੋ: ਪੁਰਾਣੇ ਇਕਰਾਰਨਾਮੇ, ਡਾਕ ਰਾਹੀਂ ਮਿਲੇ ਬਿਲ, ਭਰੇ ਹੋਏ ਫ਼ਾਰਮ ਅਤੇ ਡਿਜੀਟਾਈਜ਼ ਕੀਤੇ ਪੁਰਾਲੇਖ ਆਖ਼ਰਕਾਰ ਵਰਤੋਂਯੋਗ ਬਣ ਜਾਂਦੇ ਹਨ।
ਨਤੀਜਾ ਸਭ ਤੋਂ ਵੱਧ ਸਕੈਨ ਦੀ ਗੁਣਵੱਤਾ 'ਤੇ ਨਿਰਭਰ ਕਰਦਾ ਹੈ। 300 dpi ਜਾਂ ਵੱਧ 'ਤੇ ਸਕੈਨ ਕੀਤਾ ਇੱਕ ਤਿੱਖਾ, ਸਿੱਧਾ, ਉੱਚ-ਵਿਰੋਧਾਭਾਸ ਵਾਲਾ ਦਸਤਾਵੇਜ਼ ਭਰੋਸੇਯੋਗ ਪਛਾਣ ਦਿੰਦਾ ਹੈ। ਸਹੀ ਭਾਸ਼ਾ ਵੀ ਜ਼ਰੂਰ ਚੁਣੋ, ਕਿਉਂਕਿ ਇਹ ਅੱਖਰਾਂ ਅਤੇ ਲਗਾਖਰਾਂ ਦੀ ਵਿਆਖਿਆ ਦੀ ਅਗਵਾਈ ਕਰਦੀ ਹੈ। ਪਰ ਹੱਥ-ਲਿਖਤ ਭਰੋਸੇਯੋਗ ਨਹੀਂ ਰਹਿੰਦੀ: OCR ਛਪੇ ਪਾਠ ਲਈ ਬਣਿਆ ਹੈ।
ਇੱਕ ਵਾਰ ਪਾਠ ਕੱਢ ਲੈਣ 'ਤੇ, ਤੁਸੀਂ ਆਪਣੇ ਟੀਚੇ ਲਈ ਅਗਲਾ ਸੰਦ ਚੁਣਦੇ ਹੋ। ਪੂਰੀ ਤਰ੍ਹਾਂ ਸੋਧਣਯੋਗ ਦਸਤਾਵੇਜ਼ ਲਈ, pdf-to-word ਵਰਤੋ; ਫ਼ਾਈਲ ਨੂੰ ਸਿੱਧਾ ਵਿਵਸਥਿਤ ਕਰਨ ਲਈ, edit ਵਰਤੋ; ਅਤੇ ਫ਼ਾਰਮੈਟ ਬਦਲਣ ਲਈ, convert ਨੂੰ ਜ਼ਿੰਮਾ ਸੌਂਪੋ।
ਨਿੱਜਤਾ ਬਾਰੇ, ਕੁਝ ਵੀ ਗੁੰਝਲਦਾਰ ਨਹੀਂ: ਕੋਈ ਸਾਈਨ-ਅੱਪ ਲੋੜੀਂਦਾ ਨਹੀਂ ਅਤੇ ਤੁਹਾਡੀਆਂ ਫ਼ਾਈਲਾਂ ਪ੍ਰੋਸੈੱਸ ਤੋਂ ਬਾਅਦ ਆਪਣੇ-ਆਪ ਮਿਟਾ ਦਿੱਤੀਆਂ ਜਾਂਦੀਆਂ ਹਨ। ਤੁਹਾਡੇ ਦਸਤਾਵੇਜ਼ ਸਿਰਫ਼ ਤੁਹਾਡਾ ਪਾਠ ਬਣਾਉਣ ਲਈ ਵਰਤੇ ਜਾਂਦੇ ਹਨ, ਹੋਰ ਕੁਝ ਨਹੀਂ।
ਅੱਪਲੋਡ ਕਰੋ
ਆਪਣੀ PDF ਫ਼ਾਈਲ ਡ੍ਰੌਪ ਖੇਤਰ ਵਿੱਚ ਅੱਪਲੋਡ ਕਰੋ (ਜਾਂ ਖਿੱਚ ਕੇ ਛੱਡੋ)।
ਸੰਰਚਿਤ ਕਰੋ
ਡਿਜੀਟਲ PDF ਵਿੱਚੋਂ ਟੈਕਸਟ ਕੱਢੋ, ਜਾਂ ਸਕੈਨ ਕੀਤੀਆਂ ਤਸਵੀਰਾਂ 'ਤੇ ਆਪਟੀਕਲ ਅੱਖਰ ਪਛਾਣ ਚਲਾਓ।
ਡਾਊਨਲੋਡ ਕਰੋ
ਨਤੀਜੇ ਵਾਲੇ ਦਸਤਾਵੇਜ਼ ਨੂੰ ਇੱਕ ਕਲਿੱਕ ਵਿੱਚ ਡਾਊਨਲੋਡ ਕਰੋ — ਪ੍ਰੋਸੈਸਿੰਗ ਤੋਂ ਬਾਅਦ ਤੁਹਾਡੀਆਂ ਫ਼ਾਈਲਾਂ ਆਪਣੇ-ਆਪ ਮਿਟ ਜਾਂਦੀਆਂ ਹਨ।