/usr/lib/python3.9/site-packages/chardet/__pycache__
NameSizeModeActions
big5freq.cpython-39.opt-1.pyc271300644editdlrm
big5freq.cpython-39.pyc271300644editdlrm
big5prober.cpython-39.opt-1.pyc10850644editdlrm
big5prober.cpython-39.pyc10850644editdlrm
chardistribution.cpython-39.opt-1.pyc61710644editdlrm
chardistribution.cpython-39.pyc61710644editdlrm
charsetgroupprober.cpython-39.opt-1.pyc22120644editdlrm
charsetgroupprober.cpython-39.pyc22120644editdlrm
charsetprober.cpython-39.opt-1.pyc34340644editdlrm
charsetprober.cpython-39.pyc34340644editdlrm
codingstatemachine.cpython-39.opt-1.pyc28610644editdlrm
codingstatemachine.cpython-39.pyc28610644editdlrm
compat.cpython-39.opt-1.pyc3500644editdlrm
compat.cpython-39.pyc3500644editdlrm
cp949prober.cpython-39.opt-1.pyc10920644editdlrm
cp949prober.cpython-39.pyc10920644editdlrm
enums.cpython-39.opt-1.pyc25990644editdlrm
enums.cpython-39.pyc25990644editdlrm
escprober.cpython-39.opt-1.pyc25840644editdlrm
escprober.cpython-39.pyc25840644editdlrm
escsm.cpython-39.opt-1.pyc70330644editdlrm
escsm.cpython-39.pyc70330644editdlrm
eucjpprober.cpython-39.opt-1.pyc23980644editdlrm
eucjpprober.cpython-39.pyc23980644editdlrm
euckrfreq.cpython-39.opt-1.pyc120140644editdlrm
euckrfreq.cpython-39.pyc120140644editdlrm
euckrprober.cpython-39.opt-1.pyc10930644editdlrm
euckrprober.cpython-39.pyc10930644editdlrm
euctwfreq.cpython-39.opt-1.pyc271340644editdlrm
euctwfreq.cpython-39.pyc271340644editdlrm
euctwprober.cpython-39.opt-1.pyc10930644editdlrm
euctwprober.cpython-39.pyc10930644editdlrm
gb2312freq.cpython-39.opt-1.pyc190580644editdlrm
gb2312freq.cpython-39.pyc190580644editdlrm
gb2312prober.cpython-39.opt-1.pyc11010644editdlrm
gb2312prober.cpython-39.pyc11010644editdlrm
hebrewprober.cpython-39.opt-1.pyc29700644editdlrm
hebrewprober.cpython-39.pyc29700644editdlrm
jisfreq.cpython-39.opt-1.pyc220860644editdlrm
jisfreq.cpython-39.pyc220860644editdlrm
jpcntx.cpython-39.opt-1.pyc375590644editdlrm
jpcntx.cpython-39.pyc375590644editdlrm
langbulgarianmodel.cpython-39.opt-1.pyc217490644editdlrm
langbulgarianmodel.cpython-39.pyc217490644editdlrm
langgreekmodel.cpython-39.opt-1.pyc204250644editdlrm
langgreekmodel.cpython-39.pyc204250644editdlrm
langhebrewmodel.cpython-39.opt-1.pyc204930644editdlrm
langhebrewmodel.cpython-39.pyc204930644editdlrm
langhungarianmodel.cpython-39.opt-1.pyc216940644editdlrm
langhungarianmodel.cpython-39.pyc216940644editdlrm
langrussianmodel.cpython-39.opt-1.pyc262970644editdlrm
langrussianmodel.cpython-39.pyc262970644editdlrm
langthaimodel.cpython-39.opt-1.pyc206690644editdlrm
langthaimodel.cpython-39.pyc206690644editdlrm
langturkishmodel.cpython-39.opt-1.pyc205090644editdlrm
langturkishmodel.cpython-39.pyc205090644editdlrm
latin1prober.cpython-39.opt-1.pyc29060644editdlrm
latin1prober.cpython-39.pyc29060644editdlrm
mbcharsetprober.cpython-39.opt-1.pyc22130644editdlrm
mbcharsetprober.cpython-39.pyc22130644editdlrm
mbcsgroupprober.cpython-39.opt-1.pyc10820644editdlrm
mbcsgroupprober.cpython-39.pyc10820644editdlrm
mbcssm.cpython-39.opt-1.pyc156690644editdlrm
mbcssm.cpython-39.pyc156690644editdlrm
sbcharsetprober.cpython-39.opt-1.pyc30660644editdlrm
sbcharsetprober.cpython-39.pyc30660644editdlrm
sbcsgroupprober.cpython-39.opt-1.pyc16510644editdlrm
sbcsgroupprober.cpython-39.pyc16510644editdlrm
sjisprober.cpython-39.opt-1.pyc24340644editdlrm
sjisprober.cpython-39.pyc24340644editdlrm
universaldetector.cpython-39.opt-1.pyc57820644editdlrm
universaldetector.cpython-39.pyc57820644editdlrm
utf8prober.cpython-39.opt-1.pyc19430644editdlrm
utf8prober.cpython-39.pyc19430644editdlrm
version.cpython-39.opt-1.pyc3900644editdlrm
version.cpython-39.pyc3900644editdlrm
__init__.cpython-39.opt-1.pyc18510644editdlrm
__init__.cpython-39.pyc18510644editdlrm
Edit: /usr/lib/python3.9/site-packages/chardet/__pycache__/universaldetector.cpython-39.pyc (5782B)
a =b0@sdZddlZddlZddlZddlmZddlmZmZm Z ddl m Z ddl m Z ddlmZdd lmZGd d d eZdS) a Module containing the UniversalDetector detector class, which is the primary class a user of ``chardet`` should use. :author: Mark Pilgrim (initial port to Python) :author: Shy Shalom (original C code) :author: Dan Blanchard (major refactoring for 3.0) :author: Ian Cordasco N)CharSetGroupProber) InputStateLanguageFilter ProbingState)EscCharSetProber) Latin1Prober)MBCSGroupProber)SBCSGroupProberc @sneZdZdZdZedZedZedZ dddd d d d d dZ e j fddZ ddZddZddZdS)UniversalDetectoraq The ``UniversalDetector`` class underlies the ``chardet.detect`` function and coordinates all of the different charset probers. To get a ``dict`` containing an encoding and its confidence, you can simply run: .. code:: u = UniversalDetector() u.feed(some_bytes) u.close() detected = u.result g?s[-]s(|~{)s[-]z Windows-1252z Windows-1250z Windows-1251z Windows-1256z Windows-1253z Windows-1255z Windows-1254z Windows-1257)z iso-8859-1z iso-8859-2z iso-8859-5z iso-8859-6z iso-8859-7z iso-8859-8z iso-8859-9z iso-8859-13cCsNd|_g|_d|_d|_d|_d|_d|_||_t t |_ d|_ | dS)N)_esc_charset_prober_charset_probersresultdone _got_data _input_state _last_char lang_filterloggingZ getLogger__name__logger_has_win_bytesreset)selfrr=/usr/lib/python3.9/site-packages/chardet/universaldetector.py__init__Qs zUniversalDetector.__init__cCsVdddd|_d|_d|_d|_tj|_d|_|jr>|j |j D] }| qDdS)z Reset the UniversalDetector and all of its probers back to their initial states. This is called by ``__init__``, so you only need to call this directly in between analyses of different documents. Nencoding confidencelanguageF) rrrrr PURE_ASCIIrrr rr )rproberrrrr^s  zUniversalDetector.resetcCs>|jr dSt|sdSt|ts(t|}|js|tjrJdddd|_nv|tj tj frldddd|_nT|drdddd|_n:|d rd ddd|_n |tj tj frd ddd|_d |_|jd durd |_dS|j tjkr.|j|rtj|_ n*|j tjkr.|j|j|r.tj|_ |dd|_|j tjkr|js^t|j|_|j|tjkr:|jj|j|jjd|_d |_n|j tjkr:|jst |jg|_|jt!j"@r|j#t$|j#t%|jD]:}||tjkr|j||jd|_d |_q&q|j&|r:d |_'dS)a Takes a chunk of a document and feeds it through all of the relevant charset probers. After calling ``feed``, you can check the value of the ``done`` attribute to see if you need to continue feeding the ``UniversalDetector`` more data, or if it has made a prediction (in the ``result`` attribute). .. note:: You should always call ``close`` when you're done feeding in your document if ``done`` is not already ``True``. Nz UTF-8-SIG?rzUTF-32szX-ISO-10646-UCS-4-3412szX-ISO-10646-UCS-4-2143zUTF-16Tr)(rlen isinstance bytearrayr startswithcodecsBOM_UTF8r BOM_UTF32_LE BOM_UTF32_BEBOM_LEBOM_BErrr#HIGH_BYTE_DETECTORsearch HIGH_BYTE ESC_DETECTORrZ ESC_ASCIIr rrfeedrZFOUND_IT charset_nameget_confidencer!r r rZNON_CJKappendr rWIN_BYTE_DETECTORr)rZbyte_strr$rrrr6os            zUniversalDetector.feedc Cst|jr |jSd|_|js&|jdn|jtjkrBdddd|_n|jtjkrd}d}d}|j D]"}|sjq`| }||kr`|}|}q`|r||j kr|j }|j }| }|d r|jr|j||}|||jd|_|jtjkrn|jd durn|jd |j D]`}|sq t|trP|jD] }|jd |j |j| q,n|jd |j |j| q |jS) z Stop analyzing the current document and come up with a final prediction. :returns: The ``result`` attribute, a ``dict`` with the keys `encoding`, `confidence`, and `language`. Tzno data received!asciir%r&rNrziso-8859rz no probers hit minimum thresholdz%s %s confidence = %s)rrrrdebugrrr#r4r r8MINIMUM_THRESHOLDr7lowerr+r ISO_WIN_MAPgetr!ZgetEffectiveLevelrDEBUGr)rZprobers) rZprober_confidenceZmax_prober_confidenceZ max_proberr$r7Zlower_charset_namer Z group_proberrrrclosesj            zUniversalDetector.closeN)r __module__ __qualname____doc__r=recompiler2r5r:r?rZALLrrr6rBrrrrr 3s$     mr )rEr,rrFZcharsetgroupproberrZenumsrrrZ escproberrZ latin1proberrZmbcsgroupproberr Zsbcsgroupproberr objectr rrrrs