Overview
Comment: | [graphspell] tokinizer: update |
---|---|
Downloads: | Tarball | ZIP archive | SQL archive |
Timelines: | family | ancestors | descendants | both | trunk | graphspell |
Files: | files | file ages | folders |
SHA3-256: |
ed3b7acf68c98b9331848700f06c31b1 |
User & Date: | olr on 2019-05-02 07:50:21 |
Other Links: | manifest | tags |
Context
2019-05-02
| ||
08:16 | [graphspell] tokinizer: update check-in: 7d30bbec37 user: olr tags: trunk, graphspell | |
07:50 | [graphspell] tokinizer: update check-in: ed3b7acf68 user: olr tags: trunk, graphspell | |
07:30 | [fr] ajustements check-in: d0d59dde79 user: olr tags: trunk, fr | |
Changes
Modified gc_lang/fr/rules.grx from [25d80a896a] to [8974ca1ee5].
︙ | |||
20805 20806 20807 20808 20809 20810 20811 20812 20813 20814 20815 20816 20817 20818 | 20805 20806 20807 20808 20809 20810 20811 20812 20813 20814 20815 20816 20817 20818 20819 | + | TEST: cet être que personne n’a vu ni senti à part elle TEST: un délire systématisé de persécution basé sur des interprétations TEST: Et si je te donne son nom, cela t’aiderait, Dworkin ? TEST: il lui semblait que ne plus être serait un grand soulagement. TEST: Je me suis habitué à ces samedis. TEST: La société Sherlock est spécialisée dans l’investigation. TEST: qui aura à elle seule justifié la présence de la gent féminine TEST: Première & dernière fois !!! Tests historiques !! ## Version 0.5.14 TEST: par le léger tissu de rayonne qui les protégeait en ce moment. |
︙ |
Modified graphspell-js/tokenizer.js from [c05f88b98c] to [d9b8ecbdba].
︙ | |||
20 21 22 23 24 25 26 | 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 | - + - + | [/^(?:https?:\/\/|www[.]|[a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st_-]+[@.][a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st_-]{2,}[@.])[a-zA-Z0-9][a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st_.\/?&!%=+*"'@$#-]+/, 'LINK'], [/^[#@][a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st_-]+/, 'TAG'], [/^<[a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st]+.*?>|<\/[a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st]+ *>/, 'HTML'], [/^\[\/?[a-zA-Zà-öÀ-Ö0-9ø-ÿØ-ßĀ-ʯfi-st]+\]/, 'PSEUDOHTML'], [/^&\w+;(?:\w+;|)/, 'HTMLENTITY'], [/^\d\d?h\d\d\b/, 'HOUR'], [/^\d+(?:[.,]\d+|)/, 'NUM'], |
︙ |
Modified graphspell/tokenizer.py from [13303390f7] to [07708a4bf1].
︙ | |||
14 15 16 17 18 19 20 | 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 | - + - + | r'(?P<WORD_ACRONYM>[A-Z][.][A-Z][.](?:[A-Z][.])*)', r'(?P<LINK>(?:https?://|www[.]|\w+[@.]\w\w+[@.])\w[\w./?&!%=+*"\'@$#-]+)', r'(?P<HASHTAG>[#@][\w-]+)', r'(?P<HTML><\w+.*?>|</\w+ *>)', r'(?P<PSEUDOHTML>\[/?\w+\])', r'(?P<HOUR>\d\d?h\d\d\b)', r'(?P<NUM>\d+(?:[.,]\d+))', |
︙ |