npm - react-native-quick-crypto - Versions diffs - 1.0.19 → 1.1.1 - Mend

react-native-quick-crypto 1.0.19 → 1.1.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.

Files changed (561) hide show

package/QuickCrypto.podspec +12 -38
package/README.md +2 -0
package/android/CMakeLists.txt +3 -0
package/android/build.gradle +5 -1
package/cpp/argon2/HybridArgon2.cpp +10 -3
package/cpp/blake3/HybridBlake3.cpp +5 -3
package/cpp/cipher/CCMCipher.cpp +29 -16
package/cpp/cipher/CCMCipher.hpp +2 -4
package/cpp/cipher/ChaCha20Cipher.cpp +14 -18
package/cpp/cipher/ChaCha20Cipher.hpp +2 -4
package/cpp/cipher/ChaCha20Poly1305Cipher.cpp +34 -23
package/cpp/cipher/ChaCha20Poly1305Cipher.hpp +2 -4
package/cpp/cipher/GCMCipher.cpp +14 -15
package/cpp/cipher/HybridCipher.cpp +39 -36
package/cpp/cipher/HybridCipher.hpp +17 -1
package/cpp/cipher/HybridRsaCipher.cpp +74 -29
package/cpp/cipher/OCBCipher.cpp +4 -3
package/cpp/cipher/XChaCha20Poly1305Cipher.cpp +14 -13
package/cpp/cipher/XSalsa20Cipher.cpp +72 -6
package/cpp/cipher/XSalsa20Cipher.hpp +25 -3
package/cpp/cipher/XSalsa20Poly1305Cipher.cpp +21 -25
package/cpp/dh/HybridDiffieHellman.cpp +29 -0
package/cpp/ec/HybridEcKeyPair.cpp +35 -33
package/cpp/ec/HybridEcKeyPair.hpp +3 -7
package/cpp/ecdh/HybridECDH.cpp +23 -0
package/cpp/ed25519/HybridEdKeyPair.cpp +73 -117
package/cpp/ed25519/HybridEdKeyPair.hpp +5 -9
package/cpp/hash/HybridHash.cpp +5 -7
package/cpp/hkdf/HybridHkdf.cpp +6 -4
package/cpp/hmac/HybridHmac.cpp +4 -6
package/cpp/kmac/HybridKmac.cpp +4 -4
package/cpp/mldsa/HybridMlDsaKeyPair.cpp +37 -49
package/cpp/mlkem/HybridMlKemKeyPair.cpp +39 -43
package/cpp/pbkdf2/HybridPbkdf2.cpp +7 -8
package/cpp/rsa/HybridRsaKeyPair.cpp +5 -8
package/cpp/rsa/HybridRsaKeyPair.hpp +4 -7
package/cpp/scrypt/HybridScrypt.cpp +6 -4
package/cpp/sign/HybridSignHandle.cpp +25 -68
package/cpp/sign/HybridVerifyHandle.cpp +23 -60
package/cpp/utils/HybridUtils.cpp +213 -111
package/cpp/utils/HybridUtils.hpp +9 -2
package/cpp/utils/QuickCryptoUtils.hpp +72 -0
package/deps/simdutf/LICENSE-APACHE +201 -0
package/deps/simdutf/LICENSE-MIT +18 -0
package/deps/simdutf/README.md +2782 -0
package/deps/simdutf/include/simdutf/avx512.h +79 -0
package/deps/simdutf/include/simdutf/base64_implementation.h +158 -0
package/deps/simdutf/include/simdutf/base64_tables.h +887 -0
package/deps/simdutf/include/simdutf/common_defs.h +186 -0
package/deps/simdutf/include/simdutf/compiler_check.h +50 -0
package/deps/simdutf/include/simdutf/constexpr_ptr.h +138 -0
package/deps/simdutf/include/simdutf/encoding_types.h +189 -0
package/deps/simdutf/include/simdutf/error.h +126 -0
package/deps/simdutf/include/simdutf/implementation.h +7081 -0
package/deps/simdutf/include/simdutf/internal/isadetection.h +325 -0
package/deps/simdutf/include/simdutf/portability.h +285 -0
package/deps/simdutf/include/simdutf/scalar/ascii.h +86 -0
package/deps/simdutf/include/simdutf/scalar/atomic_util.h +105 -0
package/deps/simdutf/include/simdutf/scalar/base64.h +911 -0
package/deps/simdutf/include/simdutf/scalar/latin1.h +26 -0
package/deps/simdutf/include/simdutf/scalar/latin1_to_utf16/latin1_to_utf16.h +52 -0
package/deps/simdutf/include/simdutf/scalar/latin1_to_utf32/latin1_to_utf32.h +27 -0
package/deps/simdutf/include/simdutf/scalar/latin1_to_utf8/latin1_to_utf8.h +191 -0
package/deps/simdutf/include/simdutf/scalar/swap_bytes.h +35 -0
package/deps/simdutf/include/simdutf/scalar/utf16.h +226 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_latin1/utf16_to_latin1.h +108 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_latin1/valid_utf16_to_latin1.h +40 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_utf32/utf16_to_utf32.h +86 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_utf32/valid_utf16_to_utf32.h +44 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_utf8/utf16_to_utf8.h +295 -0
package/deps/simdutf/include/simdutf/scalar/utf16_to_utf8/valid_utf16_to_utf8.h +91 -0
package/deps/simdutf/include/simdutf/scalar/utf32.h +82 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_latin1/utf32_to_latin1.h +68 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_latin1/valid_utf32_to_latin1.h +67 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_utf16/utf32_to_utf16.h +84 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_utf16/valid_utf32_to_utf16.h +44 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_utf8/utf32_to_utf8.h +142 -0
package/deps/simdutf/include/simdutf/scalar/utf32_to_utf8/valid_utf32_to_utf8.h +72 -0
package/deps/simdutf/include/simdutf/scalar/utf8.h +326 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_latin1/utf8_to_latin1.h +225 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_latin1/valid_utf8_to_latin1.h +87 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_utf16/utf8_to_utf16.h +342 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_utf16/valid_utf8_to_utf16.h +106 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_utf32/utf8_to_utf32.h +299 -0
package/deps/simdutf/include/simdutf/scalar/utf8_to_utf32/valid_utf8_to_utf32.h +83 -0
package/deps/simdutf/include/simdutf/simdutf_version.h +26 -0
package/deps/simdutf/include/simdutf.h +26 -0
package/deps/simdutf/include/simdutf_c.h +342 -0
package/deps/simdutf/src/arm64/arm_base64.cpp +791 -0
package/deps/simdutf/src/arm64/arm_convert_latin1_to_utf16.cpp +24 -0
package/deps/simdutf/src/arm64/arm_convert_latin1_to_utf32.cpp +24 -0
package/deps/simdutf/src/arm64/arm_convert_latin1_to_utf8.cpp +70 -0
package/deps/simdutf/src/arm64/arm_convert_utf16_to_latin1.cpp +61 -0
package/deps/simdutf/src/arm64/arm_convert_utf16_to_utf32.cpp +185 -0
package/deps/simdutf/src/arm64/arm_convert_utf16_to_utf8.cpp +780 -0
package/deps/simdutf/src/arm64/arm_convert_utf32_to_latin1.cpp +60 -0
package/deps/simdutf/src/arm64/arm_convert_utf32_to_utf16.cpp +208 -0
package/deps/simdutf/src/arm64/arm_convert_utf32_to_utf8.cpp +505 -0
package/deps/simdutf/src/arm64/arm_convert_utf8_to_latin1.cpp +69 -0
package/deps/simdutf/src/arm64/arm_convert_utf8_to_utf16.cpp +313 -0
package/deps/simdutf/src/arm64/arm_convert_utf8_to_utf32.cpp +179 -0
package/deps/simdutf/src/arm64/arm_find.cpp +199 -0
package/deps/simdutf/src/arm64/arm_utf16fix.cpp +185 -0
package/deps/simdutf/src/arm64/arm_validate_utf16.cpp +165 -0
package/deps/simdutf/src/arm64/arm_validate_utf32le.cpp +65 -0
package/deps/simdutf/src/arm64/implementation.cpp +1442 -0
package/deps/simdutf/src/encoding_types.cpp +67 -0
package/deps/simdutf/src/error.cpp +3 -0
package/deps/simdutf/src/fallback/implementation.cpp +589 -0
package/deps/simdutf/src/generic/ascii_validation.h +50 -0
package/deps/simdutf/src/generic/base64.h +233 -0
package/deps/simdutf/src/generic/base64lengths.h +63 -0
package/deps/simdutf/src/generic/buf_block_reader.h +109 -0
package/deps/simdutf/src/generic/find.h +75 -0
package/deps/simdutf/src/generic/utf16/change_endianness.h +24 -0
package/deps/simdutf/src/generic/utf16/count_code_points_bytemask.h +58 -0
package/deps/simdutf/src/generic/utf16/to_well_formed.h +93 -0
package/deps/simdutf/src/generic/utf16/utf32_length_from_utf16.h +15 -0
package/deps/simdutf/src/generic/utf16/utf8_length_from_utf16.h +35 -0
package/deps/simdutf/src/generic/utf16/utf8_length_from_utf16_bytemask.h +199 -0
package/deps/simdutf/src/generic/utf16.h +73 -0
package/deps/simdutf/src/generic/utf32.h +136 -0
package/deps/simdutf/src/generic/utf8/utf16_length_from_utf8_bytemask.h +53 -0
package/deps/simdutf/src/generic/utf8.h +92 -0
package/deps/simdutf/src/generic/utf8_to_latin1/utf8_to_latin1.h +316 -0
package/deps/simdutf/src/generic/utf8_to_latin1/valid_utf8_to_latin1.h +78 -0
package/deps/simdutf/src/generic/utf8_to_utf16/utf8_to_utf16.h +332 -0
package/deps/simdutf/src/generic/utf8_to_utf16/valid_utf8_to_utf16.h +74 -0
package/deps/simdutf/src/generic/utf8_to_utf32/utf8_to_utf32.h +318 -0
package/deps/simdutf/src/generic/utf8_to_utf32/valid_utf8_to_utf32.h +42 -0
package/deps/simdutf/src/generic/utf8_validation/utf8_lookup4_algorithm.h +223 -0
package/deps/simdutf/src/generic/utf8_validation/utf8_validator.h +84 -0
package/deps/simdutf/src/generic/validate_utf16.h +164 -0
package/deps/simdutf/src/generic/validate_utf32.h +99 -0
package/deps/simdutf/src/haswell/avx2_base64.cpp +837 -0
package/deps/simdutf/src/haswell/avx2_convert_latin1_to_utf16.cpp +28 -0
package/deps/simdutf/src/haswell/avx2_convert_latin1_to_utf32.cpp +20 -0
package/deps/simdutf/src/haswell/avx2_convert_latin1_to_utf8.cpp +83 -0
package/deps/simdutf/src/haswell/avx2_convert_utf16_to_latin1.cpp +83 -0
package/deps/simdutf/src/haswell/avx2_convert_utf16_to_utf32.cpp +210 -0
package/deps/simdutf/src/haswell/avx2_convert_utf16_to_utf8.cpp +602 -0
package/deps/simdutf/src/haswell/avx2_convert_utf32_to_latin1.cpp +116 -0
package/deps/simdutf/src/haswell/avx2_convert_utf32_to_utf16.cpp +164 -0
package/deps/simdutf/src/haswell/avx2_convert_utf32_to_utf8.cpp +569 -0
package/deps/simdutf/src/haswell/avx2_convert_utf8_to_latin1.cpp +60 -0
package/deps/simdutf/src/haswell/avx2_convert_utf8_to_utf16.cpp +195 -0
package/deps/simdutf/src/haswell/avx2_convert_utf8_to_utf32.cpp +135 -0
package/deps/simdutf/src/haswell/avx2_utf16fix.cpp +173 -0
package/deps/simdutf/src/haswell/avx2_validate_utf16.cpp +17 -0
package/deps/simdutf/src/haswell/implementation.cpp +1447 -0
package/deps/simdutf/src/icelake/icelake_ascii_validation.inl.cpp +19 -0
package/deps/simdutf/src/icelake/icelake_base64.inl.cpp +630 -0
package/deps/simdutf/src/icelake/icelake_common.inl.cpp +37 -0
package/deps/simdutf/src/icelake/icelake_convert_latin1_to_utf16.inl.cpp +36 -0
package/deps/simdutf/src/icelake/icelake_convert_latin1_to_utf32.inl.cpp +23 -0
package/deps/simdutf/src/icelake/icelake_convert_latin1_to_utf8.inl.cpp +107 -0
package/deps/simdutf/src/icelake/icelake_convert_utf16_to_latin1.inl.cpp +103 -0
package/deps/simdutf/src/icelake/icelake_convert_utf16_to_utf32.inl.cpp +136 -0
package/deps/simdutf/src/icelake/icelake_convert_utf16_to_utf8.inl.cpp +206 -0
package/deps/simdutf/src/icelake/icelake_convert_utf32_to_latin1.inl.cpp +74 -0
package/deps/simdutf/src/icelake/icelake_convert_utf32_to_utf16.inl.cpp +338 -0
package/deps/simdutf/src/icelake/icelake_convert_utf32_to_utf8.inl.cpp +574 -0
package/deps/simdutf/src/icelake/icelake_convert_utf8_to_latin1.inl.cpp +104 -0
package/deps/simdutf/src/icelake/icelake_convert_utf8_to_utf16.inl.cpp +75 -0
package/deps/simdutf/src/icelake/icelake_convert_valid_utf8_to_latin1.inl.cpp +69 -0
package/deps/simdutf/src/icelake/icelake_find.inl.cpp +146 -0
package/deps/simdutf/src/icelake/icelake_from_utf8.inl.cpp +266 -0
package/deps/simdutf/src/icelake/icelake_from_valid_utf8.inl.cpp +136 -0
package/deps/simdutf/src/icelake/icelake_macros.inl.cpp +143 -0
package/deps/simdutf/src/icelake/icelake_utf16fix.cpp +138 -0
package/deps/simdutf/src/icelake/icelake_utf32_validation.inl.cpp +63 -0
package/deps/simdutf/src/icelake/icelake_utf8_common.inl.cpp +753 -0
package/deps/simdutf/src/icelake/icelake_utf8_length_from_utf16.inl.cpp +269 -0
package/deps/simdutf/src/icelake/icelake_utf8_validation.inl.cpp +116 -0
package/deps/simdutf/src/icelake/implementation.cpp +1903 -0
package/deps/simdutf/src/implementation.cpp +2526 -0
package/deps/simdutf/src/lasx/implementation.cpp +1531 -0
package/deps/simdutf/src/lasx/lasx_base64.cpp +695 -0
package/deps/simdutf/src/lasx/lasx_convert_latin1_to_utf16.cpp +76 -0
package/deps/simdutf/src/lasx/lasx_convert_latin1_to_utf32.cpp +55 -0
package/deps/simdutf/src/lasx/lasx_convert_latin1_to_utf8.cpp +65 -0
package/deps/simdutf/src/lasx/lasx_convert_utf16_to_latin1.cpp +64 -0
package/deps/simdutf/src/lasx/lasx_convert_utf16_to_utf32.cpp +183 -0
package/deps/simdutf/src/lasx/lasx_convert_utf16_to_utf8.cpp +550 -0
package/deps/simdutf/src/lasx/lasx_convert_utf32_to_latin1.cpp +73 -0
package/deps/simdutf/src/lasx/lasx_convert_utf32_to_utf16.cpp +218 -0
package/deps/simdutf/src/lasx/lasx_convert_utf32_to_utf8.cpp +589 -0
package/deps/simdutf/src/lasx/lasx_convert_utf8_to_latin1.cpp +72 -0
package/deps/simdutf/src/lasx/lasx_convert_utf8_to_utf16.cpp +296 -0
package/deps/simdutf/src/lasx/lasx_convert_utf8_to_utf32.cpp +190 -0
package/deps/simdutf/src/lasx/lasx_find.cpp +64 -0
package/deps/simdutf/src/lasx/lasx_validate_utf16.cpp +13 -0
package/deps/simdutf/src/lasx/lasx_validate_utf32le.cpp +84 -0
package/deps/simdutf/src/lsx/implementation.cpp +1417 -0
package/deps/simdutf/src/lsx/lsx_base64.cpp +675 -0
package/deps/simdutf/src/lsx/lsx_convert_latin1_to_utf16.cpp +39 -0
package/deps/simdutf/src/lsx/lsx_convert_latin1_to_utf32.cpp +27 -0
package/deps/simdutf/src/lsx/lsx_convert_latin1_to_utf8.cpp +56 -0
package/deps/simdutf/src/lsx/lsx_convert_utf16_to_latin1.cpp +64 -0
package/deps/simdutf/src/lsx/lsx_convert_utf16_to_utf32.cpp +133 -0
package/deps/simdutf/src/lsx/lsx_convert_utf16_to_utf8.cpp +518 -0
package/deps/simdutf/src/lsx/lsx_convert_utf32_to_latin1.cpp +66 -0
package/deps/simdutf/src/lsx/lsx_convert_utf32_to_utf16.cpp +155 -0
package/deps/simdutf/src/lsx/lsx_convert_utf32_to_utf8.cpp +459 -0
package/deps/simdutf/src/lsx/lsx_convert_utf8_to_latin1.cpp +75 -0
package/deps/simdutf/src/lsx/lsx_convert_utf8_to_utf16.cpp +291 -0
package/deps/simdutf/src/lsx/lsx_convert_utf8_to_utf32.cpp +179 -0
package/deps/simdutf/src/lsx/lsx_find.cpp +60 -0
package/deps/simdutf/src/lsx/lsx_validate_utf16.cpp +13 -0
package/deps/simdutf/src/lsx/lsx_validate_utf32le.cpp +68 -0
package/deps/simdutf/src/ppc64/implementation.cpp +992 -0
package/deps/simdutf/src/ppc64/ppc64_base64.cpp +480 -0
package/deps/simdutf/src/ppc64/ppc64_base64_internal_tests.cpp +401 -0
package/deps/simdutf/src/ppc64/ppc64_convert_latin1_to_utf16.cpp +12 -0
package/deps/simdutf/src/ppc64/ppc64_convert_latin1_to_utf32.cpp +12 -0
package/deps/simdutf/src/ppc64/ppc64_convert_latin1_to_utf8.cpp +149 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf16_to_latin1.cpp +67 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf16_to_utf32.cpp +87 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf16_to_utf8.cpp +296 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf32_to_latin1.cpp +57 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf32_to_utf16.cpp +117 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf32_to_utf8.cpp +166 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf8_to_latin1.cpp +69 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf8_to_utf16.cpp +211 -0
package/deps/simdutf/src/ppc64/ppc64_convert_utf8_to_utf32.cpp +153 -0
package/deps/simdutf/src/ppc64/ppc64_utf16_to_utf8_tables.h +1011 -0
package/deps/simdutf/src/ppc64/ppc64_utf8_length_from_latin1.cpp +37 -0
package/deps/simdutf/src/ppc64/ppc64_validate_utf16.cpp +19 -0
package/deps/simdutf/src/ppc64/templates.cpp +91 -0
package/deps/simdutf/src/rvv/implementation.cpp +138 -0
package/deps/simdutf/src/rvv/rvv_find.cpp +27 -0
package/deps/simdutf/src/rvv/rvv_helpers.inl.cpp +23 -0
package/deps/simdutf/src/rvv/rvv_latin1_to.inl.cpp +71 -0
package/deps/simdutf/src/rvv/rvv_length_from.inl.cpp +164 -0
package/deps/simdutf/src/rvv/rvv_utf16_to.inl.cpp +399 -0
package/deps/simdutf/src/rvv/rvv_utf16fix.cpp +110 -0
package/deps/simdutf/src/rvv/rvv_utf32_to.inl.cpp +307 -0
package/deps/simdutf/src/rvv/rvv_utf8_to.inl.cpp +435 -0
package/deps/simdutf/src/rvv/rvv_validate.inl.cpp +275 -0
package/deps/simdutf/src/simdutf/arm64/begin.h +2 -0
package/deps/simdutf/src/simdutf/arm64/bitmanipulation.h +34 -0
package/deps/simdutf/src/simdutf/arm64/end.h +2 -0
package/deps/simdutf/src/simdutf/arm64/implementation.h +307 -0
package/deps/simdutf/src/simdutf/arm64/intrinsics.h +10 -0
package/deps/simdutf/src/simdutf/arm64/simd.h +547 -0
package/deps/simdutf/src/simdutf/arm64/simd16-inl.h +403 -0
package/deps/simdutf/src/simdutf/arm64/simd32-inl.h +129 -0
package/deps/simdutf/src/simdutf/arm64/simd64-inl.h +28 -0
package/deps/simdutf/src/simdutf/arm64.h +43 -0
package/deps/simdutf/src/simdutf/fallback/begin.h +1 -0
package/deps/simdutf/src/simdutf/fallback/bitmanipulation.h +13 -0
package/deps/simdutf/src/simdutf/fallback/end.h +1 -0
package/deps/simdutf/src/simdutf/fallback/implementation.h +331 -0
package/deps/simdutf/src/simdutf/fallback.h +42 -0
package/deps/simdutf/src/simdutf/haswell/begin.h +15 -0
package/deps/simdutf/src/simdutf/haswell/bitmanipulation.h +35 -0
package/deps/simdutf/src/simdutf/haswell/end.h +13 -0
package/deps/simdutf/src/simdutf/haswell/implementation.h +338 -0
package/deps/simdutf/src/simdutf/haswell/intrinsics.h +67 -0
package/deps/simdutf/src/simdutf/haswell/simd.h +363 -0
package/deps/simdutf/src/simdutf/haswell/simd16-inl.h +261 -0
package/deps/simdutf/src/simdutf/haswell/simd32-inl.h +111 -0
package/deps/simdutf/src/simdutf/haswell/simd64-inl.h +34 -0
package/deps/simdutf/src/simdutf/haswell.h +63 -0
package/deps/simdutf/src/simdutf/icelake/begin.h +14 -0
package/deps/simdutf/src/simdutf/icelake/bitmanipulation.h +44 -0
package/deps/simdutf/src/simdutf/icelake/end.h +12 -0
package/deps/simdutf/src/simdutf/icelake/implementation.h +346 -0
package/deps/simdutf/src/simdutf/icelake/intrinsics.h +138 -0
package/deps/simdutf/src/simdutf/icelake/simd.h +17 -0
package/deps/simdutf/src/simdutf/icelake/simd16-inl.h +90 -0
package/deps/simdutf/src/simdutf/icelake/simd32-inl.h +47 -0
package/deps/simdutf/src/simdutf/icelake.h +81 -0
package/deps/simdutf/src/simdutf/lasx/begin.h +8 -0
package/deps/simdutf/src/simdutf/lasx/bitmanipulation.h +25 -0
package/deps/simdutf/src/simdutf/lasx/end.h +8 -0
package/deps/simdutf/src/simdutf/lasx/implementation.h +310 -0
package/deps/simdutf/src/simdutf/lasx/intrinsics.h +319 -0
package/deps/simdutf/src/simdutf/lasx/simd.h +551 -0
package/deps/simdutf/src/simdutf/lasx/simd16-inl.h +234 -0
package/deps/simdutf/src/simdutf/lasx/simd32-inl.h +74 -0
package/deps/simdutf/src/simdutf/lasx/simd64-inl.h +52 -0
package/deps/simdutf/src/simdutf/lasx.h +49 -0
package/deps/simdutf/src/simdutf/lsx/begin.h +2 -0
package/deps/simdutf/src/simdutf/lsx/bitmanipulation.h +25 -0
package/deps/simdutf/src/simdutf/lsx/end.h +2 -0
package/deps/simdutf/src/simdutf/lsx/implementation.h +309 -0
package/deps/simdutf/src/simdutf/lsx/intrinsics.h +196 -0
package/deps/simdutf/src/simdutf/lsx/simd.h +421 -0
package/deps/simdutf/src/simdutf/lsx/simd16-inl.h +242 -0
package/deps/simdutf/src/simdutf/lsx/simd32-inl.h +69 -0
package/deps/simdutf/src/simdutf/lsx/simd64-inl.h +50 -0
package/deps/simdutf/src/simdutf/lsx.h +52 -0
package/deps/simdutf/src/simdutf/ppc64/begin.h +1 -0
package/deps/simdutf/src/simdutf/ppc64/bitmanipulation.h +29 -0
package/deps/simdutf/src/simdutf/ppc64/end.h +1 -0
package/deps/simdutf/src/simdutf/ppc64/implementation.h +348 -0
package/deps/simdutf/src/simdutf/ppc64/intrinsics.h +19 -0
package/deps/simdutf/src/simdutf/ppc64/simd.h +177 -0
package/deps/simdutf/src/simdutf/ppc64/simd16-inl.h +327 -0
package/deps/simdutf/src/simdutf/ppc64/simd32-inl.h +247 -0
package/deps/simdutf/src/simdutf/ppc64/simd8-inl.h +618 -0
package/deps/simdutf/src/simdutf/ppc64.h +40 -0
package/deps/simdutf/src/simdutf/rvv/begin.h +7 -0
package/deps/simdutf/src/simdutf/rvv/end.h +7 -0
package/deps/simdutf/src/simdutf/rvv/implementation.h +321 -0
package/deps/simdutf/src/simdutf/rvv/intrinsics.h +131 -0
package/deps/simdutf/src/simdutf/rvv.h +41 -0
package/deps/simdutf/src/simdutf/westmere/begin.h +8 -0
package/deps/simdutf/src/simdutf/westmere/bitmanipulation.h +37 -0
package/deps/simdutf/src/simdutf/westmere/end.h +8 -0
package/deps/simdutf/src/simdutf/westmere/implementation.h +338 -0
package/deps/simdutf/src/simdutf/westmere/intrinsics.h +38 -0
package/deps/simdutf/src/simdutf/westmere/simd.h +379 -0
package/deps/simdutf/src/simdutf/westmere/simd16-inl.h +242 -0
package/deps/simdutf/src/simdutf/westmere/simd32-inl.h +151 -0
package/deps/simdutf/src/simdutf/westmere/simd64-inl.h +33 -0
package/deps/simdutf/src/simdutf/westmere.h +59 -0
package/deps/simdutf/src/simdutf.cpp +152 -0
package/deps/simdutf/src/simdutf_c.cpp +525 -0
package/deps/simdutf/src/tables/utf16_to_utf8_tables.h +768 -0
package/deps/simdutf/src/tables/utf32_to_utf16_tables.h +53 -0
package/deps/simdutf/src/tables/utf8_to_utf16_tables.h +826 -0
package/deps/simdutf/src/westmere/implementation.cpp +1479 -0
package/deps/simdutf/src/westmere/internal/loader.cpp +7 -0
package/deps/simdutf/src/westmere/internal/write_v_u16_11bits_to_utf8.cpp +66 -0
package/deps/simdutf/src/westmere/sse_base64.cpp +672 -0
package/deps/simdutf/src/westmere/sse_convert_latin1_to_utf16.cpp +21 -0
package/deps/simdutf/src/westmere/sse_convert_latin1_to_utf32.cpp +31 -0
package/deps/simdutf/src/westmere/sse_convert_latin1_to_utf8.cpp +71 -0
package/deps/simdutf/src/westmere/sse_convert_utf16_to_latin1.cpp +70 -0
package/deps/simdutf/src/westmere/sse_convert_utf16_to_utf32.cpp +206 -0
package/deps/simdutf/src/westmere/sse_convert_utf16_to_utf8.cpp +504 -0
package/deps/simdutf/src/westmere/sse_convert_utf32_to_latin1.cpp +82 -0
package/deps/simdutf/src/westmere/sse_convert_utf32_to_utf16.cpp +209 -0
package/deps/simdutf/src/westmere/sse_convert_utf32_to_utf8.cpp +589 -0
package/deps/simdutf/src/westmere/sse_convert_utf8_to_latin1.cpp +58 -0
package/deps/simdutf/src/westmere/sse_convert_utf8_to_utf16.cpp +197 -0
package/deps/simdutf/src/westmere/sse_convert_utf8_to_utf32.cpp +141 -0
package/deps/simdutf/src/westmere/sse_utf16fix.cpp +82 -0
package/deps/simdutf/src/westmere/sse_validate_utf16.cpp +17 -0
package/lib/commonjs/argon2.js +51 -2
package/lib/commonjs/argon2.js.map +1 -1
package/lib/commonjs/cipher.js +109 -11
package/lib/commonjs/cipher.js.map +1 -1
package/lib/commonjs/dsa.js +8 -2
package/lib/commonjs/dsa.js.map +1 -1
package/lib/commonjs/hash.js +15 -5
package/lib/commonjs/hash.js.map +1 -1
package/lib/commonjs/hkdf.js +33 -6
package/lib/commonjs/hkdf.js.map +1 -1
package/lib/commonjs/hmac.js +15 -5
package/lib/commonjs/hmac.js.map +1 -1
package/lib/commonjs/keys/publicCipher.js +10 -4
package/lib/commonjs/keys/publicCipher.js.map +1 -1
package/lib/commonjs/random.js +11 -2
package/lib/commonjs/random.js.map +1 -1
package/lib/commonjs/rsa.js +12 -5
package/lib/commonjs/rsa.js.map +1 -1
package/lib/commonjs/scrypt.js +47 -6
package/lib/commonjs/scrypt.js.map +1 -1
package/lib/commonjs/subtle.js +76 -5
package/lib/commonjs/subtle.js.map +1 -1
package/lib/commonjs/utils/cipher.js +18 -7
package/lib/commonjs/utils/cipher.js.map +1 -1
package/lib/commonjs/utils/conversion.js +33 -9
package/lib/commonjs/utils/conversion.js.map +1 -1
package/lib/commonjs/utils/timingSafeEqual.js +7 -2
package/lib/commonjs/utils/timingSafeEqual.js.map +1 -1
package/lib/commonjs/x509certificate.js +6 -6
package/lib/commonjs/x509certificate.js.map +1 -1
package/lib/module/argon2.js +51 -2
package/lib/module/argon2.js.map +1 -1
package/lib/module/cipher.js +109 -11
package/lib/module/cipher.js.map +1 -1
package/lib/module/dsa.js +8 -2
package/lib/module/dsa.js.map +1 -1
package/lib/module/hash.js +15 -5
package/lib/module/hash.js.map +1 -1
package/lib/module/hkdf.js +33 -6
package/lib/module/hkdf.js.map +1 -1
package/lib/module/hmac.js +15 -5
package/lib/module/hmac.js.map +1 -1
package/lib/module/keys/publicCipher.js +10 -4
package/lib/module/keys/publicCipher.js.map +1 -1
package/lib/module/random.js +11 -2
package/lib/module/random.js.map +1 -1
package/lib/module/rsa.js +11 -4
package/lib/module/rsa.js.map +1 -1
package/lib/module/scrypt.js +47 -6
package/lib/module/scrypt.js.map +1 -1
package/lib/module/subtle.js +76 -5
package/lib/module/subtle.js.map +1 -1
package/lib/module/utils/cipher.js +18 -7
package/lib/module/utils/cipher.js.map +1 -1
package/lib/module/utils/conversion.js +33 -9
package/lib/module/utils/conversion.js.map +1 -1
package/lib/module/utils/timingSafeEqual.js +8 -3
package/lib/module/utils/timingSafeEqual.js.map +1 -1
package/lib/module/x509certificate.js +6 -6
package/lib/module/x509certificate.js.map +1 -1
package/lib/typescript/argon2.d.ts.map +1 -1
package/lib/typescript/cipher.d.ts +2 -2
package/lib/typescript/cipher.d.ts.map +1 -1
package/lib/typescript/dsa.d.ts.map +1 -1
package/lib/typescript/hash.d.ts +2 -2
package/lib/typescript/hash.d.ts.map +1 -1
package/lib/typescript/hkdf.d.ts.map +1 -1
package/lib/typescript/hmac.d.ts +2 -2
package/lib/typescript/hmac.d.ts.map +1 -1
package/lib/typescript/index.d.ts +1 -1
package/lib/typescript/index.d.ts.map +1 -1
package/lib/typescript/keys/publicCipher.d.ts.map +1 -1
package/lib/typescript/random.d.ts.map +1 -1
package/lib/typescript/rsa.d.ts.map +1 -1
package/lib/typescript/scrypt.d.ts.map +1 -1
package/lib/typescript/specs/utils.nitro.d.ts +0 -2
package/lib/typescript/specs/utils.nitro.d.ts.map +1 -1
package/lib/typescript/subtle.d.ts.map +1 -1
package/lib/typescript/utils/cipher.d.ts +13 -1
package/lib/typescript/utils/cipher.d.ts.map +1 -1
package/lib/typescript/utils/conversion.d.ts +9 -6
package/lib/typescript/utils/conversion.d.ts.map +1 -1
package/lib/typescript/utils/timingSafeEqual.d.ts.map +1 -1
package/lib/typescript/x509certificate.d.ts.map +1 -1
package/nitrogen/generated/shared/c++/HybridUtilsSpec.cpp +0 -2
package/nitrogen/generated/shared/c++/HybridUtilsSpec.hpp +0 -3
package/package.json +38 -6
package/src/argon2.ts +80 -2
package/src/cipher.ts +139 -15
package/src/dsa.ts +11 -2
package/src/hash.ts +17 -7
package/src/hkdf.ts +44 -6
package/src/hmac.ts +17 -7
package/src/keys/publicCipher.ts +10 -4
package/src/random.ts +11 -2
package/src/rsa.ts +18 -4
package/src/scrypt.ts +73 -6
package/src/specs/utils.nitro.ts +0 -2
package/src/subtle.ts +90 -8
package/src/utils/cipher.ts +30 -8
package/src/utils/conversion.ts +58 -20
package/src/utils/timingSafeEqual.ts +8 -3
package/src/x509certificate.ts +5 -6
package/deps/blake3/.cargo/config.toml +0 -2
package/deps/blake3/.git-blame-ignore-revs +0 -2
package/deps/blake3/.github/workflows/build_b3sum.py +0 -38
package/deps/blake3/.github/workflows/ci.yml +0 -491
package/deps/blake3/.github/workflows/tag.yml +0 -43
package/deps/blake3/.github/workflows/upload_github_release_asset.py +0 -73
package/deps/blake3/CONTRIBUTING.md +0 -31
package/deps/blake3/Cargo.toml +0 -135
package/deps/blake3/b3sum/Cargo.lock +0 -513
package/deps/blake3/b3sum/Cargo.toml +0 -26
package/deps/blake3/b3sum/README.md +0 -72
package/deps/blake3/b3sum/src/main.rs +0 -564
package/deps/blake3/b3sum/src/unit_tests.rs +0 -235
package/deps/blake3/b3sum/tests/cli_tests.rs +0 -680
package/deps/blake3/b3sum/what_does_check_do.md +0 -176
package/deps/blake3/benches/bench.rs +0 -623
package/deps/blake3/build.rs +0 -389
package/deps/blake3/c/CMakeLists.txt +0 -383
package/deps/blake3/c/CMakePresets.json +0 -73
package/deps/blake3/c/Makefile.testing +0 -82
package/deps/blake3/c/blake3-config.cmake.in +0 -14
package/deps/blake3/c/blake3_avx2.c +0 -326
package/deps/blake3/c/blake3_avx2_x86-64_unix.S +0 -1815
package/deps/blake3/c/blake3_avx2_x86-64_windows_gnu.S +0 -1817
package/deps/blake3/c/blake3_avx2_x86-64_windows_msvc.asm +0 -1828
package/deps/blake3/c/blake3_avx512.c +0 -1388
package/deps/blake3/c/blake3_avx512_x86-64_unix.S +0 -4824
package/deps/blake3/c/blake3_avx512_x86-64_windows_gnu.S +0 -2615
package/deps/blake3/c/blake3_avx512_x86-64_windows_msvc.asm +0 -2634
package/deps/blake3/c/blake3_c_rust_bindings/Cargo.toml +0 -32
package/deps/blake3/c/blake3_c_rust_bindings/README.md +0 -4
package/deps/blake3/c/blake3_c_rust_bindings/benches/bench.rs +0 -477
package/deps/blake3/c/blake3_c_rust_bindings/build.rs +0 -253
package/deps/blake3/c/blake3_c_rust_bindings/cross_test.sh +0 -31
package/deps/blake3/c/blake3_c_rust_bindings/src/lib.rs +0 -333
package/deps/blake3/c/blake3_c_rust_bindings/src/test.rs +0 -696
package/deps/blake3/c/blake3_sse2.c +0 -566
package/deps/blake3/c/blake3_sse2_x86-64_unix.S +0 -2291
package/deps/blake3/c/blake3_sse2_x86-64_windows_gnu.S +0 -2332
package/deps/blake3/c/blake3_sse2_x86-64_windows_msvc.asm +0 -2350
package/deps/blake3/c/blake3_sse41.c +0 -560
package/deps/blake3/c/blake3_sse41_x86-64_unix.S +0 -2028
package/deps/blake3/c/blake3_sse41_x86-64_windows_gnu.S +0 -2069
package/deps/blake3/c/blake3_sse41_x86-64_windows_msvc.asm +0 -2089
package/deps/blake3/c/blake3_tbb.cpp +0 -37
package/deps/blake3/c/dependencies/CMakeLists.txt +0 -3
package/deps/blake3/c/dependencies/tbb/CMakeLists.txt +0 -28
package/deps/blake3/c/example.c +0 -36
package/deps/blake3/c/example_tbb.c +0 -57
package/deps/blake3/c/libblake3.pc.in +0 -12
package/deps/blake3/c/main.c +0 -166
package/deps/blake3/c/test.py +0 -97
package/deps/blake3/media/B3.svg +0 -70
package/deps/blake3/media/BLAKE3.svg +0 -85
package/deps/blake3/media/speed.svg +0 -1474
package/deps/blake3/reference_impl/Cargo.toml +0 -8
package/deps/blake3/reference_impl/README.md +0 -14
package/deps/blake3/reference_impl/reference_impl.rs +0 -374
package/deps/blake3/src/ffi_avx2.rs +0 -65
package/deps/blake3/src/ffi_avx512.rs +0 -169
package/deps/blake3/src/ffi_neon.rs +0 -82
package/deps/blake3/src/ffi_sse2.rs +0 -126
package/deps/blake3/src/ffi_sse41.rs +0 -126
package/deps/blake3/src/guts.rs +0 -60
package/deps/blake3/src/hazmat.rs +0 -704
package/deps/blake3/src/io.rs +0 -64
package/deps/blake3/src/join.rs +0 -92
package/deps/blake3/src/lib.rs +0 -1835
package/deps/blake3/src/platform.rs +0 -587
package/deps/blake3/src/portable.rs +0 -198
package/deps/blake3/src/rust_avx2.rs +0 -474
package/deps/blake3/src/rust_sse2.rs +0 -775
package/deps/blake3/src/rust_sse41.rs +0 -766
package/deps/blake3/src/test.rs +0 -1049
package/deps/blake3/src/traits.rs +0 -227
package/deps/blake3/src/wasm32_simd.rs +0 -794
package/deps/blake3/test_vectors/Cargo.toml +0 -19
package/deps/blake3/test_vectors/cross_test.sh +0 -25
package/deps/blake3/test_vectors/src/bin/generate.rs +0 -4
package/deps/blake3/test_vectors/src/lib.rs +0 -350
package/deps/blake3/test_vectors/test_vectors.json +0 -217
package/deps/blake3/tools/compiler_version/Cargo.toml +0 -7
package/deps/blake3/tools/compiler_version/build.rs +0 -6
package/deps/blake3/tools/compiler_version/src/main.rs +0 -27
package/deps/blake3/tools/instruction_set_support/Cargo.toml +0 -6
package/deps/blake3/tools/instruction_set_support/src/main.rs +0 -10
package/deps/blake3/tools/release.md +0 -16
package/deps/ncrypto/.bazelignore +0 -4
package/deps/ncrypto/.bazelrc +0 -1
package/deps/ncrypto/.bazelversion +0 -1
package/deps/ncrypto/.clang-format +0 -111
package/deps/ncrypto/.github/workflows/bazel.yml +0 -58
package/deps/ncrypto/.github/workflows/commitlint.yml +0 -16
package/deps/ncrypto/.github/workflows/linter.yml +0 -38
package/deps/ncrypto/.github/workflows/macos.yml +0 -43
package/deps/ncrypto/.github/workflows/release-please.yml +0 -16
package/deps/ncrypto/.github/workflows/ubuntu.yml +0 -128
package/deps/ncrypto/.github/workflows/visual-studio.yml +0 -49
package/deps/ncrypto/.python-version +0 -1
package/deps/ncrypto/.release-please-manifest.json +0 -3
package/deps/ncrypto/BUILD.bazel +0 -44
package/deps/ncrypto/CHANGELOG.md +0 -37
package/deps/ncrypto/CMakeLists.txt +0 -79
package/deps/ncrypto/MODULE.bazel +0 -16
package/deps/ncrypto/MODULE.bazel.lock +0 -461
package/deps/ncrypto/cmake/CPM.cmake +0 -1225
package/deps/ncrypto/cmake/ncrypto-flags.cmake +0 -17
package/deps/ncrypto/ncrypto.pc.in +0 -10
package/deps/ncrypto/patches/0001-Expose-libdecrepit-so-NodeJS-can-use-it-for-ncrypto.patch +0 -28
package/deps/ncrypto/pyproject.toml +0 -38
package/deps/ncrypto/release-please-config.json +0 -11
package/deps/ncrypto/src/CMakeLists.txt +0 -40
package/deps/ncrypto/tests/BUILD.bazel +0 -11
package/deps/ncrypto/tests/CMakeLists.txt +0 -7
package/deps/ncrypto/tests/basic.cpp +0 -856
package/deps/ncrypto/tools/run-clang-format.sh +0 -42
package/lib/tsconfig.tsbuildinfo +0 -1

package/deps/simdutf/src/westmere/sse_convert_utf32_to_utf8.cpp ADDED Viewed

@@ -0,0 +1,589 @@
+std::pair<const char32_t *, char *>
+sse_convert_utf32_to_utf8(const char32_t *buf, size_t len, char *utf8_output) {
+  const char32_t *end = buf + len;
+  const __m128i v_0000 = _mm_setzero_si128();              //__m128 = 128 bits
+  const __m128i v_f800 = _mm_set1_epi16((uint16_t)0xf800); // 1111 1000 0000
+                                                           // 0000
+  const __m128i v_c080 = _mm_set1_epi16((uint16_t)0xc080); // 1100 0000 1000
+                                                           // 0000
+  const __m128i v_ff80 = _mm_set1_epi16((uint16_t)0xff80); // 1111 1111 1000
+                                                           // 0000
+  const __m128i v_ffff0000 = _mm_set1_epi32(
+      (uint32_t)0xffff0000); // 1111 1111 1111 1111 0000 0000 0000 0000
+  const __m128i v_7fffffff = _mm_set1_epi32(
+      (uint32_t)0x7fffffff); // 0111 1111 1111 1111 1111 1111 1111 1111
+  __m128i running_max = _mm_setzero_si128();
+  __m128i forbidden_bytemask = _mm_setzero_si128();
+  const size_t safety_margin =
+      12; // to avoid overruns, see issue
+          // https://github.com/simdutf/simdutf/issues/92
+  while (end - buf >=
+         std::ptrdiff_t(
+             16 + safety_margin)) { // buf is a char32_t pointer, each char32_t
+                                    // has 4 bytes or 32 bits, thus buf + 16 *
+                                    // char_32t = 512 bits = 64 bytes
+    // We load two 16 bytes registers for a total of 32 bytes or 16 characters.
+    __m128i in = _mm_loadu_si128((__m128i *)buf);
+    __m128i nextin = _mm_loadu_si128(
+        (__m128i *)buf + 1); // These two values can hold only 8 UTF32 chars
+    running_max = _mm_max_epu32(
+        _mm_max_epu32(in, running_max), // take element-wise max char32_t from
+                                        // in and running_max vector
+        nextin); // and take element-wise max element from nextin and
+                 // running_max vector
+    // Pack 32-bit UTF-32 code units to 16-bit UTF-16 code units with unsigned
+    // saturation
+    __m128i in_16 = _mm_packus_epi32(
+        _mm_and_si128(in, v_7fffffff),
+        _mm_and_si128(
+            nextin,
+            v_7fffffff)); // in this context pack the two __m128 into a single
+    // By ensuring the highest bit is set to 0(&v_7fffffff), we are making sure
+    // all values are interpreted as non-negative, or specifically, the values
+    // are within the range of valid Unicode code points. remember : having
+    // leading byte 0 means a positive number by the two complements system.
+    // Unicode is well beneath the range where you'll start getting issues so
+    // that's OK.
+    // Try to apply UTF-16 => UTF-8 from ./sse_convert_utf16_to_utf8.cpp
+    // Check for ASCII fast path
+    // ASCII fast path!!!!
+    // We eagerly load another 32 bytes, hoping that they will be ASCII too.
+    // The intuition is that we try to collect 16 ASCII characters which
+    // requires a total of 64 bytes of input. If we fail, we just pass thirdin
+    // and fourthin as our new inputs.
+    if (_mm_testz_si128(in_16, v_ff80)) { // if the first two blocks are ASCII
+      __m128i thirdin = _mm_loadu_si128((__m128i *)buf + 2);
+      __m128i fourthin = _mm_loadu_si128((__m128i *)buf + 3);
+      running_max = _mm_max_epu32(
+          _mm_max_epu32(thirdin, running_max),
+          fourthin); // take the running max of all 4 vectors thus far
+      __m128i nextin_16 = _mm_packus_epi32(
+          _mm_and_si128(thirdin, v_7fffffff),
+          _mm_and_si128(fourthin,
+                        v_7fffffff)); // pack into 1 vector, now you have two
+      if (!_mm_testz_si128(
+              nextin_16,
+              v_ff80)) { // checks if the second packed vector is ASCII, if not:
+        // 1. pack the bytes
+        // obviously suboptimal.
+        const __m128i utf8_packed = _mm_packus_epi16(
+            in_16, in_16); // creates two copy of in_16 in 1 vector
+        // 2. store (16 bytes)
+        _mm_storeu_si128((__m128i *)utf8_output,
+                         utf8_packed); // put them into the output
+        // 3. adjust pointers
+        buf += 8; // the char32_t buffer pointer goes up 8 char32_t chars* 32
+                  // bits =  256 bits
+        utf8_output +=
+            8; // same with output, e.g. lift the first two blocks alone.
+        // Proceed with next input
+        in_16 = nextin_16;
+        // We need to update in and nextin because they are used later.
+        in = thirdin;
+        nextin = fourthin;
+      } else {
+        // 1. pack the bytes
+        const __m128i utf8_packed = _mm_packus_epi16(in_16, nextin_16);
+        // 2. store (16 bytes)
+        _mm_storeu_si128((__m128i *)utf8_output, utf8_packed);
+        // 3. adjust pointers
+        buf += 16;
+        utf8_output += 16;
+        continue; // we are done for this round!
+      }
+    }
+    // no bits set above 7th bit -- find out all the ASCII characters
+    const __m128i one_byte_bytemask =
+        _mm_cmpeq_epi16( // this takes four bytes at a time and compares:
+            _mm_and_si128(in_16, v_ff80), // the vector that get only the first
+                                          // 9 bits of each 16-bit/2-byte units
+            v_0000                        //
+        ); // they should be all zero if they are ASCII. E.g. ASCII in UTF32 is
+           // of format 0000 0000 0000 0XXX XXXX
+    // _mm_cmpeq_epi16 should now return a 1111 1111 1111 1111 for equals, and
+    // 0000 0000 0000 0000 if not for each 16-bit/2-byte units
+    const uint16_t one_byte_bitmask = static_cast<uint16_t>(_mm_movemask_epi8(
+        one_byte_bytemask)); // collect the MSB from previous vector and put
+                             // them into uint16_t mas
+    // no bits set above 11th bit
+    const __m128i one_or_two_bytes_bytemask =
+        _mm_cmpeq_epi16(_mm_and_si128(in_16, v_f800), v_0000);
+    const uint16_t one_or_two_bytes_bitmask =
+        static_cast<uint16_t>(_mm_movemask_epi8(one_or_two_bytes_bytemask));
+    if (one_or_two_bytes_bitmask == 0xffff) {
+      // case: all code units either produce 1 or 2 UTF-8 bytes (at least one
+      // produces 2 bytes)
+      // 1. prepare 2-byte values
+      // input 16-bit word : [0000|0aaa|aabb|bbbb] x 8
+      // expected output   : [110a|aaaa|10bb|bbbb] x 8
+      const __m128i v_1f00 =
+          _mm_set1_epi16((int16_t)0x1f00); // 0001 1111 0000 0000
+      const __m128i v_003f =
+          _mm_set1_epi16((int16_t)0x003f); // 0000 0000 0011 1111
+      // t0 = [000a|aaaa|bbbb|bb00]
+      const __m128i t0 = _mm_slli_epi16(in_16, 2); // shift packed vector by two
+      // t1 = [000a|aaaa|0000|0000]
+      const __m128i t1 = _mm_and_si128(t0, v_1f00); // potential first utf8 byte
+      // t2 = [0000|0000|00bb|bbbb]
+      const __m128i t2 =
+          _mm_and_si128(in_16, v_003f); // potential second utf8 byte
+      // t3 = [000a|aaaa|00bb|bbbb]
+      const __m128i t3 =
+          _mm_or_si128(t1, t2); // first and second potential utf8 byte together
+      // t4 = [110a|aaaa|10bb|bbbb]
+      const __m128i t4 = _mm_or_si128(
+          t3,
+          v_c080); // t3 | 1100 0000 1000 0000 = full potential 2-byte utf8 unit
+      // 2. merge ASCII and 2-byte codewords
+      const __m128i utf8_unpacked =
+          _mm_blendv_epi8(t4, in_16, one_byte_bytemask);
+      // 3. prepare bitmask for 8-bit lookup
+      //    one_byte_bitmask = hhggffeeddccbbaa -- the bits are doubled (h -
+      //    MSB, a - LSB)
+      const uint16_t m0 = one_byte_bitmask & 0x5555; // m0 = 0h0g0f0e0d0c0b0a
+      const uint16_t m1 =
+          static_cast<uint16_t>(m0 >> 7); // m1 = 00000000h0g0f0e0
+      const uint8_t m2 =
+          static_cast<uint8_t>((m0 | m1) & 0xff); // m2 =         hdgcfbea
+      // 4. pack the bytes
+      const uint8_t *row =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_utf8_bytes[m2][0];
+      const __m128i shuffle = _mm_loadu_si128((__m128i *)(row + 1));
+      const __m128i utf8_packed = _mm_shuffle_epi8(utf8_unpacked, shuffle);
+      // 5. store bytes
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_packed);
+      // 6. adjust pointers
+      buf += 8;
+      utf8_output += row[0];
+      continue;
+    }
+    // Check for overflow in packing
+    const __m128i saturation_bytemask = _mm_cmpeq_epi32(
+        _mm_and_si128(_mm_or_si128(in, nextin), v_ffff0000), v_0000);
+    const uint32_t saturation_bitmask =
+        static_cast<uint32_t>(_mm_movemask_epi8(saturation_bytemask));
+    if (saturation_bitmask == 0xffff) {
+      // case: code units from register produce either 1, 2 or 3 UTF-8 bytes
+      const __m128i v_d800 = _mm_set1_epi16((uint16_t)0xd800);
+      forbidden_bytemask =
+          _mm_or_si128(forbidden_bytemask,
+                       _mm_cmpeq_epi16(_mm_and_si128(in_16, v_f800), v_d800));
+      const __m128i dup_even = _mm_setr_epi16(0x0000, 0x0202, 0x0404, 0x0606,
+                                              0x0808, 0x0a0a, 0x0c0c, 0x0e0e);
+      /* In this branch we handle three cases:
+          1. [0000|0000|0ccc|cccc] => [0ccc|cccc]                           -
+        single UFT-8 byte
+          2. [0000|0bbb|bbcc|cccc] => [110b|bbbb], [10cc|cccc]              -
+        two UTF-8 bytes
+          3. [aaaa|bbbb|bbcc|cccc] => [1110|aaaa], [10bb|bbbb], [10cc|cccc] -
+        three UTF-8 bytes
+        We expand the input word (16-bit) into two code units (32-bit), thus
+        we have room for four bytes. However, we need five distinct bit
+        layouts. Note that the last byte in cases #2 and #3 is the same.
+        We precompute byte 1 for case #1 and the common byte for cases #2 & #3
+        in register t2.
+        We precompute byte 1 for case #3 and -- **conditionally** -- precompute
+        either byte 1 for case #2 or byte 2 for case #3. Note that they
+        differ by exactly one bit.
+        Finally from these two code units we build proper UTF-8 sequence, taking
+        into account the case (i.e, the number of bytes to write).
+      */
+      /**
+       * Given [aaaa|bbbb|bbcc|cccc] our goal is to produce:
+       * t2 => [0ccc|cccc] [10cc|cccc]
+       * s4 => [1110|aaaa] ([110b|bbbb] OR [10bb|bbbb])
+       */
+#define simdutf_vec(x) _mm_set1_epi16(static_cast<uint16_t>(x))
+      // [aaaa|bbbb|bbcc|cccc] => [bbcc|cccc|bbcc|cccc]
+      const __m128i t0 = _mm_shuffle_epi8(in_16, dup_even);
+      // [bbcc|cccc|bbcc|cccc] => [00cc|cccc|0bcc|cccc]
+      const __m128i t1 = _mm_and_si128(t0, simdutf_vec(0b0011111101111111));
+      // [00cc|cccc|0bcc|cccc] => [10cc|cccc|0bcc|cccc]
+      const __m128i t2 = _mm_or_si128(t1, simdutf_vec(0b1000000000000000));
+      // [aaaa|bbbb|bbcc|cccc] =>  [0000|aaaa|bbbb|bbcc]
+      const __m128i s0 = _mm_srli_epi16(in_16, 4);
+      // [0000|aaaa|bbbb|bbcc] => [0000|aaaa|bbbb|bb00]
+      const __m128i s1 = _mm_and_si128(s0, simdutf_vec(0b0000111111111100));
+      // [0000|aaaa|bbbb|bb00] => [00bb|bbbb|0000|aaaa]
+      const __m128i s2 = _mm_maddubs_epi16(s1, simdutf_vec(0x0140));
+      // [00bb|bbbb|0000|aaaa] => [11bb|bbbb|1110|aaaa]
+      const __m128i s3 = _mm_or_si128(s2, simdutf_vec(0b1100000011100000));
+      const __m128i m0 = _mm_andnot_si128(one_or_two_bytes_bytemask,
+                                          simdutf_vec(0b0100000000000000));
+      const __m128i s4 = _mm_xor_si128(s3, m0);
+#undef simdutf_vec
+      // 4. expand code units 16-bit => 32-bit
+      const __m128i out0 = _mm_unpacklo_epi16(t2, s4);
+      const __m128i out1 = _mm_unpackhi_epi16(t2, s4);
+      // 5. compress 32-bit code units into 1, 2 or 3 bytes -- 2 x shuffle
+      const uint16_t mask =
+          (one_byte_bitmask & 0x5555) | (one_or_two_bytes_bitmask & 0xaaaa);
+      if (mask == 0) {
+        // We only have three-byte code units. Use fast path.
+        const __m128i shuffle = _mm_setr_epi8(2, 3, 1, 6, 7, 5, 10, 11, 9, 14,
+                                              15, 13, -1, -1, -1, -1);
+        const __m128i utf8_0 = _mm_shuffle_epi8(out0, shuffle);
+        const __m128i utf8_1 = _mm_shuffle_epi8(out1, shuffle);
+        _mm_storeu_si128((__m128i *)utf8_output, utf8_0);
+        utf8_output += 12;
+        _mm_storeu_si128((__m128i *)utf8_output, utf8_1);
+        utf8_output += 12;
+        buf += 8;
+        continue;
+      }
+      const uint8_t mask0 = uint8_t(mask);
+      const uint8_t *row0 =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_3_utf8_bytes[mask0][0];
+      const __m128i shuffle0 = _mm_loadu_si128((__m128i *)(row0 + 1));
+      const __m128i utf8_0 = _mm_shuffle_epi8(out0, shuffle0);
+      const uint8_t mask1 = static_cast<uint8_t>(mask >> 8);
+      const uint8_t *row1 =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_3_utf8_bytes[mask1][0];
+      const __m128i shuffle1 = _mm_loadu_si128((__m128i *)(row1 + 1));
+      const __m128i utf8_1 = _mm_shuffle_epi8(out1, shuffle1);
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_0);
+      utf8_output += row0[0];
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_1);
+      utf8_output += row1[0];
+      buf += 8;
+    } else {
+      // case: at least one 32-bit word produce a surrogate pair in UTF-16 <=>
+      // will produce four UTF-8 bytes Let us do a scalar fallback. It may seem
+      // wasteful to use scalar code, but being efficient with SIMD in the
+      // presence of surrogate pairs may require non-trivial tables.
+      size_t forward = 15;
+      size_t k = 0;
+      if (size_t(end - buf) < forward + 1) {
+        forward = size_t(end - buf - 1);
+      }
+      for (; k < forward; k++) {
+        uint32_t word = buf[k];
+        if ((word & 0xFFFFFF80) == 0) {
+          *utf8_output++ = char(word);
+        } else if ((word & 0xFFFFF800) == 0) {
+          *utf8_output++ = char((word >> 6) | 0b11000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        } else if ((word & 0xFFFF0000) == 0) {
+          if (word >= 0xD800 && word <= 0xDFFF) {
+            return std::make_pair(nullptr, utf8_output);
+          }
+          *utf8_output++ = char((word >> 12) | 0b11100000);
+          *utf8_output++ = char(((word >> 6) & 0b111111) | 0b10000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        } else {
+          if (word > 0x10FFFF) {
+            return std::make_pair(nullptr, utf8_output);
+          }
+          *utf8_output++ = char((word >> 18) | 0b11110000);
+          *utf8_output++ = char(((word >> 12) & 0b111111) | 0b10000000);
+          *utf8_output++ = char(((word >> 6) & 0b111111) | 0b10000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        }
+      }
+      buf += k;
+    }
+  } // while
+  // check for invalid input
+  const __m128i v_10ffff = _mm_set1_epi32((uint32_t)0x10ffff);
+  if (static_cast<uint16_t>(_mm_movemask_epi8(_mm_cmpeq_epi32(
+          _mm_max_epu32(running_max, v_10ffff), v_10ffff))) != 0xffff) {
+    return std::make_pair(nullptr, utf8_output);
+  }
+  if (static_cast<uint32_t>(_mm_movemask_epi8(forbidden_bytemask)) != 0) {
+    return std::make_pair(nullptr, utf8_output);
+  }
+  return std::make_pair(buf, utf8_output);
+}
+std::pair<result, char *>
+sse_convert_utf32_to_utf8_with_errors(const char32_t *buf, size_t len,
+                                      char *utf8_output) {
+  const char32_t *end = buf + len;
+  const char32_t *start = buf;
+  const __m128i v_0000 = _mm_setzero_si128();
+  const __m128i v_f800 = _mm_set1_epi16((uint16_t)0xf800);
+  const __m128i v_c080 = _mm_set1_epi16((uint16_t)0xc080);
+  const __m128i v_ff80 = _mm_set1_epi16((uint16_t)0xff80);
+  const __m128i v_ffff0000 = _mm_set1_epi32((uint32_t)0xffff0000);
+  const __m128i v_7fffffff = _mm_set1_epi32((uint32_t)0x7fffffff);
+  const __m128i v_10ffff = _mm_set1_epi32((uint32_t)0x10ffff);
+  const size_t safety_margin =
+      12; // to avoid overruns, see issue
+          // https://github.com/simdutf/simdutf/issues/92
+  while (end - buf >= std::ptrdiff_t(16 + safety_margin)) {
+    // We load two 16 bytes registers for a total of 32 bytes or 8 characters.
+    __m128i in = _mm_loadu_si128((__m128i *)buf);
+    __m128i nextin = _mm_loadu_si128((__m128i *)buf + 1);
+    // Check for too large input
+    __m128i max_input = _mm_max_epu32(_mm_max_epu32(in, nextin), v_10ffff);
+    if (static_cast<uint16_t>(_mm_movemask_epi8(
+            _mm_cmpeq_epi32(max_input, v_10ffff))) != 0xffff) {
+      return std::make_pair(result(error_code::TOO_LARGE, buf - start),
+                            utf8_output);
+    }
+    // Pack 32-bit UTF-32 code units to 16-bit UTF-16 code units with unsigned
+    // saturation
+    __m128i in_16 = _mm_packus_epi32(_mm_and_si128(in, v_7fffffff),
+                                     _mm_and_si128(nextin, v_7fffffff));
+    // Try to apply UTF-16 => UTF-8 from ./sse_convert_utf16_to_utf8.cpp
+    // Check for ASCII fast path
+    if (_mm_testz_si128(in_16, v_ff80)) { // ASCII fast path!!!!
+      // 1. pack the bytes
+      // obviously suboptimal.
+      const __m128i utf8_packed = _mm_packus_epi16(in_16, in_16);
+      // 2. store (16 bytes)
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_packed);
+      // 3. adjust pointers
+      buf += 8;
+      utf8_output += 8;
+      continue;
+    }
+    // no bits set above 7th bit
+    const __m128i one_byte_bytemask =
+        _mm_cmpeq_epi16(_mm_and_si128(in_16, v_ff80), v_0000);
+    const uint16_t one_byte_bitmask =
+        static_cast<uint16_t>(_mm_movemask_epi8(one_byte_bytemask));
+    // no bits set above 11th bit
+    const __m128i one_or_two_bytes_bytemask =
+        _mm_cmpeq_epi16(_mm_and_si128(in_16, v_f800), v_0000);
+    const uint16_t one_or_two_bytes_bitmask =
+        static_cast<uint16_t>(_mm_movemask_epi8(one_or_two_bytes_bytemask));
+    if (one_or_two_bytes_bitmask == 0xffff) {
+      // case: all code units either produce 1 or 2 UTF-8 bytes (at least one
+      // produces 2 bytes)
+      // 1. prepare 2-byte values
+      // input 16-bit word : [0000|0aaa|aabb|bbbb] x 8
+      // expected output   : [110a|aaaa|10bb|bbbb] x 8
+      const __m128i v_1f00 = _mm_set1_epi16((int16_t)0x1f00);
+      const __m128i v_003f = _mm_set1_epi16((int16_t)0x003f);
+      // t0 = [000a|aaaa|bbbb|bb00]
+      const __m128i t0 = _mm_slli_epi16(in_16, 2);
+      // t1 = [000a|aaaa|0000|0000]
+      const __m128i t1 = _mm_and_si128(t0, v_1f00);
+      // t2 = [0000|0000|00bb|bbbb]
+      const __m128i t2 = _mm_and_si128(in_16, v_003f);
+      // t3 = [000a|aaaa|00bb|bbbb]
+      const __m128i t3 = _mm_or_si128(t1, t2);
+      // t4 = [110a|aaaa|10bb|bbbb]
+      const __m128i t4 = _mm_or_si128(t3, v_c080);
+      // 2. merge ASCII and 2-byte codewords
+      const __m128i utf8_unpacked =
+          _mm_blendv_epi8(t4, in_16, one_byte_bytemask);
+      // 3. prepare bitmask for 8-bit lookup
+      //    one_byte_bitmask = hhggffeeddccbbaa -- the bits are doubled (h -
+      //    MSB, a - LSB)
+      const uint16_t m0 = one_byte_bitmask & 0x5555; // m0 = 0h0g0f0e0d0c0b0a
+      const uint16_t m1 =
+          static_cast<uint16_t>(m0 >> 7); // m1 = 00000000h0g0f0e0
+      const uint8_t m2 =
+          static_cast<uint8_t>((m0 | m1) & 0xff); // m2 =         hdgcfbea
+      // 4. pack the bytes
+      const uint8_t *row =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_utf8_bytes[m2][0];
+      const __m128i shuffle = _mm_loadu_si128((__m128i *)(row + 1));
+      const __m128i utf8_packed = _mm_shuffle_epi8(utf8_unpacked, shuffle);
+      // 5. store bytes
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_packed);
+      // 6. adjust pointers
+      buf += 8;
+      utf8_output += row[0];
+      continue;
+    }
+    // Check for overflow in packing
+    const __m128i saturation_bytemask = _mm_cmpeq_epi32(
+        _mm_and_si128(_mm_or_si128(in, nextin), v_ffff0000), v_0000);
+    const uint32_t saturation_bitmask =
+        static_cast<uint32_t>(_mm_movemask_epi8(saturation_bytemask));
+    if (saturation_bitmask == 0xffff) {
+      // case: code units from register produce either 1, 2 or 3 UTF-8 bytes
+      // Check for illegal surrogate code units
+      const __m128i v_d800 = _mm_set1_epi16((uint16_t)0xd800);
+      const __m128i forbidden_bytemask =
+          _mm_cmpeq_epi16(_mm_and_si128(in_16, v_f800), v_d800);
+      if (static_cast<uint32_t>(_mm_movemask_epi8(forbidden_bytemask)) != 0) {
+        return std::make_pair(result(error_code::SURROGATE, buf - start),
+                              utf8_output);
+      }
+      const __m128i dup_even = _mm_setr_epi16(0x0000, 0x0202, 0x0404, 0x0606,
+                                              0x0808, 0x0a0a, 0x0c0c, 0x0e0e);
+      /* In this branch we handle three cases:
+          1. [0000|0000|0ccc|cccc] => [0ccc|cccc]                           -
+        single UFT-8 byte
+          2. [0000|0bbb|bbcc|cccc] => [110b|bbbb], [10cc|cccc]              -
+        two UTF-8 bytes
+          3. [aaaa|bbbb|bbcc|cccc] => [1110|aaaa], [10bb|bbbb], [10cc|cccc] -
+        three UTF-8 bytes
+        We expand the input word (16-bit) into two code units (32-bit), thus
+        we have room for four bytes. However, we need five distinct bit
+        layouts. Note that the last byte in cases #2 and #3 is the same.
+        We precompute byte 1 for case #1 and the common byte for cases #2 & #3
+        in register t2.
+        We precompute byte 1 for case #3 and -- **conditionally** -- precompute
+        either byte 1 for case #2 or byte 2 for case #3. Note that they
+        differ by exactly one bit.
+        Finally from these two code units we build proper UTF-8 sequence, taking
+        into account the case (i.e, the number of bytes to write).
+      */
+      /**
+       * Given [aaaa|bbbb|bbcc|cccc] our goal is to produce:
+       * t2 => [0ccc|cccc] [10cc|cccc]
+       * s4 => [1110|aaaa] ([110b|bbbb] OR [10bb|bbbb])
+       */
+#define simdutf_vec(x) _mm_set1_epi16(static_cast<uint16_t>(x))
+      // [aaaa|bbbb|bbcc|cccc] => [bbcc|cccc|bbcc|cccc]
+      const __m128i t0 = _mm_shuffle_epi8(in_16, dup_even);
+      // [bbcc|cccc|bbcc|cccc] => [00cc|cccc|0bcc|cccc]
+      const __m128i t1 = _mm_and_si128(t0, simdutf_vec(0b0011111101111111));
+      // [00cc|cccc|0bcc|cccc] => [10cc|cccc|0bcc|cccc]
+      const __m128i t2 = _mm_or_si128(t1, simdutf_vec(0b1000000000000000));
+      // [aaaa|bbbb|bbcc|cccc] =>  [0000|aaaa|bbbb|bbcc]
+      const __m128i s0 = _mm_srli_epi16(in_16, 4);
+      // [0000|aaaa|bbbb|bbcc] => [0000|aaaa|bbbb|bb00]
+      const __m128i s1 = _mm_and_si128(s0, simdutf_vec(0b0000111111111100));
+      // [0000|aaaa|bbbb|bb00] => [00bb|bbbb|0000|aaaa]
+      const __m128i s2 = _mm_maddubs_epi16(s1, simdutf_vec(0x0140));
+      // [00bb|bbbb|0000|aaaa] => [11bb|bbbb|1110|aaaa]
+      const __m128i s3 = _mm_or_si128(s2, simdutf_vec(0b1100000011100000));
+      const __m128i m0 = _mm_andnot_si128(one_or_two_bytes_bytemask,
+                                          simdutf_vec(0b0100000000000000));
+      const __m128i s4 = _mm_xor_si128(s3, m0);
+#undef simdutf_vec
+      // 4. expand code units 16-bit => 32-bit
+      const __m128i out0 = _mm_unpacklo_epi16(t2, s4);
+      const __m128i out1 = _mm_unpackhi_epi16(t2, s4);
+      // 5. compress 32-bit code units into 1, 2 or 3 bytes -- 2 x shuffle
+      const uint16_t mask =
+          (one_byte_bitmask & 0x5555) | (one_or_two_bytes_bitmask & 0xaaaa);
+      if (mask == 0) {
+        // We only have three-byte code units. Use fast path.
+        const __m128i shuffle = _mm_setr_epi8(2, 3, 1, 6, 7, 5, 10, 11, 9, 14,
+                                              15, 13, -1, -1, -1, -1);
+        const __m128i utf8_0 = _mm_shuffle_epi8(out0, shuffle);
+        const __m128i utf8_1 = _mm_shuffle_epi8(out1, shuffle);
+        _mm_storeu_si128((__m128i *)utf8_output, utf8_0);
+        utf8_output += 12;
+        _mm_storeu_si128((__m128i *)utf8_output, utf8_1);
+        utf8_output += 12;
+        buf += 8;
+        continue;
+      }
+      const uint8_t mask0 = uint8_t(mask);
+      const uint8_t *row0 =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_3_utf8_bytes[mask0][0];
+      const __m128i shuffle0 = _mm_loadu_si128((__m128i *)(row0 + 1));
+      const __m128i utf8_0 = _mm_shuffle_epi8(out0, shuffle0);
+      const uint8_t mask1 = static_cast<uint8_t>(mask >> 8);
+      const uint8_t *row1 =
+          &simdutf::tables::utf16_to_utf8::pack_1_2_3_utf8_bytes[mask1][0];
+      const __m128i shuffle1 = _mm_loadu_si128((__m128i *)(row1 + 1));
+      const __m128i utf8_1 = _mm_shuffle_epi8(out1, shuffle1);
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_0);
+      utf8_output += row0[0];
+      _mm_storeu_si128((__m128i *)utf8_output, utf8_1);
+      utf8_output += row1[0];
+      buf += 8;
+    } else {
+      // case: at least one 32-bit word produce a surrogate pair in UTF-16 <=>
+      // will produce four UTF-8 bytes Let us do a scalar fallback. It may seem
+      // wasteful to use scalar code, but being efficient with SIMD in the
+      // presence of surrogate pairs may require non-trivial tables.
+      size_t forward = 15;
+      size_t k = 0;
+      if (size_t(end - buf) < forward + 1) {
+        forward = size_t(end - buf - 1);
+      }
+      for (; k < forward; k++) {
+        uint32_t word = buf[k];
+        if ((word & 0xFFFFFF80) == 0) {
+          *utf8_output++ = char(word);
+        } else if ((word & 0xFFFFF800) == 0) {
+          *utf8_output++ = char((word >> 6) | 0b11000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        } else if ((word & 0xFFFF0000) == 0) {
+          if (word >= 0xD800 && word <= 0xDFFF) {
+            return std::make_pair(
+                result(error_code::SURROGATE, buf - start + k), utf8_output);
+          }
+          *utf8_output++ = char((word >> 12) | 0b11100000);
+          *utf8_output++ = char(((word >> 6) & 0b111111) | 0b10000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        } else {
+          if (word > 0x10FFFF) {
+            return std::make_pair(
+                result(error_code::TOO_LARGE, buf - start + k), utf8_output);
+          }
+          *utf8_output++ = char((word >> 18) | 0b11110000);
+          *utf8_output++ = char(((word >> 12) & 0b111111) | 0b10000000);
+          *utf8_output++ = char(((word >> 6) & 0b111111) | 0b10000000);
+          *utf8_output++ = char((word & 0b111111) | 0b10000000);
+        }
+      }
+      buf += k;
+    }
+  } // while
+  return std::make_pair(result(error_code::SUCCESS, buf - start), utf8_output);
+}

package/deps/simdutf/src/westmere/sse_convert_utf8_to_latin1.cpp ADDED Viewed

@@ -0,0 +1,58 @@
+// depends on "tables/utf8_to_utf16_tables.h"
+// Convert up to 12 bytes from utf8 to latin1 using a mask indicating the
+// end of the code points. Only the least significant 12 bits of the mask
+// are accessed.
+// It returns how many bytes were consumed (up to 12).
+size_t convert_masked_utf8_to_latin1(const char *input,
+                                     uint64_t utf8_end_of_code_point_mask,
+                                     char *&latin1_output) {
+  // we use an approach where we try to process up to 12 input bytes.
+  // Why 12 input bytes and not 16? Because we are concerned with the size of
+  // the lookup tables. Also 12 is nicely divisible by two and three.
+  //
+  //
+  // Optimization note: our main path below is load-latency dependent. Thus it
+  // is maybe beneficial to have fast paths that depend on branch prediction but
+  // have less latency. This results in more instructions but, potentially, also
+  // higher speeds.
+  //
+  const __m128i in = _mm_loadu_si128((__m128i *)input);
+  const uint16_t input_utf8_end_of_code_point_mask =
+      utf8_end_of_code_point_mask &
+      0xfff; // we are only processing 12 bytes in case it is not all ASCII
+  if (utf8_end_of_code_point_mask == 0xfff) {
+    // We process the data in chunks of 12 bytes.
+    _mm_storeu_si128(reinterpret_cast<__m128i *>(latin1_output), in);
+    latin1_output += 12; // We wrote 12 characters.
+    return 12;           // We consumed 12 bytes.
+  }
+  /// We do not have a fast path available, so we fallback.
+  const uint8_t idx =
+      tables::utf8_to_utf16::utf8bigindex[input_utf8_end_of_code_point_mask][0];
+  const uint8_t consumed =
+      tables::utf8_to_utf16::utf8bigindex[input_utf8_end_of_code_point_mask][1];
+  // this indicates an invalid input:
+  if (idx >= 64) {
+    return consumed;
+  }
+  // Here we should have (idx < 64), if not, there is a bug in the validation or
+  // elsewhere. SIX (6) input code-code units this is a relatively easy scenario
+  // we process SIX (6) input code-code units. The max length in bytes of six
+  // code code units spanning between 1 and 2 bytes each is 12 bytes. On
+  // processors where pdep/pext is fast, we might be able to use a small lookup
+  // table.
+  const __m128i sh =
+      _mm_loadu_si128((const __m128i *)tables::utf8_to_utf16::shufutf8[idx]);
+  const __m128i perm = _mm_shuffle_epi8(in, sh);
+  const __m128i ascii = _mm_and_si128(perm, _mm_set1_epi16(0x7f));
+  const __m128i highbyte = _mm_and_si128(perm, _mm_set1_epi16(0x1f00));
+  __m128i composed = _mm_or_si128(ascii, _mm_srli_epi16(highbyte, 2));
+  const __m128i latin1_packed = _mm_packus_epi16(composed, composed);
+  // writing 8 bytes even though we only care about the first 6 bytes.
+  // performance note: it would be faster to use _mm_storeu_si128, we should
+  // investigate.
+  _mm_storel_epi64((__m128i *)latin1_output, latin1_packed);
+  latin1_output += 6; // We wrote 6 bytes.
+  return consumed;
+}