RubyGems - tomoto - Versions diffs - 0.2.2 → 0.3.0 - Mend

tomoto 0.2.2 → 0.3.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.

Files changed (369) hide show

checksums.yaml +4 -4
data/CHANGELOG.md +10 -0
data/README.md +8 -10
data/ext/tomoto/ct.cpp +11 -11
data/ext/tomoto/dmr.cpp +14 -13
data/ext/tomoto/dt.cpp +14 -14
data/ext/tomoto/extconf.rb +7 -5
data/ext/tomoto/gdmr.cpp +7 -7
data/ext/tomoto/hdp.cpp +9 -9
data/ext/tomoto/hlda.cpp +13 -13
data/ext/tomoto/hpa.cpp +5 -5
data/ext/tomoto/lda.cpp +42 -39
data/ext/tomoto/llda.cpp +6 -6
data/ext/tomoto/mglda.cpp +15 -15
data/ext/tomoto/pa.cpp +6 -6
data/ext/tomoto/plda.cpp +6 -6
data/ext/tomoto/slda.cpp +8 -8
data/ext/tomoto/{ext.cpp → tomoto.cpp} +8 -8
data/ext/tomoto/utils.h +16 -70
data/lib/tomoto/version.rb +1 -1
data/lib/tomoto.rb +5 -1
data/vendor/EigenRand/EigenRand/Core.h +10 -10
data/vendor/EigenRand/EigenRand/Dists/Basic.h +208 -9
data/vendor/EigenRand/EigenRand/Dists/Discrete.h +52 -31
data/vendor/EigenRand/EigenRand/Dists/GammaPoisson.h +9 -8
data/vendor/EigenRand/EigenRand/Dists/NormalExp.h +28 -21
data/vendor/EigenRand/EigenRand/EigenRand +11 -6
data/vendor/EigenRand/EigenRand/Macro.h +13 -7
data/vendor/EigenRand/EigenRand/MorePacketMath.h +348 -740
data/vendor/EigenRand/EigenRand/MvDists/Multinomial.h +5 -3
data/vendor/EigenRand/EigenRand/MvDists/MvNormal.h +9 -3
data/vendor/EigenRand/EigenRand/PacketFilter.h +11 -253
data/vendor/EigenRand/EigenRand/PacketRandomEngine.h +21 -47
data/vendor/EigenRand/EigenRand/RandUtils.h +50 -344
data/vendor/EigenRand/EigenRand/arch/AVX/MorePacketMath.h +619 -0
data/vendor/EigenRand/EigenRand/arch/AVX/PacketFilter.h +149 -0
data/vendor/EigenRand/EigenRand/arch/AVX/RandUtils.h +228 -0
data/vendor/EigenRand/EigenRand/arch/NEON/MorePacketMath.h +473 -0
data/vendor/EigenRand/EigenRand/arch/NEON/PacketFilter.h +142 -0
data/vendor/EigenRand/EigenRand/arch/NEON/RandUtils.h +126 -0
data/vendor/EigenRand/EigenRand/arch/SSE/MorePacketMath.h +501 -0
data/vendor/EigenRand/EigenRand/arch/SSE/PacketFilter.h +133 -0
data/vendor/EigenRand/EigenRand/arch/SSE/RandUtils.h +120 -0
data/vendor/EigenRand/EigenRand/doc.h +24 -12
data/vendor/EigenRand/README.md +57 -4
data/vendor/eigen/COPYING.APACHE +203 -0
data/vendor/eigen/COPYING.BSD +1 -1
data/vendor/eigen/COPYING.MINPACK +51 -52
data/vendor/eigen/Eigen/Cholesky +0 -1
data/vendor/eigen/Eigen/Core +112 -265
data/vendor/eigen/Eigen/Eigenvalues +2 -3
data/vendor/eigen/Eigen/Geometry +5 -8
data/vendor/eigen/Eigen/Householder +0 -1
data/vendor/eigen/Eigen/Jacobi +0 -1
data/vendor/eigen/Eigen/KLUSupport +41 -0
data/vendor/eigen/Eigen/LU +2 -5
data/vendor/eigen/Eigen/OrderingMethods +0 -3
data/vendor/eigen/Eigen/PaStiXSupport +1 -0
data/vendor/eigen/Eigen/PardisoSupport +0 -0
data/vendor/eigen/Eigen/QR +2 -3
data/vendor/eigen/Eigen/QtAlignedMalloc +0 -1
data/vendor/eigen/Eigen/SVD +0 -1
data/vendor/eigen/Eigen/Sparse +0 -2
data/vendor/eigen/Eigen/SparseCholesky +0 -8
data/vendor/eigen/Eigen/SparseLU +4 -0
data/vendor/eigen/Eigen/SparseQR +0 -1
data/vendor/eigen/Eigen/src/Cholesky/LDLT.h +42 -27
data/vendor/eigen/Eigen/src/Cholesky/LLT.h +39 -23
data/vendor/eigen/Eigen/src/CholmodSupport/CholmodSupport.h +90 -47
data/vendor/eigen/Eigen/src/Core/ArithmeticSequence.h +413 -0
data/vendor/eigen/Eigen/src/Core/Array.h +99 -11
data/vendor/eigen/Eigen/src/Core/ArrayBase.h +3 -3
data/vendor/eigen/Eigen/src/Core/ArrayWrapper.h +21 -21
data/vendor/eigen/Eigen/src/Core/Assign.h +1 -1
data/vendor/eigen/Eigen/src/Core/AssignEvaluator.h +125 -50
data/vendor/eigen/Eigen/src/Core/Assign_MKL.h +10 -10
data/vendor/eigen/Eigen/src/Core/BandMatrix.h +16 -16
data/vendor/eigen/Eigen/src/Core/Block.h +56 -60
data/vendor/eigen/Eigen/src/Core/BooleanRedux.h +29 -31
data/vendor/eigen/Eigen/src/Core/CommaInitializer.h +7 -3
data/vendor/eigen/Eigen/src/Core/CoreEvaluators.h +325 -272
data/vendor/eigen/Eigen/src/Core/CoreIterators.h +5 -0
data/vendor/eigen/Eigen/src/Core/CwiseBinaryOp.h +21 -22
data/vendor/eigen/Eigen/src/Core/CwiseNullaryOp.h +153 -18
data/vendor/eigen/Eigen/src/Core/CwiseUnaryOp.h +6 -6
data/vendor/eigen/Eigen/src/Core/CwiseUnaryView.h +14 -10
data/vendor/eigen/Eigen/src/Core/DenseBase.h +132 -42
data/vendor/eigen/Eigen/src/Core/DenseCoeffsBase.h +25 -21
data/vendor/eigen/Eigen/src/Core/DenseStorage.h +153 -71
data/vendor/eigen/Eigen/src/Core/Diagonal.h +21 -23
data/vendor/eigen/Eigen/src/Core/DiagonalMatrix.h +50 -2
data/vendor/eigen/Eigen/src/Core/DiagonalProduct.h +1 -1
data/vendor/eigen/Eigen/src/Core/Dot.h +10 -10
data/vendor/eigen/Eigen/src/Core/EigenBase.h +10 -9
data/vendor/eigen/Eigen/src/Core/ForceAlignedAccess.h +8 -4
data/vendor/eigen/Eigen/src/Core/Fuzzy.h +3 -3
data/vendor/eigen/Eigen/src/Core/GeneralProduct.h +20 -10
data/vendor/eigen/Eigen/src/Core/GenericPacketMath.h +599 -152
data/vendor/eigen/Eigen/src/Core/GlobalFunctions.h +40 -33
data/vendor/eigen/Eigen/src/Core/IO.h +40 -7
data/vendor/eigen/Eigen/src/Core/IndexedView.h +237 -0
data/vendor/eigen/Eigen/src/Core/Inverse.h +9 -10
data/vendor/eigen/Eigen/src/Core/Map.h +7 -7
data/vendor/eigen/Eigen/src/Core/MapBase.h +10 -3
data/vendor/eigen/Eigen/src/Core/MathFunctions.h +767 -125
data/vendor/eigen/Eigen/src/Core/MathFunctionsImpl.h +118 -19
data/vendor/eigen/Eigen/src/Core/Matrix.h +131 -25
data/vendor/eigen/Eigen/src/Core/MatrixBase.h +21 -3
data/vendor/eigen/Eigen/src/Core/NestByValue.h +25 -50
data/vendor/eigen/Eigen/src/Core/NoAlias.h +4 -3
data/vendor/eigen/Eigen/src/Core/NumTraits.h +107 -20
data/vendor/eigen/Eigen/src/Core/PartialReduxEvaluator.h +232 -0
data/vendor/eigen/Eigen/src/Core/PermutationMatrix.h +3 -31
data/vendor/eigen/Eigen/src/Core/PlainObjectBase.h +152 -59
data/vendor/eigen/Eigen/src/Core/Product.h +30 -25
data/vendor/eigen/Eigen/src/Core/ProductEvaluators.h +192 -125
data/vendor/eigen/Eigen/src/Core/Random.h +37 -1
data/vendor/eigen/Eigen/src/Core/Redux.h +180 -170
data/vendor/eigen/Eigen/src/Core/Ref.h +121 -23
data/vendor/eigen/Eigen/src/Core/Replicate.h +8 -8
data/vendor/eigen/Eigen/src/Core/Reshaped.h +454 -0
data/vendor/eigen/Eigen/src/Core/ReturnByValue.h +7 -5
data/vendor/eigen/Eigen/src/Core/Reverse.h +18 -12
data/vendor/eigen/Eigen/src/Core/Select.h +8 -6
data/vendor/eigen/Eigen/src/Core/SelfAdjointView.h +33 -20
data/vendor/eigen/Eigen/src/Core/Solve.h +14 -14
data/vendor/eigen/Eigen/src/Core/SolveTriangular.h +16 -16
data/vendor/eigen/Eigen/src/Core/SolverBase.h +41 -3
data/vendor/eigen/Eigen/src/Core/StableNorm.h +100 -70
data/vendor/eigen/Eigen/src/Core/StlIterators.h +463 -0
data/vendor/eigen/Eigen/src/Core/Stride.h +9 -4
data/vendor/eigen/Eigen/src/Core/Swap.h +5 -4
data/vendor/eigen/Eigen/src/Core/Transpose.h +88 -27
data/vendor/eigen/Eigen/src/Core/Transpositions.h +26 -47
data/vendor/eigen/Eigen/src/Core/TriangularMatrix.h +93 -75
data/vendor/eigen/Eigen/src/Core/VectorBlock.h +5 -5
data/vendor/eigen/Eigen/src/Core/VectorwiseOp.h +159 -70
data/vendor/eigen/Eigen/src/Core/Visitor.h +137 -29
data/vendor/eigen/Eigen/src/Core/arch/AVX/Complex.h +50 -129
data/vendor/eigen/Eigen/src/Core/arch/AVX/MathFunctions.h +126 -337
data/vendor/eigen/Eigen/src/Core/arch/AVX/PacketMath.h +1092 -155
data/vendor/eigen/Eigen/src/Core/arch/AVX/TypeCasting.h +65 -1
data/vendor/eigen/Eigen/src/Core/arch/AVX512/Complex.h +422 -0
data/vendor/eigen/Eigen/src/Core/arch/AVX512/MathFunctions.h +207 -236
data/vendor/eigen/Eigen/src/Core/arch/AVX512/PacketMath.h +1482 -495
data/vendor/eigen/Eigen/src/Core/arch/AVX512/TypeCasting.h +89 -0
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/Complex.h +152 -165
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/MathFunctions.h +19 -251
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/MatrixProduct.h +2937 -0
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/MatrixProductCommon.h +221 -0
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/MatrixProductMMA.h +629 -0
data/vendor/eigen/Eigen/src/Core/arch/AltiVec/PacketMath.h +2042 -392
data/vendor/eigen/Eigen/src/Core/arch/CUDA/Complex.h +235 -80
data/vendor/eigen/Eigen/src/Core/arch/Default/BFloat16.h +700 -0
data/vendor/eigen/Eigen/src/Core/arch/Default/ConjHelper.h +102 -14
data/vendor/eigen/Eigen/src/Core/arch/Default/GenericPacketMathFunctions.h +1649 -0
data/vendor/eigen/Eigen/src/Core/arch/Default/GenericPacketMathFunctionsFwd.h +110 -0
data/vendor/eigen/Eigen/src/Core/arch/Default/Half.h +942 -0
data/vendor/eigen/Eigen/src/Core/arch/Default/Settings.h +1 -1
data/vendor/eigen/Eigen/src/Core/arch/Default/TypeCasting.h +120 -0
data/vendor/eigen/Eigen/src/Core/arch/{CUDA → GPU}/MathFunctions.h +16 -4
data/vendor/eigen/Eigen/src/Core/arch/GPU/PacketMath.h +1685 -0
data/vendor/eigen/Eigen/src/Core/arch/GPU/TypeCasting.h +80 -0
data/vendor/eigen/Eigen/src/Core/arch/HIP/hcc/math_constants.h +23 -0
data/vendor/eigen/Eigen/src/Core/arch/MSA/Complex.h +648 -0
data/vendor/eigen/Eigen/src/Core/arch/MSA/MathFunctions.h +387 -0
data/vendor/eigen/Eigen/src/Core/arch/MSA/PacketMath.h +1233 -0
data/vendor/eigen/Eigen/src/Core/arch/NEON/Complex.h +313 -219
data/vendor/eigen/Eigen/src/Core/arch/NEON/GeneralBlockPanelKernel.h +183 -0
data/vendor/eigen/Eigen/src/Core/arch/NEON/MathFunctions.h +54 -70
data/vendor/eigen/Eigen/src/Core/arch/NEON/PacketMath.h +4376 -549
data/vendor/eigen/Eigen/src/Core/arch/NEON/TypeCasting.h +1419 -0
data/vendor/eigen/Eigen/src/Core/arch/SSE/Complex.h +59 -179
data/vendor/eigen/Eigen/src/Core/arch/SSE/MathFunctions.h +65 -428
data/vendor/eigen/Eigen/src/Core/arch/SSE/PacketMath.h +893 -283
data/vendor/eigen/Eigen/src/Core/arch/SSE/TypeCasting.h +65 -0
data/vendor/eigen/Eigen/src/Core/arch/SVE/MathFunctions.h +44 -0
data/vendor/eigen/Eigen/src/Core/arch/SVE/PacketMath.h +752 -0
data/vendor/eigen/Eigen/src/Core/arch/SVE/TypeCasting.h +49 -0
data/vendor/eigen/Eigen/src/Core/arch/SYCL/InteropHeaders.h +232 -0
data/vendor/eigen/Eigen/src/Core/arch/SYCL/MathFunctions.h +301 -0
data/vendor/eigen/Eigen/src/Core/arch/SYCL/PacketMath.h +670 -0
data/vendor/eigen/Eigen/src/Core/arch/SYCL/SyclMemoryModel.h +694 -0
data/vendor/eigen/Eigen/src/Core/arch/SYCL/TypeCasting.h +85 -0
data/vendor/eigen/Eigen/src/Core/arch/ZVector/Complex.h +212 -183
data/vendor/eigen/Eigen/src/Core/arch/ZVector/MathFunctions.h +101 -5
data/vendor/eigen/Eigen/src/Core/arch/ZVector/PacketMath.h +510 -395
data/vendor/eigen/Eigen/src/Core/functors/AssignmentFunctors.h +11 -2
data/vendor/eigen/Eigen/src/Core/functors/BinaryFunctors.h +112 -46
data/vendor/eigen/Eigen/src/Core/functors/NullaryFunctors.h +31 -30
data/vendor/eigen/Eigen/src/Core/functors/StlFunctors.h +32 -2
data/vendor/eigen/Eigen/src/Core/functors/UnaryFunctors.h +355 -16
data/vendor/eigen/Eigen/src/Core/products/GeneralBlockPanelKernel.h +1075 -586
data/vendor/eigen/Eigen/src/Core/products/GeneralMatrixMatrix.h +49 -24
data/vendor/eigen/Eigen/src/Core/products/GeneralMatrixMatrixTriangular.h +41 -35
data/vendor/eigen/Eigen/src/Core/products/GeneralMatrixMatrixTriangular_BLAS.h +6 -6
data/vendor/eigen/Eigen/src/Core/products/GeneralMatrixMatrix_BLAS.h +4 -2
data/vendor/eigen/Eigen/src/Core/products/GeneralMatrixVector.h +382 -483
data/vendor/eigen/Eigen/src/Core/products/Parallelizer.h +22 -5
data/vendor/eigen/Eigen/src/Core/products/SelfadjointMatrixMatrix.h +53 -30
data/vendor/eigen/Eigen/src/Core/products/SelfadjointMatrixMatrix_BLAS.h +16 -8
data/vendor/eigen/Eigen/src/Core/products/SelfadjointMatrixVector.h +8 -6
data/vendor/eigen/Eigen/src/Core/products/SelfadjointProduct.h +4 -4
data/vendor/eigen/Eigen/src/Core/products/SelfadjointRank2Update.h +5 -4
data/vendor/eigen/Eigen/src/Core/products/TriangularMatrixMatrix.h +33 -27
data/vendor/eigen/Eigen/src/Core/products/TriangularMatrixMatrix_BLAS.h +14 -12
data/vendor/eigen/Eigen/src/Core/products/TriangularSolverMatrix.h +36 -34
data/vendor/eigen/Eigen/src/Core/products/TriangularSolverMatrix_BLAS.h +8 -4
data/vendor/eigen/Eigen/src/Core/products/TriangularSolverVector.h +13 -10
data/vendor/eigen/Eigen/src/Core/util/BlasUtil.h +304 -119
data/vendor/eigen/Eigen/src/Core/util/ConfigureVectorization.h +512 -0
data/vendor/eigen/Eigen/src/Core/util/Constants.h +25 -9
data/vendor/eigen/Eigen/src/Core/util/DisableStupidWarnings.h +26 -3
data/vendor/eigen/Eigen/src/Core/util/ForwardDeclarations.h +29 -9
data/vendor/eigen/Eigen/src/Core/util/IndexedViewHelper.h +186 -0
data/vendor/eigen/Eigen/src/Core/util/IntegralConstant.h +272 -0
data/vendor/eigen/Eigen/src/Core/util/MKL_support.h +8 -1
data/vendor/eigen/Eigen/src/Core/util/Macros.h +709 -246
data/vendor/eigen/Eigen/src/Core/util/Memory.h +222 -52
data/vendor/eigen/Eigen/src/Core/util/Meta.h +355 -77
data/vendor/eigen/Eigen/src/Core/util/ReenableStupidWarnings.h +5 -1
data/vendor/eigen/Eigen/src/Core/util/ReshapedHelper.h +51 -0
data/vendor/eigen/Eigen/src/Core/util/StaticAssert.h +8 -5
data/vendor/eigen/Eigen/src/Core/util/SymbolicIndex.h +293 -0
data/vendor/eigen/Eigen/src/Core/util/XprHelper.h +65 -30
data/vendor/eigen/Eigen/src/Eigenvalues/ComplexEigenSolver.h +1 -1
data/vendor/eigen/Eigen/src/Eigenvalues/ComplexSchur.h +7 -4
data/vendor/eigen/Eigen/src/Eigenvalues/EigenSolver.h +2 -2
data/vendor/eigen/Eigen/src/Eigenvalues/GeneralizedSelfAdjointEigenSolver.h +1 -1
data/vendor/eigen/Eigen/src/Eigenvalues/HessenbergDecomposition.h +2 -2
data/vendor/eigen/Eigen/src/Eigenvalues/MatrixBaseEigenvalues.h +2 -2
data/vendor/eigen/Eigen/src/Eigenvalues/RealQZ.h +9 -6
data/vendor/eigen/Eigen/src/Eigenvalues/RealSchur.h +21 -9
data/vendor/eigen/Eigen/src/Eigenvalues/SelfAdjointEigenSolver.h +77 -43
data/vendor/eigen/Eigen/src/Eigenvalues/Tridiagonalization.h +20 -15
data/vendor/eigen/Eigen/src/Geometry/AlignedBox.h +99 -5
data/vendor/eigen/Eigen/src/Geometry/AngleAxis.h +4 -4
data/vendor/eigen/Eigen/src/Geometry/EulerAngles.h +3 -3
data/vendor/eigen/Eigen/src/Geometry/Homogeneous.h +15 -11
data/vendor/eigen/Eigen/src/Geometry/Hyperplane.h +1 -1
data/vendor/eigen/Eigen/src/Geometry/OrthoMethods.h +3 -2
data/vendor/eigen/Eigen/src/Geometry/ParametrizedLine.h +39 -2
data/vendor/eigen/Eigen/src/Geometry/Quaternion.h +70 -14
data/vendor/eigen/Eigen/src/Geometry/Rotation2D.h +3 -3
data/vendor/eigen/Eigen/src/Geometry/Scaling.h +23 -5
data/vendor/eigen/Eigen/src/Geometry/Transform.h +88 -67
data/vendor/eigen/Eigen/src/Geometry/Translation.h +6 -12
data/vendor/eigen/Eigen/src/Geometry/Umeyama.h +1 -1
data/vendor/eigen/Eigen/src/Geometry/arch/Geometry_SIMD.h +168 -0
data/vendor/eigen/Eigen/src/Householder/BlockHouseholder.h +9 -2
data/vendor/eigen/Eigen/src/Householder/Householder.h +8 -4
data/vendor/eigen/Eigen/src/Householder/HouseholderSequence.h +123 -48
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/BasicPreconditioners.h +15 -15
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/BiCGSTAB.h +7 -23
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/ConjugateGradient.h +5 -22
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/IncompleteCholesky.h +41 -47
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/IncompleteLUT.h +51 -60
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/IterativeSolverBase.h +70 -20
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/LeastSquareConjugateGradient.h +2 -20
data/vendor/eigen/Eigen/src/IterativeLinearSolvers/SolveWithGuess.h +11 -9
data/vendor/eigen/Eigen/src/Jacobi/Jacobi.h +31 -10
data/vendor/eigen/Eigen/src/KLUSupport/KLUSupport.h +358 -0
data/vendor/eigen/Eigen/src/LU/Determinant.h +35 -19
data/vendor/eigen/Eigen/src/LU/FullPivLU.h +29 -43
data/vendor/eigen/Eigen/src/LU/InverseImpl.h +25 -8
data/vendor/eigen/Eigen/src/LU/PartialPivLU.h +71 -58
data/vendor/eigen/Eigen/src/LU/arch/InverseSize4.h +351 -0
data/vendor/eigen/Eigen/src/OrderingMethods/Amd.h +7 -17
data/vendor/eigen/Eigen/src/OrderingMethods/Eigen_Colamd.h +297 -277
data/vendor/eigen/Eigen/src/OrderingMethods/Ordering.h +6 -10
data/vendor/eigen/Eigen/src/PaStiXSupport/PaStiXSupport.h +1 -1
data/vendor/eigen/Eigen/src/PardisoSupport/PardisoSupport.h +9 -7
data/vendor/eigen/Eigen/src/QR/ColPivHouseholderQR.h +41 -20
data/vendor/eigen/Eigen/src/QR/CompleteOrthogonalDecomposition.h +100 -27
data/vendor/eigen/Eigen/src/QR/FullPivHouseholderQR.h +59 -22
data/vendor/eigen/Eigen/src/QR/HouseholderQR.h +48 -23
data/vendor/eigen/Eigen/src/SPQRSupport/SuiteSparseQRSupport.h +25 -3
data/vendor/eigen/Eigen/src/SVD/BDCSVD.h +183 -63
data/vendor/eigen/Eigen/src/SVD/JacobiSVD.h +22 -14
data/vendor/eigen/Eigen/src/SVD/SVDBase.h +83 -22
data/vendor/eigen/Eigen/src/SVD/UpperBidiagonalization.h +3 -3
data/vendor/eigen/Eigen/src/SparseCholesky/SimplicialCholesky.h +17 -9
data/vendor/eigen/Eigen/src/SparseCholesky/SimplicialCholesky_impl.h +12 -37
data/vendor/eigen/Eigen/src/SparseCore/AmbiVector.h +3 -2
data/vendor/eigen/Eigen/src/SparseCore/CompressedStorage.h +16 -0
data/vendor/eigen/Eigen/src/SparseCore/ConservativeSparseSparseProduct.h +6 -6
data/vendor/eigen/Eigen/src/SparseCore/SparseAssign.h +81 -27
data/vendor/eigen/Eigen/src/SparseCore/SparseBlock.h +25 -57
data/vendor/eigen/Eigen/src/SparseCore/SparseCompressedBase.h +40 -11
data/vendor/eigen/Eigen/src/SparseCore/SparseCwiseBinaryOp.h +11 -15
data/vendor/eigen/Eigen/src/SparseCore/SparseCwiseUnaryOp.h +4 -2
data/vendor/eigen/Eigen/src/SparseCore/SparseDenseProduct.h +30 -8
data/vendor/eigen/Eigen/src/SparseCore/SparseMatrix.h +126 -11
data/vendor/eigen/Eigen/src/SparseCore/SparseMatrixBase.h +5 -12
data/vendor/eigen/Eigen/src/SparseCore/SparseProduct.h +13 -1
data/vendor/eigen/Eigen/src/SparseCore/SparseRef.h +7 -7
data/vendor/eigen/Eigen/src/SparseCore/SparseSelfAdjointView.h +5 -2
data/vendor/eigen/Eigen/src/SparseCore/SparseUtil.h +8 -0
data/vendor/eigen/Eigen/src/SparseCore/SparseVector.h +1 -1
data/vendor/eigen/Eigen/src/SparseCore/SparseView.h +1 -0
data/vendor/eigen/Eigen/src/SparseLU/SparseLU.h +162 -12
data/vendor/eigen/Eigen/src/SparseLU/SparseLU_Memory.h +1 -1
data/vendor/eigen/Eigen/src/SparseLU/SparseLU_SupernodalMatrix.h +76 -2
data/vendor/eigen/Eigen/src/SparseLU/SparseLU_column_dfs.h +2 -2
data/vendor/eigen/Eigen/src/SparseLU/SparseLU_gemm_kernel.h +1 -1
data/vendor/eigen/Eigen/src/SparseLU/SparseLU_panel_bmod.h +1 -1
data/vendor/eigen/Eigen/src/SparseQR/SparseQR.h +19 -6
data/vendor/eigen/Eigen/src/StlSupport/StdDeque.h +2 -12
data/vendor/eigen/Eigen/src/StlSupport/StdList.h +2 -2
data/vendor/eigen/Eigen/src/StlSupport/StdVector.h +2 -2
data/vendor/eigen/Eigen/src/SuperLUSupport/SuperLUSupport.h +6 -8
data/vendor/eigen/Eigen/src/UmfPackSupport/UmfPackSupport.h +175 -39
data/vendor/eigen/Eigen/src/misc/lapacke.h +5 -4
data/vendor/eigen/Eigen/src/plugins/ArrayCwiseBinaryOps.h +28 -2
data/vendor/eigen/Eigen/src/plugins/ArrayCwiseUnaryOps.h +155 -11
data/vendor/eigen/Eigen/src/plugins/BlockMethods.h +626 -242
data/vendor/eigen/Eigen/src/plugins/CommonCwiseUnaryOps.h +14 -0
data/vendor/eigen/Eigen/src/plugins/IndexedViewMethods.h +262 -0
data/vendor/eigen/Eigen/src/plugins/MatrixCwiseBinaryOps.h +4 -4
data/vendor/eigen/Eigen/src/plugins/MatrixCwiseUnaryOps.h +10 -0
data/vendor/eigen/Eigen/src/plugins/ReshapedMethods.h +149 -0
data/vendor/eigen/README.md +2 -0
data/vendor/eigen/bench/btl/README +1 -1
data/vendor/eigen/bench/tensors/README +6 -7
data/vendor/eigen/ci/README.md +56 -0
data/vendor/eigen/demos/mix_eigen_and_c/README +1 -1
data/vendor/eigen/unsupported/Eigen/CXX11/src/Tensor/README.md +213 -158
data/vendor/eigen/unsupported/README.txt +1 -1
data/vendor/tomotopy/README.kr.rst +78 -0
data/vendor/tomotopy/README.rst +75 -0
data/vendor/tomotopy/src/Labeling/FoRelevance.cpp +2 -2
data/vendor/tomotopy/src/Labeling/Phraser.hpp +4 -4
data/vendor/tomotopy/src/TopicModel/CTModel.hpp +7 -3
data/vendor/tomotopy/src/TopicModel/DMRModel.hpp +7 -3
data/vendor/tomotopy/src/TopicModel/DTModel.hpp +6 -3
data/vendor/tomotopy/src/TopicModel/GDMRModel.hpp +2 -2
data/vendor/tomotopy/src/TopicModel/HDP.h +1 -0
data/vendor/tomotopy/src/TopicModel/HDPModel.hpp +57 -6
data/vendor/tomotopy/src/TopicModel/HLDAModel.hpp +6 -3
data/vendor/tomotopy/src/TopicModel/HPAModel.hpp +3 -2
data/vendor/tomotopy/src/TopicModel/LDA.h +3 -3
data/vendor/tomotopy/src/TopicModel/LDACVB0Model.hpp +5 -5
data/vendor/tomotopy/src/TopicModel/LDAModel.hpp +50 -19
data/vendor/tomotopy/src/TopicModel/LLDAModel.hpp +6 -2
data/vendor/tomotopy/src/TopicModel/MGLDAModel.hpp +3 -2
data/vendor/tomotopy/src/TopicModel/PAModel.hpp +1 -1
data/vendor/tomotopy/src/TopicModel/PLDAModel.hpp +6 -2
data/vendor/tomotopy/src/TopicModel/PT.h +3 -1
data/vendor/tomotopy/src/TopicModel/PTModel.hpp +36 -3
data/vendor/tomotopy/src/TopicModel/SLDAModel.hpp +6 -3
data/vendor/tomotopy/src/TopicModel/TopicModel.hpp +55 -26
data/vendor/tomotopy/src/Utils/AliasMethod.hpp +5 -4
data/vendor/tomotopy/src/Utils/Dictionary.h +2 -2
data/vendor/tomotopy/src/Utils/EigenAddonOps.hpp +36 -1
data/vendor/tomotopy/src/Utils/MultiNormalDistribution.hpp +1 -1
data/vendor/tomotopy/src/Utils/TruncMultiNormal.hpp +1 -1
data/vendor/tomotopy/src/Utils/exception.h +6 -0
data/vendor/tomotopy/src/Utils/math.h +2 -2
data/vendor/tomotopy/src/Utils/sample.hpp +14 -12
data/vendor/tomotopy/src/Utils/serializer.hpp +30 -5
data/vendor/tomotopy/src/Utils/sse_gamma.h +0 -3
metadata +64 -18
data/vendor/eigen/Eigen/CMakeLists.txt +0 -19
data/vendor/eigen/Eigen/src/Core/arch/CUDA/Half.h +0 -674
data/vendor/eigen/Eigen/src/Core/arch/CUDA/PacketMath.h +0 -333
data/vendor/eigen/Eigen/src/Core/arch/CUDA/PacketMathHalf.h +0 -1124
data/vendor/eigen/Eigen/src/Core/arch/CUDA/TypeCasting.h +0 -212
data/vendor/eigen/Eigen/src/Geometry/arch/Geometry_SSE.h +0 -161
data/vendor/eigen/Eigen/src/LU/arch/Inverse_SSE.h +0 -338

data/vendor/eigen/Eigen/src/Core/arch/SVE/PacketMath.h ADDED Viewed

@@ -0,0 +1,752 @@
+// This file is part of Eigen, a lightweight C++ template library
+// for linear algebra.
+//
+// Copyright (C) 2020, Arm Limited and Contributors
+//
+// This Source Code Form is subject to the terms of the Mozilla
+// Public License v. 2.0. If a copy of the MPL was not distributed
+// with this file, You can obtain one at http://mozilla.org/MPL/2.0/.
+#ifndef EIGEN_PACKET_MATH_SVE_H
+#define EIGEN_PACKET_MATH_SVE_H
+namespace Eigen
+{
+namespace internal
+{
+#ifndef EIGEN_CACHEFRIENDLY_PRODUCT_THRESHOLD
+#define EIGEN_CACHEFRIENDLY_PRODUCT_THRESHOLD 8
+#endif
+#ifndef EIGEN_HAS_SINGLE_INSTRUCTION_MADD
+#define EIGEN_HAS_SINGLE_INSTRUCTION_MADD
+#endif
+#define EIGEN_ARCH_DEFAULT_NUMBER_OF_REGISTERS 32
+template <typename Scalar, int SVEVectorLength>
+struct sve_packet_size_selector {
+  enum { size = SVEVectorLength / (sizeof(Scalar) * CHAR_BIT) };
+};
+/********************************* int32 **************************************/
+typedef svint32_t PacketXi __attribute__((arm_sve_vector_bits(EIGEN_ARM64_SVE_VL)));
+template <>
+struct packet_traits<numext::int32_t> : default_packet_traits {
+  typedef PacketXi type;
+  typedef PacketXi half;  // Half not implemented yet
+  enum {
+    Vectorizable = 1,
+    AlignedOnScalar = 1,
+    size = sve_packet_size_selector<numext::int32_t, EIGEN_ARM64_SVE_VL>::size,
+    HasHalfPacket = 0,
+    HasAdd = 1,
+    HasSub = 1,
+    HasShift = 1,
+    HasMul = 1,
+    HasNegate = 1,
+    HasAbs = 1,
+    HasArg = 0,
+    HasAbs2 = 1,
+    HasMin = 1,
+    HasMax = 1,
+    HasConj = 1,
+    HasSetLinear = 0,
+    HasBlend = 0,
+    HasReduxp = 0  // Not implemented in SVE
+  };
+};
+template <>
+struct unpacket_traits<PacketXi> {
+  typedef numext::int32_t type;
+  typedef PacketXi half;  // Half not yet implemented
+  enum {
+    size = sve_packet_size_selector<numext::int32_t, EIGEN_ARM64_SVE_VL>::size,
+    alignment = Aligned64,
+    vectorizable = true,
+    masked_load_available = false,
+    masked_store_available = false
+  };
+};
+template <>
+EIGEN_STRONG_INLINE void prefetch<numext::int32_t>(const numext::int32_t* addr)
+{
+  svprfw(svptrue_b32(), addr, SV_PLDL1KEEP);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pset1<PacketXi>(const numext::int32_t& from)
+{
+  return svdup_n_s32(from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi plset<PacketXi>(const numext::int32_t& a)
+{
+  numext::int32_t c[packet_traits<numext::int32_t>::size];
+  for (int i = 0; i < packet_traits<numext::int32_t>::size; i++) c[i] = i;
+  return svadd_s32_z(svptrue_b32(), pset1<PacketXi>(a), svld1_s32(svptrue_b32(), c));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi padd<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svadd_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi psub<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svsub_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pnegate(const PacketXi& a)
+{
+  return svneg_s32_z(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pconj(const PacketXi& a)
+{
+  return a;
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pmul<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svmul_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pdiv<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svdiv_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pmadd(const PacketXi& a, const PacketXi& b, const PacketXi& c)
+{
+  return svmla_s32_z(svptrue_b32(), c, a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pmin<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svmin_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pmax<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svmax_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pcmp_le<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svdup_n_s32_z(svcmplt_s32(svptrue_b32(), a, b), 0xffffffffu);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pcmp_lt<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svdup_n_s32_z(svcmplt_s32(svptrue_b32(), a, b), 0xffffffffu);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pcmp_eq<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svdup_n_s32_z(svcmpeq_s32(svptrue_b32(), a, b), 0xffffffffu);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi ptrue<PacketXi>(const PacketXi& /*a*/)
+{
+  return svdup_n_s32_z(svptrue_b32(), 0xffffffffu);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pzero<PacketXi>(const PacketXi& /*a*/)
+{
+  return svdup_n_s32_z(svptrue_b32(), 0);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pand<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svand_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi por<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svorr_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pxor<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return sveor_s32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pandnot<PacketXi>(const PacketXi& a, const PacketXi& b)
+{
+  return svbic_s32_z(svptrue_b32(), a, b);
+}
+template <int N>
+EIGEN_STRONG_INLINE PacketXi parithmetic_shift_right(PacketXi a)
+{
+  return svasrd_n_s32_z(svptrue_b32(), a, N);
+}
+template <int N>
+EIGEN_STRONG_INLINE PacketXi plogical_shift_right(PacketXi a)
+{
+  return svreinterpret_s32_u32(svlsr_u32_z(svptrue_b32(), svreinterpret_u32_s32(a), svdup_n_u32_z(svptrue_b32(), N)));
+}
+template <int N>
+EIGEN_STRONG_INLINE PacketXi plogical_shift_left(PacketXi a)
+{
+  return svlsl_s32_z(svptrue_b32(), a, svdup_n_u32_z(svptrue_b32(), N));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pload<PacketXi>(const numext::int32_t* from)
+{
+  EIGEN_DEBUG_ALIGNED_LOAD return svld1_s32(svptrue_b32(), from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi ploadu<PacketXi>(const numext::int32_t* from)
+{
+  EIGEN_DEBUG_UNALIGNED_LOAD return svld1_s32(svptrue_b32(), from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi ploaddup<PacketXi>(const numext::int32_t* from)
+{
+  svuint32_t indices = svindex_u32(0, 1);  // index {base=0, base+step=1, base+step*2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a1, a1, a2, a2, ...}
+  return svld1_gather_u32index_s32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi ploadquad<PacketXi>(const numext::int32_t* from)
+{
+  svuint32_t indices = svindex_u32(0, 1);  // index {base=0, base+step=1, base+step*2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a1, a1, a2, a2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a0, a0, a1, a1, a1, a1, ...}
+  return svld1_gather_u32index_s32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_STRONG_INLINE void pstore<numext::int32_t>(numext::int32_t* to, const PacketXi& from)
+{
+  EIGEN_DEBUG_ALIGNED_STORE svst1_s32(svptrue_b32(), to, from);
+}
+template <>
+EIGEN_STRONG_INLINE void pstoreu<numext::int32_t>(numext::int32_t* to, const PacketXi& from)
+{
+  EIGEN_DEBUG_UNALIGNED_STORE svst1_s32(svptrue_b32(), to, from);
+}
+template <>
+EIGEN_DEVICE_FUNC inline PacketXi pgather<numext::int32_t, PacketXi>(const numext::int32_t* from, Index stride)
+{
+  // Indice format: {base=0, base+stride, base+stride*2, base+stride*3, ...}
+  svint32_t indices = svindex_s32(0, stride);
+  return svld1_gather_s32index_s32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_DEVICE_FUNC inline void pscatter<numext::int32_t, PacketXi>(numext::int32_t* to, const PacketXi& from, Index stride)
+{
+  // Indice format: {base=0, base+stride, base+stride*2, base+stride*3, ...}
+  svint32_t indices = svindex_s32(0, stride);
+  svst1_scatter_s32index_s32(svptrue_b32(), to, indices, from);
+}
+template <>
+EIGEN_STRONG_INLINE numext::int32_t pfirst<PacketXi>(const PacketXi& a)
+{
+  // svlasta returns the first element if all predicate bits are 0
+  return svlasta_s32(svpfalse_b(), a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi preverse(const PacketXi& a)
+{
+  return svrev_s32(a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXi pabs(const PacketXi& a)
+{
+  return svabs_s32_z(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE numext::int32_t predux<PacketXi>(const PacketXi& a)
+{
+  return static_cast<numext::int32_t>(svaddv_s32(svptrue_b32(), a));
+}
+template <>
+EIGEN_STRONG_INLINE numext::int32_t predux_mul<PacketXi>(const PacketXi& a)
+{
+  EIGEN_STATIC_ASSERT((EIGEN_ARM64_SVE_VL % 128 == 0),
+                      EIGEN_INTERNAL_ERROR_PLEASE_FILE_A_BUG_REPORT);
+  // Multiply the vector by its reverse
+  svint32_t prod = svmul_s32_z(svptrue_b32(), a, svrev_s32(a));
+  svint32_t half_prod;
+  // Extract the high half of the vector. Depending on the VL more reductions need to be done
+  if (EIGEN_ARM64_SVE_VL >= 2048) {
+    half_prod = svtbl_s32(prod, svindex_u32(32, 1));
+    prod = svmul_s32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 1024) {
+    half_prod = svtbl_s32(prod, svindex_u32(16, 1));
+    prod = svmul_s32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 512) {
+    half_prod = svtbl_s32(prod, svindex_u32(8, 1));
+    prod = svmul_s32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 256) {
+    half_prod = svtbl_s32(prod, svindex_u32(4, 1));
+    prod = svmul_s32_z(svptrue_b32(), prod, half_prod);
+  }
+  // Last reduction
+  half_prod = svtbl_s32(prod, svindex_u32(2, 1));
+  prod = svmul_s32_z(svptrue_b32(), prod, half_prod);
+  // The reduction is done to the first element.
+  return pfirst<PacketXi>(prod);
+}
+template <>
+EIGEN_STRONG_INLINE numext::int32_t predux_min<PacketXi>(const PacketXi& a)
+{
+  return svminv_s32(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE numext::int32_t predux_max<PacketXi>(const PacketXi& a)
+{
+  return svmaxv_s32(svptrue_b32(), a);
+}
+template <int N>
+EIGEN_DEVICE_FUNC inline void ptranspose(PacketBlock<PacketXi, N>& kernel) {
+  int buffer[packet_traits<numext::int32_t>::size * N] = {0};
+  int i = 0;
+  PacketXi stride_index = svindex_s32(0, N);
+  for (i = 0; i < N; i++) {
+    svst1_scatter_s32index_s32(svptrue_b32(), buffer + i, stride_index, kernel.packet[i]);
+  }
+  for (i = 0; i < N; i++) {
+    kernel.packet[i] = svld1_s32(svptrue_b32(), buffer + i * packet_traits<numext::int32_t>::size);
+  }
+}
+/********************************* float32 ************************************/
+typedef svfloat32_t PacketXf __attribute__((arm_sve_vector_bits(EIGEN_ARM64_SVE_VL)));
+template <>
+struct packet_traits<float> : default_packet_traits {
+  typedef PacketXf type;
+  typedef PacketXf half;
+  enum {
+    Vectorizable = 1,
+    AlignedOnScalar = 1,
+    size = sve_packet_size_selector<float, EIGEN_ARM64_SVE_VL>::size,
+    HasHalfPacket = 0,
+    HasAdd = 1,
+    HasSub = 1,
+    HasShift = 1,
+    HasMul = 1,
+    HasNegate = 1,
+    HasAbs = 1,
+    HasArg = 0,
+    HasAbs2 = 1,
+    HasMin = 1,
+    HasMax = 1,
+    HasConj = 1,
+    HasSetLinear = 0,
+    HasBlend = 0,
+    HasReduxp = 0,  // Not implemented in SVE
+    HasDiv = 1,
+    HasFloor = 1,
+    HasSin = EIGEN_FAST_MATH,
+    HasCos = EIGEN_FAST_MATH,
+    HasLog = 1,
+    HasExp = 1,
+    HasSqrt = 0,
+    HasTanh = EIGEN_FAST_MATH,
+    HasErf = EIGEN_FAST_MATH
+  };
+};
+template <>
+struct unpacket_traits<PacketXf> {
+  typedef float type;
+  typedef PacketXf half;  // Half not yet implemented
+  typedef PacketXi integer_packet;
+  enum {
+    size = sve_packet_size_selector<float, EIGEN_ARM64_SVE_VL>::size,
+    alignment = Aligned64,
+    vectorizable = true,
+    masked_load_available = false,
+    masked_store_available = false
+  };
+};
+template <>
+EIGEN_STRONG_INLINE PacketXf pset1<PacketXf>(const float& from)
+{
+  return svdup_n_f32(from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pset1frombits<PacketXf>(numext::uint32_t from)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svptrue_b32(), from));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf plset<PacketXf>(const float& a)
+{
+  float c[packet_traits<float>::size];
+  for (int i = 0; i < packet_traits<float>::size; i++) c[i] = i;
+  return svadd_f32_z(svptrue_b32(), pset1<PacketXf>(a), svld1_f32(svptrue_b32(), c));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf padd<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svadd_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf psub<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svsub_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pnegate(const PacketXf& a)
+{
+  return svneg_f32_z(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pconj(const PacketXf& a)
+{
+  return a;
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmul<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svmul_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pdiv<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svdiv_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmadd(const PacketXf& a, const PacketXf& b, const PacketXf& c)
+{
+  return svmla_f32_z(svptrue_b32(), c, a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmin<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svmin_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmin<PropagateNaN, PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return pmin<PacketXf>(a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmin<PropagateNumbers, PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svminnm_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmax<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svmax_f32_z(svptrue_b32(), a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmax<PropagateNaN, PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return pmax<PacketXf>(a, b);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pmax<PropagateNumbers, PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svmaxnm_f32_z(svptrue_b32(), a, b);
+}
+// Float comparisons in SVE return svbool (predicate). Use svdup to set active
+// lanes to 1 (0xffffffffu) and inactive lanes to 0.
+template <>
+EIGEN_STRONG_INLINE PacketXf pcmp_le<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svcmplt_f32(svptrue_b32(), a, b), 0xffffffffu));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pcmp_lt<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svcmplt_f32(svptrue_b32(), a, b), 0xffffffffu));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pcmp_eq<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svcmpeq_f32(svptrue_b32(), a, b), 0xffffffffu));
+}
+// Do a predicate inverse (svnot_b_z) on the predicate resulted from the
+// greater/equal comparison (svcmpge_f32). Then fill a float vector with the
+// active elements.
+template <>
+EIGEN_STRONG_INLINE PacketXf pcmp_lt_or_nan<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svnot_b_z(svptrue_b32(), svcmpge_f32(svptrue_b32(), a, b)), 0xffffffffu));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pfloor<PacketXf>(const PacketXf& a)
+{
+  return svrintm_f32_z(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf ptrue<PacketXf>(const PacketXf& /*a*/)
+{
+  return svreinterpret_f32_u32(svdup_n_u32_z(svptrue_b32(), 0xffffffffu));
+}
+// Logical Operations are not supported for float, so reinterpret casts
+template <>
+EIGEN_STRONG_INLINE PacketXf pand<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svand_u32_z(svptrue_b32(), svreinterpret_u32_f32(a), svreinterpret_u32_f32(b)));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf por<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svorr_u32_z(svptrue_b32(), svreinterpret_u32_f32(a), svreinterpret_u32_f32(b)));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pxor<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(sveor_u32_z(svptrue_b32(), svreinterpret_u32_f32(a), svreinterpret_u32_f32(b)));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pandnot<PacketXf>(const PacketXf& a, const PacketXf& b)
+{
+  return svreinterpret_f32_u32(svbic_u32_z(svptrue_b32(), svreinterpret_u32_f32(a), svreinterpret_u32_f32(b)));
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pload<PacketXf>(const float* from)
+{
+  EIGEN_DEBUG_ALIGNED_LOAD return svld1_f32(svptrue_b32(), from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf ploadu<PacketXf>(const float* from)
+{
+  EIGEN_DEBUG_UNALIGNED_LOAD return svld1_f32(svptrue_b32(), from);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf ploaddup<PacketXf>(const float* from)
+{
+  svuint32_t indices = svindex_u32(0, 1);  // index {base=0, base+step=1, base+step*2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a1, a1, a2, a2, ...}
+  return svld1_gather_u32index_f32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf ploadquad<PacketXf>(const float* from)
+{
+  svuint32_t indices = svindex_u32(0, 1);  // index {base=0, base+step=1, base+step*2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a1, a1, a2, a2, ...}
+  indices = svzip1_u32(indices, indices);  // index in the format {a0, a0, a0, a0, a1, a1, a1, a1, ...}
+  return svld1_gather_u32index_f32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_STRONG_INLINE void pstore<float>(float* to, const PacketXf& from)
+{
+  EIGEN_DEBUG_ALIGNED_STORE svst1_f32(svptrue_b32(), to, from);
+}
+template <>
+EIGEN_STRONG_INLINE void pstoreu<float>(float* to, const PacketXf& from)
+{
+  EIGEN_DEBUG_UNALIGNED_STORE svst1_f32(svptrue_b32(), to, from);
+}
+template <>
+EIGEN_DEVICE_FUNC inline PacketXf pgather<float, PacketXf>(const float* from, Index stride)
+{
+  // Indice format: {base=0, base+stride, base+stride*2, base+stride*3, ...}
+  svint32_t indices = svindex_s32(0, stride);
+  return svld1_gather_s32index_f32(svptrue_b32(), from, indices);
+}
+template <>
+EIGEN_DEVICE_FUNC inline void pscatter<float, PacketXf>(float* to, const PacketXf& from, Index stride)
+{
+  // Indice format: {base=0, base+stride, base+stride*2, base+stride*3, ...}
+  svint32_t indices = svindex_s32(0, stride);
+  svst1_scatter_s32index_f32(svptrue_b32(), to, indices, from);
+}
+template <>
+EIGEN_STRONG_INLINE float pfirst<PacketXf>(const PacketXf& a)
+{
+  // svlasta returns the first element if all predicate bits are 0
+  return svlasta_f32(svpfalse_b(), a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf preverse(const PacketXf& a)
+{
+  return svrev_f32(a);
+}
+template <>
+EIGEN_STRONG_INLINE PacketXf pabs(const PacketXf& a)
+{
+  return svabs_f32_z(svptrue_b32(), a);
+}
+// TODO(tellenbach): Should this go into MathFunctions.h? If so, change for
+// all vector extensions and the generic version.
+template <>
+EIGEN_STRONG_INLINE PacketXf pfrexp<PacketXf>(const PacketXf& a, PacketXf& exponent)
+{
+  return pfrexp_generic(a, exponent);
+}
+template <>
+EIGEN_STRONG_INLINE float predux<PacketXf>(const PacketXf& a)
+{
+  return svaddv_f32(svptrue_b32(), a);
+}
+// Other reduction functions:
+// mul
+// Only works for SVE Vls multiple of 128
+template <>
+EIGEN_STRONG_INLINE float predux_mul<PacketXf>(const PacketXf& a)
+{
+  EIGEN_STATIC_ASSERT((EIGEN_ARM64_SVE_VL % 128 == 0),
+                      EIGEN_INTERNAL_ERROR_PLEASE_FILE_A_BUG_REPORT);
+  // Multiply the vector by its reverse
+  svfloat32_t prod = svmul_f32_z(svptrue_b32(), a, svrev_f32(a));
+  svfloat32_t half_prod;
+  // Extract the high half of the vector. Depending on the VL more reductions need to be done
+  if (EIGEN_ARM64_SVE_VL >= 2048) {
+    half_prod = svtbl_f32(prod, svindex_u32(32, 1));
+    prod = svmul_f32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 1024) {
+    half_prod = svtbl_f32(prod, svindex_u32(16, 1));
+    prod = svmul_f32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 512) {
+    half_prod = svtbl_f32(prod, svindex_u32(8, 1));
+    prod = svmul_f32_z(svptrue_b32(), prod, half_prod);
+  }
+  if (EIGEN_ARM64_SVE_VL >= 256) {
+    half_prod = svtbl_f32(prod, svindex_u32(4, 1));
+    prod = svmul_f32_z(svptrue_b32(), prod, half_prod);
+  }
+  // Last reduction
+  half_prod = svtbl_f32(prod, svindex_u32(2, 1));
+  prod = svmul_f32_z(svptrue_b32(), prod, half_prod);
+  // The reduction is done to the first element.
+  return pfirst<PacketXf>(prod);
+}
+template <>
+EIGEN_STRONG_INLINE float predux_min<PacketXf>(const PacketXf& a)
+{
+  return svminv_f32(svptrue_b32(), a);
+}
+template <>
+EIGEN_STRONG_INLINE float predux_max<PacketXf>(const PacketXf& a)
+{
+  return svmaxv_f32(svptrue_b32(), a);
+}
+template<int N>
+EIGEN_DEVICE_FUNC inline void ptranspose(PacketBlock<PacketXf, N>& kernel)
+{
+  float buffer[packet_traits<float>::size * N] = {0};
+  int i = 0;
+  PacketXi stride_index = svindex_s32(0, N);
+  for (i = 0; i < N; i++) {
+    svst1_scatter_s32index_f32(svptrue_b32(), buffer + i, stride_index, kernel.packet[i]);
+  }
+  for (i = 0; i < N; i++) {
+    kernel.packet[i] = svld1_f32(svptrue_b32(), buffer + i * packet_traits<float>::size);
+  }
+}
+template<>
+EIGEN_STRONG_INLINE PacketXf pldexp<PacketXf>(const PacketXf& a, const PacketXf& exponent)
+{
+  return pldexp_generic(a, exponent);
+}
+}  // namespace internal
+}  // namespace Eigen
+#endif  // EIGEN_PACKET_MATH_SVE_H