k3-node 1.0.0__py3-none-any.whl
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- k3_node/__init__.py +122 -0
- k3_node/applications/__init__.py +17 -0
- k3_node/applications/bio/__init__.py +21 -0
- k3_node/applications/chemistry/__init__.py +155 -0
- k3_node/applications/materials/__init__.py +127 -0
- k3_node/applications/materials/basis.py +449 -0
- k3_node/applications/materials/chgnet.py +360 -0
- k3_node/applications/materials/core.py +351 -0
- k3_node/applications/materials/grace.py +246 -0
- k3_node/applications/materials/io.py +230 -0
- k3_node/applications/materials/m3gnet.py +462 -0
- k3_node/applications/materials/megnet.py +395 -0
- k3_node/applications/materials/qet.py +220 -0
- k3_node/applications/materials/readout.py +235 -0
- k3_node/applications/materials/so3net.py +234 -0
- k3_node/applications/materials/tensornet.py +381 -0
- k3_node/applications/materials/test_materials.py +167 -0
- k3_node/applications/materials/wrappers.py +95 -0
- k3_node/data/__init__.py +47 -0
- k3_node/data/batch.py +102 -0
- k3_node/data/collate.py +282 -0
- k3_node/data/data.py +532 -0
- k3_node/data/database.py +154 -0
- k3_node/data/dataset.py +182 -0
- k3_node/data/download.py +49 -0
- k3_node/data/extract.py +45 -0
- k3_node/data/feature_store.py +70 -0
- k3_node/data/graph_store.py +92 -0
- k3_node/data/hetero_data.py +374 -0
- k3_node/data/hypergraph_data.py +59 -0
- k3_node/data/in_memory_dataset.py +177 -0
- k3_node/data/makedirs.py +7 -0
- k3_node/data/on_disk_dataset.py +77 -0
- k3_node/data/separate.py +115 -0
- k3_node/data/storage.py +593 -0
- k3_node/data/temporal.py +154 -0
- k3_node/data/test_batch.py +67 -0
- k3_node/data/test_data.py +68 -0
- k3_node/data/test_dataset_and_stores.py +111 -0
- k3_node/data/test_hetero_data.py +33 -0
- k3_node/data/test_temporal_and_hyper.py +32 -0
- k3_node/data/view.py +43 -0
- k3_node/datasets/__init__.py +88 -0
- k3_node/datasets/actor.py +101 -0
- k3_node/datasets/airports.py +84 -0
- k3_node/datasets/amazon.py +66 -0
- k3_node/datasets/ba2motif_dataset.py +73 -0
- k3_node/datasets/ba_shapes.py +81 -0
- k3_node/datasets/bitcoin_otc.py +77 -0
- k3_node/datasets/citation_full.py +81 -0
- k3_node/datasets/coauthor.py +66 -0
- k3_node/datasets/dblp.py +106 -0
- k3_node/datasets/digits.py +63 -0
- k3_node/datasets/email_eu_core.py +60 -0
- k3_node/datasets/entities.py +158 -0
- k3_node/datasets/explainer_dataset.py +101 -0
- k3_node/datasets/facebook.py +51 -0
- k3_node/datasets/fake.py +256 -0
- k3_node/datasets/freebase.py +90 -0
- k3_node/datasets/geometric_shapes.py +69 -0
- k3_node/datasets/github.py +51 -0
- k3_node/datasets/graph_generator/__init__.py +6 -0
- k3_node/datasets/graph_generator/ba_graph.py +20 -0
- k3_node/datasets/graph_generator/base.py +29 -0
- k3_node/datasets/graph_generator/er_graph.py +21 -0
- k3_node/datasets/icews.py +58 -0
- k3_node/datasets/imdb.py +96 -0
- k3_node/datasets/jodie.py +56 -0
- k3_node/datasets/karate.py +56 -0
- k3_node/datasets/lastfm_asia.py +51 -0
- k3_node/datasets/mesh_correspondence.py +50 -0
- k3_node/datasets/molecule_net.py +148 -0
- k3_node/datasets/motif_generator/__init__.py +7 -0
- k3_node/datasets/motif_generator/base.py +29 -0
- k3_node/datasets/motif_generator/custom.py +17 -0
- k3_node/datasets/motif_generator/cycle.py +25 -0
- k3_node/datasets/motif_generator/house.py +27 -0
- k3_node/datasets/movielens.py +55 -0
- k3_node/datasets/planetoid.py +137 -0
- k3_node/datasets/polblogs.py +63 -0
- k3_node/datasets/ppi.py +189 -0
- k3_node/datasets/qm7.py +65 -0
- k3_node/datasets/qm9.py +132 -0
- k3_node/datasets/reddit.py +121 -0
- k3_node/datasets/sbm_dataset.py +165 -0
- k3_node/datasets/seal.py +74 -0
- k3_node/datasets/shape_scenes.py +92 -0
- k3_node/datasets/test_datasets.py +322 -0
- k3_node/datasets/tu_dataset.py +131 -0
- k3_node/datasets/twitch.py +66 -0
- k3_node/datasets/webkb.py +102 -0
- k3_node/datasets/wikics.py +85 -0
- k3_node/datasets/word_net.py +184 -0
- k3_node/etl/__init__.py +37 -0
- k3_node/etl/encoders.py +248 -0
- k3_node/etl/graph_builders.py +270 -0
- k3_node/etl/relational_to_graph.py +201 -0
- k3_node/etl/table_to_graph.py +244 -0
- k3_node/etl/test_etl.py +318 -0
- k3_node/export/__init__.py +15 -0
- k3_node/export/cross_backend.py +172 -0
- k3_node/export/onnx_exporter.py +190 -0
- k3_node/export/runtime.py +254 -0
- k3_node/export/tensorrt_exporter.py +201 -0
- k3_node/export/test_export.py +337 -0
- k3_node/export/tflite_exporter.py +112 -0
- k3_node/hub/__init__.py +29 -0
- k3_node/hub/dataset_hub.py +242 -0
- k3_node/hub/hub_mixin.py +599 -0
- k3_node/hub/model_card.py +133 -0
- k3_node/hub/test_hub.py +419 -0
- k3_node/io/__init__.py +22 -0
- k3_node/io/fs.py +117 -0
- k3_node/io/npz.py +45 -0
- k3_node/io/off.py +29 -0
- k3_node/io/planetoid.py +98 -0
- k3_node/io/tu.py +137 -0
- k3_node/io/txt_array.py +58 -0
- k3_node/layers/__init__.py +14 -0
- k3_node/layers/aggr/__init__.py +70 -0
- k3_node/layers/aggr/attention.py +77 -0
- k3_node/layers/aggr/base.py +403 -0
- k3_node/layers/aggr/basic.py +412 -0
- k3_node/layers/aggr/deep_sets.py +65 -0
- k3_node/layers/aggr/deepsets.py +29 -0
- k3_node/layers/aggr/equilibrium.py +107 -0
- k3_node/layers/aggr/fused.py +43 -0
- k3_node/layers/aggr/gmt.py +89 -0
- k3_node/layers/aggr/gru.py +58 -0
- k3_node/layers/aggr/lcm.py +143 -0
- k3_node/layers/aggr/lstm.py +58 -0
- k3_node/layers/aggr/mlp.py +75 -0
- k3_node/layers/aggr/multi.py +154 -0
- k3_node/layers/aggr/patch_transformer.py +137 -0
- k3_node/layers/aggr/quantile.py +125 -0
- k3_node/layers/aggr/resolver.py +68 -0
- k3_node/layers/aggr/scaler.py +133 -0
- k3_node/layers/aggr/set2set.py +87 -0
- k3_node/layers/aggr/set_transformer.py +107 -0
- k3_node/layers/aggr/sort.py +68 -0
- k3_node/layers/aggr/test_aggr.py +337 -0
- k3_node/layers/aggr/utils.py +210 -0
- k3_node/layers/aggr/variance_preserving.py +54 -0
- k3_node/layers/attention/__init__.py +5 -0
- k3_node/layers/attention/pair_attention.py +448 -0
- k3_node/layers/attention/performer.py +187 -0
- k3_node/layers/attention/polynormer.py +160 -0
- k3_node/layers/attention/qformer.py +143 -0
- k3_node/layers/attention/sgformer.py +106 -0
- k3_node/layers/attention/test_attention.py +68 -0
- k3_node/layers/attention/test_pair_attention.py +91 -0
- k3_node/layers/conv/__init__.py +149 -0
- k3_node/layers/conv/agnn_conv.py +120 -0
- k3_node/layers/conv/antisymmetric_conv.py +94 -0
- k3_node/layers/conv/appnp.py +105 -0
- k3_node/layers/conv/appnp_conv.py +157 -0
- k3_node/layers/conv/arma_conv.py +231 -0
- k3_node/layers/conv/cg_conv.py +92 -0
- k3_node/layers/conv/cheb_conv.py +137 -0
- k3_node/layers/conv/cluster_gcn_conv.py +102 -0
- k3_node/layers/conv/conv.py +100 -0
- k3_node/layers/conv/crystal_conv.py +140 -0
- k3_node/layers/conv/cugraph.py +84 -0
- k3_node/layers/conv/diffusion_conv.py +144 -0
- k3_node/layers/conv/dir_gnn_conv.py +93 -0
- k3_node/layers/conv/dna_conv.py +192 -0
- k3_node/layers/conv/edge_conv.py +107 -0
- k3_node/layers/conv/eg_conv.py +155 -0
- k3_node/layers/conv/fa_conv.py +107 -0
- k3_node/layers/conv/feast_conv.py +126 -0
- k3_node/layers/conv/film_conv.py +143 -0
- k3_node/layers/conv/gat_conv.py +244 -0
- k3_node/layers/conv/gated_graph_conv.py +136 -0
- k3_node/layers/conv/gatv2_conv.py +205 -0
- k3_node/layers/conv/gcn.py +144 -0
- k3_node/layers/conv/gcn2_conv.py +126 -0
- k3_node/layers/conv/gcn_conv.py +135 -0
- k3_node/layers/conv/gen_conv.py +163 -0
- k3_node/layers/conv/general_conv.py +218 -0
- k3_node/layers/conv/gin_conv.py +218 -0
- k3_node/layers/conv/gmm_conv.py +172 -0
- k3_node/layers/conv/gps_conv.py +153 -0
- k3_node/layers/conv/graph_attention.py +262 -0
- k3_node/layers/conv/graph_conv.py +84 -0
- k3_node/layers/conv/gravnet_conv.py +93 -0
- k3_node/layers/conv/han_conv.py +175 -0
- k3_node/layers/conv/heat_conv.py +131 -0
- k3_node/layers/conv/hetero_conv.py +128 -0
- k3_node/layers/conv/hgt_conv.py +218 -0
- k3_node/layers/conv/hypergraph_conv.py +182 -0
- k3_node/layers/conv/le_conv.py +81 -0
- k3_node/layers/conv/lg_conv.py +58 -0
- k3_node/layers/conv/meshcnn_conv.py +84 -0
- k3_node/layers/conv/message_passing.py +451 -0
- k3_node/layers/conv/mf_conv.py +95 -0
- k3_node/layers/conv/mixhop_conv.py +108 -0
- k3_node/layers/conv/nn_conv.py +110 -0
- k3_node/layers/conv/pan_conv.py +100 -0
- k3_node/layers/conv/pdn_conv.py +109 -0
- k3_node/layers/conv/pna_conv.py +177 -0
- k3_node/layers/conv/point_conv.py +101 -0
- k3_node/layers/conv/point_gnn_conv.py +90 -0
- k3_node/layers/conv/point_transformer_conv.py +132 -0
- k3_node/layers/conv/ppf_conv.py +135 -0
- k3_node/layers/conv/ppnp.py +89 -0
- k3_node/layers/conv/res_gated_graph_conv.py +126 -0
- k3_node/layers/conv/rgat_conv.py +251 -0
- k3_node/layers/conv/rgcn_conv.py +321 -0
- k3_node/layers/conv/sage_conv.py +154 -0
- k3_node/layers/conv/sg_conv.py +96 -0
- k3_node/layers/conv/signed_conv.py +100 -0
- k3_node/layers/conv/simple_conv.py +75 -0
- k3_node/layers/conv/spline_conv.py +182 -0
- k3_node/layers/conv/ssg_conv.py +101 -0
- k3_node/layers/conv/supergat_conv.py +195 -0
- k3_node/layers/conv/tag_conv.py +98 -0
- k3_node/layers/conv/test_backend_consistency.py +164 -0
- k3_node/layers/conv/test_conv.py +176 -0
- k3_node/layers/conv/test_conv_pyg.py +566 -0
- k3_node/layers/conv/transformer_conv.py +168 -0
- k3_node/layers/conv/utils.py +403 -0
- k3_node/layers/conv/wl_conv.py +151 -0
- k3_node/layers/conv/x_conv.py +187 -0
- k3_node/layers/dense/__init__.py +40 -0
- k3_node/layers/dense/dense_gat_conv.py +149 -0
- k3_node/layers/dense/dense_gcn_conv.py +117 -0
- k3_node/layers/dense/dense_gin_conv.py +88 -0
- k3_node/layers/dense/dense_graph_conv.py +95 -0
- k3_node/layers/dense/dense_sage_conv.py +85 -0
- k3_node/layers/dense/diff_pool.py +76 -0
- k3_node/layers/dense/dmon_pool.py +223 -0
- k3_node/layers/dense/linear.py +327 -0
- k3_node/layers/dense/mincut_pool.py +92 -0
- k3_node/layers/dense/test_dense.py +377 -0
- k3_node/layers/functional/__init__.py +13 -0
- k3_node/layers/functional/bro.py +49 -0
- k3_node/layers/functional/edge_dropout.py +55 -0
- k3_node/layers/functional/gini.py +44 -0
- k3_node/layers/functional/test_functional.py +34 -0
- k3_node/layers/kge/__init__.py +17 -0
- k3_node/layers/kge/base.py +255 -0
- k3_node/layers/kge/complex.py +98 -0
- k3_node/layers/kge/distmult.py +79 -0
- k3_node/layers/kge/loader.py +50 -0
- k3_node/layers/kge/rotate.py +103 -0
- k3_node/layers/kge/test_kge.py +76 -0
- k3_node/layers/kge/transe.py +96 -0
- k3_node/layers/norm/__init__.py +23 -0
- k3_node/layers/norm/batch_norm.py +328 -0
- k3_node/layers/norm/diff_group_norm.py +141 -0
- k3_node/layers/norm/graph_norm.py +105 -0
- k3_node/layers/norm/graph_size_norm.py +57 -0
- k3_node/layers/norm/instance_norm.py +163 -0
- k3_node/layers/norm/layer_norm.py +245 -0
- k3_node/layers/norm/mean_subtraction_norm.py +57 -0
- k3_node/layers/norm/msg_norm.py +58 -0
- k3_node/layers/norm/pair_norm.py +94 -0
- k3_node/layers/norm/test_norm.py +275 -0
- k3_node/layers/pool/__init__.py +83 -0
- k3_node/layers/pool/approx_knn.py +101 -0
- k3_node/layers/pool/asap.py +173 -0
- k3_node/layers/pool/avg_pool.py +165 -0
- k3_node/layers/pool/cluster_pool.py +168 -0
- k3_node/layers/pool/connect/__init__.py +10 -0
- k3_node/layers/pool/connect/base.py +103 -0
- k3_node/layers/pool/connect/filter_edges.py +113 -0
- k3_node/layers/pool/consecutive.py +30 -0
- k3_node/layers/pool/decimation.py +48 -0
- k3_node/layers/pool/edge_pool.py +189 -0
- k3_node/layers/pool/glob.py +139 -0
- k3_node/layers/pool/graclus.py +66 -0
- k3_node/layers/pool/knn.py +253 -0
- k3_node/layers/pool/max_pool.py +159 -0
- k3_node/layers/pool/mem_pool.py +145 -0
- k3_node/layers/pool/pan_pool.py +144 -0
- k3_node/layers/pool/point_cloud.py +212 -0
- k3_node/layers/pool/pool.py +119 -0
- k3_node/layers/pool/sag_pool.py +174 -0
- k3_node/layers/pool/select/__init__.py +10 -0
- k3_node/layers/pool/select/base.py +112 -0
- k3_node/layers/pool/select/topk.py +206 -0
- k3_node/layers/pool/test_pool.py +456 -0
- k3_node/layers/pool/topk_pool.py +103 -0
- k3_node/layers/pool/voxel_grid.py +70 -0
- k3_node/layers/unpool/__init__.py +9 -0
- k3_node/layers/unpool/knn_interpolate.py +57 -0
- k3_node/layers/unpool/test_unpool.py +31 -0
- k3_node/loader/__init__.py +62 -0
- k3_node/loader/base.py +69 -0
- k3_node/loader/cache.py +68 -0
- k3_node/loader/cluster.py +127 -0
- k3_node/loader/data_list_loader.py +45 -0
- k3_node/loader/dataloader.py +117 -0
- k3_node/loader/dense_data_loader.py +62 -0
- k3_node/loader/dynamic_batch_sampler.py +93 -0
- k3_node/loader/graph_saint.py +188 -0
- k3_node/loader/hgt_loader.py +90 -0
- k3_node/loader/imbalanced_sampler.py +87 -0
- k3_node/loader/keras_dataset.py +334 -0
- k3_node/loader/link_loader.py +179 -0
- k3_node/loader/link_neighbor_loader.py +202 -0
- k3_node/loader/mixin.py +190 -0
- k3_node/loader/neighbor_loader.py +159 -0
- k3_node/loader/neighbor_sampler.py +167 -0
- k3_node/loader/node_loader.py +185 -0
- k3_node/loader/prefetch.py +115 -0
- k3_node/loader/random_node_loader.py +89 -0
- k3_node/loader/sampler_utils.py +499 -0
- k3_node/loader/shadow.py +115 -0
- k3_node/loader/temporal_dataloader.py +98 -0
- k3_node/loader/test_dataloader.py +113 -0
- k3_node/loader/test_keras_dataset.py +221 -0
- k3_node/loader/test_neighbor_loader.py +122 -0
- k3_node/loader/test_sampler_utils.py +82 -0
- k3_node/loader/test_samplers.py +96 -0
- k3_node/loader/test_subgraph_loaders.py +89 -0
- k3_node/loader/utils.py +232 -0
- k3_node/loader/zip_loader.py +88 -0
- k3_node/metrics.py +94 -0
- k3_node/models/__init__.py +424 -0
- k3_node/models/attentive_fp.py +232 -0
- k3_node/models/attract_repel.py +108 -0
- k3_node/models/autoencoder.py +318 -0
- k3_node/models/basic_gnn.py +443 -0
- k3_node/models/bio/__init__.py +4 -0
- k3_node/models/captum.py +52 -0
- k3_node/models/chemistry/__init__.py +4 -0
- k3_node/models/correct_and_smooth.py +146 -0
- k3_node/models/deep_graph_infomax.py +113 -0
- k3_node/models/deepgcn.py +121 -0
- k3_node/models/dimenet.py +737 -0
- k3_node/models/dimenet_utils.py +153 -0
- k3_node/models/gnnff.py +263 -0
- k3_node/models/gps_model.py +1122 -0
- k3_node/models/gpse.py +638 -0
- k3_node/models/graph_unet.py +199 -0
- k3_node/models/graphmae2.py +954 -0
- k3_node/models/graphormer.py +1258 -0
- k3_node/models/graphormer_3d.py +868 -0
- k3_node/models/grover.py +1066 -0
- k3_node/models/jumping_knowledge.py +200 -0
- k3_node/models/label_prop.py +110 -0
- k3_node/models/lightgcn.py +171 -0
- k3_node/models/linkx.py +181 -0
- k3_node/models/lpformer.py +404 -0
- k3_node/models/mask_label.py +114 -0
- k3_node/models/materials/__init__.py +33 -0
- k3_node/models/meta.py +133 -0
- k3_node/models/metapath2vec.py +234 -0
- k3_node/models/mlp.py +264 -0
- k3_node/models/mole_bert.py +379 -0
- k3_node/models/neural_fingerprint.py +95 -0
- k3_node/models/node2vec.py +213 -0
- k3_node/models/pmlp.py +157 -0
- k3_node/models/polynormer.py +229 -0
- k3_node/models/rect.py +93 -0
- k3_node/models/renet.py +221 -0
- k3_node/models/rev_gnn.py +128 -0
- k3_node/models/schnet.py +484 -0
- k3_node/models/sgformer.py +195 -0
- k3_node/models/signed_gcn.py +185 -0
- k3_node/models/test_attentive_fp.py +32 -0
- k3_node/models/test_attract_repel.py +33 -0
- k3_node/models/test_autoencoder.py +119 -0
- k3_node/models/test_basic_gnn.py +102 -0
- k3_node/models/test_correct_and_smooth.py +40 -0
- k3_node/models/test_deep_graph_infomax.py +68 -0
- k3_node/models/test_deepgcn.py +21 -0
- k3_node/models/test_dimenet.py +86 -0
- k3_node/models/test_domain_apis.py +138 -0
- k3_node/models/test_gnnff.py +24 -0
- k3_node/models/test_gps_model.py +271 -0
- k3_node/models/test_gpse.py +34 -0
- k3_node/models/test_graph_unet.py +26 -0
- k3_node/models/test_graphmae2.py +226 -0
- k3_node/models/test_graphormer.py +233 -0
- k3_node/models/test_graphormer3d.py +163 -0
- k3_node/models/test_grover.py +287 -0
- k3_node/models/test_jumping_knowledge.py +129 -0
- k3_node/models/test_label_prop.py +37 -0
- k3_node/models/test_lightgcn.py +38 -0
- k3_node/models/test_linkx.py +31 -0
- k3_node/models/test_lpformer.py +22 -0
- k3_node/models/test_mask_label.py +90 -0
- k3_node/models/test_meta.py +159 -0
- k3_node/models/test_metapath2vec.py +45 -0
- k3_node/models/test_mlp.py +62 -0
- k3_node/models/test_mole_bert.py +164 -0
- k3_node/models/test_neural_fingerprint.py +13 -0
- k3_node/models/test_node2vec.py +57 -0
- k3_node/models/test_pmlp.py +81 -0
- k3_node/models/test_polynormer.py +104 -0
- k3_node/models/test_rect.py +23 -0
- k3_node/models/test_renet.py +32 -0
- k3_node/models/test_rev_gnn.py +24 -0
- k3_node/models/test_schnet.py +43 -0
- k3_node/models/test_sgformer.py +48 -0
- k3_node/models/test_signed_gcn.py +28 -0
- k3_node/models/test_tgn.py +77 -0
- k3_node/models/test_unimol.py +179 -0
- k3_node/models/test_unimol2.py +114 -0
- k3_node/models/test_unimol_plus.py +131 -0
- k3_node/models/test_visnet.py +44 -0
- k3_node/models/tgn.py +382 -0
- k3_node/models/unimol.py +1156 -0
- k3_node/models/unimol2.py +616 -0
- k3_node/models/unimol_docking_v2.py +301 -0
- k3_node/models/unimol_plus.py +456 -0
- k3_node/models/utils.py +97 -0
- k3_node/models/visnet.py +759 -0
- k3_node/ops/__init__.py +4 -0
- k3_node/ops/conv.py +56 -0
- k3_node/ops/creation.py +43 -0
- k3_node/ops/graph.py +27 -0
- k3_node/ops/host.py +41 -0
- k3_node/ops/matmul.py +49 -0
- k3_node/ops/numpy.py +24 -0
- k3_node/ops/segment.py +54 -0
- k3_node/ops/sparse.py +51 -0
- k3_node/rag/__init__.py +49 -0
- k3_node/rag/encoders.py +312 -0
- k3_node/rag/pipeline.py +192 -0
- k3_node/rag/projector.py +184 -0
- k3_node/rag/subgraph.py +270 -0
- k3_node/rag/test_rag.py +347 -0
- k3_node/rag/verbalizer.py +162 -0
- k3_node/tasks/__init__.py +19 -0
- k3_node/tasks/backbone_resolver.py +125 -0
- k3_node/tasks/base.py +67 -0
- k3_node/tasks/graph_classification.py +270 -0
- k3_node/tasks/graph_regression.py +228 -0
- k3_node/tasks/link_prediction.py +306 -0
- k3_node/tasks/node_classification.py +194 -0
- k3_node/tasks/node_regression.py +138 -0
- k3_node/tasks/test_tasks.py +319 -0
- k3_node/test_docstring_examples.py +106 -0
- k3_node/test_training_forwarding.py +116 -0
- k3_node/training.py +115 -0
- k3_node/transforms/__init__.py +166 -0
- k3_node/transforms/base_transform.py +32 -0
- k3_node/transforms/compose.py +58 -0
- k3_node/transforms/general.py +676 -0
- k3_node/transforms/graph.py +1070 -0
- k3_node/transforms/spatial.py +797 -0
- k3_node/transforms/test_random_link_split.py +45 -0
- k3_node/transforms/test_spatial_transforms.py +65 -0
- k3_node/transforms/test_transforms.py +253 -0
- k3_node/transforms/utils.py +102 -0
- k3_node/utils/__init__.py +5 -0
- k3_node/utils/backend_import.py +12 -0
- k3_node/utils/graph.py +286 -0
- k3_node/utils/keras.py +94 -0
- k3_node/utils/random.py +103 -0
- k3_node/utils/smiles.py +235 -0
- k3_node-1.0.0.dist-info/METADATA +284 -0
- k3_node-1.0.0.dist-info/RECORD +459 -0
- k3_node-1.0.0.dist-info/WHEEL +5 -0
- k3_node-1.0.0.dist-info/licenses/LICENSE +21 -0
- k3_node-1.0.0.dist-info/top_level.txt +1 -0
|
@@ -0,0 +1,160 @@
|
|
|
1
|
+
import keras
|
|
2
|
+
from keras import ops
|
|
3
|
+
|
|
4
|
+
|
|
5
|
+
class PolynormerAttention(keras.layers.Layer):
|
|
6
|
+
"""Layer ``PolynormerAttention``.
|
|
7
|
+
|
|
8
|
+
Example:
|
|
9
|
+
```python
|
|
10
|
+
import numpy as np
|
|
11
|
+
from k3_node.layers import PolynormerAttention
|
|
12
|
+
|
|
13
|
+
x = np.random.rand(1, 10, 8).astype("float32") # [batch, num_nodes, channels]
|
|
14
|
+
|
|
15
|
+
mask = np.ones((1, 10), dtype=bool)
|
|
16
|
+
attn = PolynormerAttention(channels=8, heads=2)
|
|
17
|
+
print(tuple(attn(x, mask).shape)) # (1, 10, 128)
|
|
18
|
+
```
|
|
19
|
+
"""
|
|
20
|
+
def __init__(
|
|
21
|
+
self,
|
|
22
|
+
channels,
|
|
23
|
+
heads,
|
|
24
|
+
head_channels=64,
|
|
25
|
+
beta=0.9,
|
|
26
|
+
qkv_bias=False,
|
|
27
|
+
qk_shared=True,
|
|
28
|
+
dropout=0.0,
|
|
29
|
+
**kwargs,
|
|
30
|
+
):
|
|
31
|
+
super().__init__(**kwargs)
|
|
32
|
+
self.supports_masking = True
|
|
33
|
+
|
|
34
|
+
self.channels = channels
|
|
35
|
+
self.heads = heads
|
|
36
|
+
self.head_channels = head_channels
|
|
37
|
+
self.beta = beta
|
|
38
|
+
self.qk_shared = qk_shared
|
|
39
|
+
|
|
40
|
+
inner_channels = heads * head_channels
|
|
41
|
+
|
|
42
|
+
self.h_lins = keras.layers.Dense(inner_channels)
|
|
43
|
+
|
|
44
|
+
if not qk_shared:
|
|
45
|
+
self.q = keras.layers.Dense(
|
|
46
|
+
inner_channels,
|
|
47
|
+
use_bias=qkv_bias,
|
|
48
|
+
)
|
|
49
|
+
|
|
50
|
+
self.k = keras.layers.Dense(
|
|
51
|
+
inner_channels,
|
|
52
|
+
use_bias=qkv_bias,
|
|
53
|
+
)
|
|
54
|
+
|
|
55
|
+
self.v = keras.layers.Dense(
|
|
56
|
+
inner_channels,
|
|
57
|
+
use_bias=qkv_bias,
|
|
58
|
+
)
|
|
59
|
+
|
|
60
|
+
self.lns = keras.layers.LayerNormalization(epsilon=1e-5)
|
|
61
|
+
self.lin_out = keras.layers.Dense(inner_channels)
|
|
62
|
+
self.dropout = keras.layers.Dropout(dropout)
|
|
63
|
+
|
|
64
|
+
def compute_mask(self, inputs, mask=None):
|
|
65
|
+
return mask
|
|
66
|
+
|
|
67
|
+
def call(self, x, mask=None, training=None):
|
|
68
|
+
shape = ops.shape(x)
|
|
69
|
+
|
|
70
|
+
B = shape[0]
|
|
71
|
+
N = shape[1]
|
|
72
|
+
|
|
73
|
+
h = self.h_lins(x)
|
|
74
|
+
|
|
75
|
+
k = self.k(x)
|
|
76
|
+
k = ops.sigmoid(k)
|
|
77
|
+
k = ops.reshape(
|
|
78
|
+
k,
|
|
79
|
+
(B, N, self.head_channels, self.heads),
|
|
80
|
+
)
|
|
81
|
+
|
|
82
|
+
if self.qk_shared:
|
|
83
|
+
q = k
|
|
84
|
+
else:
|
|
85
|
+
q = ops.sigmoid(self.q(x))
|
|
86
|
+
q = ops.reshape(
|
|
87
|
+
q,
|
|
88
|
+
(B, N, self.head_channels, self.heads),
|
|
89
|
+
)
|
|
90
|
+
|
|
91
|
+
v = self.v(x)
|
|
92
|
+
v = ops.reshape(
|
|
93
|
+
v,
|
|
94
|
+
(B, N, self.head_channels, self.heads),
|
|
95
|
+
)
|
|
96
|
+
|
|
97
|
+
if mask is not None:
|
|
98
|
+
mask = ops.expand_dims(mask, axis=-1)
|
|
99
|
+
mask = ops.expand_dims(mask, axis=-1)
|
|
100
|
+
v = v * ops.cast(mask, v.dtype)
|
|
101
|
+
|
|
102
|
+
# numerator
|
|
103
|
+
kv = ops.einsum(
|
|
104
|
+
"bndh,bnmh->bdmh",
|
|
105
|
+
k,
|
|
106
|
+
v,
|
|
107
|
+
)
|
|
108
|
+
|
|
109
|
+
num = ops.einsum(
|
|
110
|
+
"bndh,bdmh->bnmh",
|
|
111
|
+
q,
|
|
112
|
+
kv,
|
|
113
|
+
)
|
|
114
|
+
|
|
115
|
+
# denominator
|
|
116
|
+
k_sum = ops.einsum(
|
|
117
|
+
"bndh->bdh",
|
|
118
|
+
k,
|
|
119
|
+
)
|
|
120
|
+
|
|
121
|
+
den = ops.einsum(
|
|
122
|
+
"bndh,bdh->bnh",
|
|
123
|
+
q,
|
|
124
|
+
k_sum,
|
|
125
|
+
)
|
|
126
|
+
|
|
127
|
+
den = ops.expand_dims(den, axis=2)
|
|
128
|
+
|
|
129
|
+
x = num / (den + 1e-6)
|
|
130
|
+
|
|
131
|
+
x = ops.reshape(
|
|
132
|
+
x,
|
|
133
|
+
(B, N, self.head_channels * self.heads),
|
|
134
|
+
)
|
|
135
|
+
|
|
136
|
+
x = self.lns(x)
|
|
137
|
+
x = x * (h + self.beta)
|
|
138
|
+
|
|
139
|
+
x = self.lin_out(x)
|
|
140
|
+
x = ops.relu(x)
|
|
141
|
+
|
|
142
|
+
x = self.dropout(
|
|
143
|
+
x,
|
|
144
|
+
training=training,
|
|
145
|
+
)
|
|
146
|
+
|
|
147
|
+
return x
|
|
148
|
+
|
|
149
|
+
def get_config(self):
|
|
150
|
+
config = super().get_config()
|
|
151
|
+
config.update(
|
|
152
|
+
{
|
|
153
|
+
"channels": self.channels,
|
|
154
|
+
"heads": self.heads,
|
|
155
|
+
"head_channels": self.head_channels,
|
|
156
|
+
"beta": self.beta,
|
|
157
|
+
"qk_shared": self.qk_shared,
|
|
158
|
+
}
|
|
159
|
+
)
|
|
160
|
+
return config
|
|
@@ -0,0 +1,143 @@
|
|
|
1
|
+
from keras import layers, ops
|
|
2
|
+
|
|
3
|
+
|
|
4
|
+
class QFormerEncoderLayer(layers.Layer):
|
|
5
|
+
"""Layer ``QFormerEncoderLayer``.
|
|
6
|
+
|
|
7
|
+
Example:
|
|
8
|
+
```python
|
|
9
|
+
import numpy as np
|
|
10
|
+
from k3_node.layers import QFormerEncoderLayer
|
|
11
|
+
|
|
12
|
+
x = np.random.rand(1, 10, 8).astype("float32") # [batch, num_nodes, channels]
|
|
13
|
+
|
|
14
|
+
layer = QFormerEncoderLayer(input_dim=8, hidden_dim=16, num_heads=2)
|
|
15
|
+
print(tuple(layer(x).shape)) # (1, 10, 8)
|
|
16
|
+
```
|
|
17
|
+
"""
|
|
18
|
+
def __init__(
|
|
19
|
+
self,
|
|
20
|
+
input_dim,
|
|
21
|
+
hidden_dim,
|
|
22
|
+
num_heads,
|
|
23
|
+
dropout=0.0,
|
|
24
|
+
activation="relu",
|
|
25
|
+
**kwargs,
|
|
26
|
+
):
|
|
27
|
+
super().__init__(**kwargs)
|
|
28
|
+
|
|
29
|
+
self.self_attn = layers.MultiHeadAttention(
|
|
30
|
+
num_heads=num_heads,
|
|
31
|
+
key_dim=input_dim // num_heads,
|
|
32
|
+
dropout=dropout,
|
|
33
|
+
use_bias=True,
|
|
34
|
+
)
|
|
35
|
+
|
|
36
|
+
self.linear1 = layers.Dense(hidden_dim)
|
|
37
|
+
self.linear2 = layers.Dense(input_dim)
|
|
38
|
+
|
|
39
|
+
self.norm1 = layers.LayerNormalization(epsilon=1e-5)
|
|
40
|
+
self.norm2 = layers.LayerNormalization(epsilon=1e-5)
|
|
41
|
+
|
|
42
|
+
self.dropout = layers.Dropout(dropout)
|
|
43
|
+
self.dropout1 = layers.Dropout(dropout)
|
|
44
|
+
self.dropout2 = layers.Dropout(dropout)
|
|
45
|
+
|
|
46
|
+
self.activation = activation
|
|
47
|
+
|
|
48
|
+
def call(self, x, training=None):
|
|
49
|
+
# PyTorch TransformerEncoderLayer, norm_first=False
|
|
50
|
+
|
|
51
|
+
attn = self.self_attn(
|
|
52
|
+
x,
|
|
53
|
+
x,
|
|
54
|
+
training=training,
|
|
55
|
+
)
|
|
56
|
+
|
|
57
|
+
x = self.norm1(
|
|
58
|
+
x + self.dropout1(attn, training=training)
|
|
59
|
+
)
|
|
60
|
+
|
|
61
|
+
ff = self.linear1(x)
|
|
62
|
+
|
|
63
|
+
if self.activation == "relu":
|
|
64
|
+
ff = ops.relu(ff)
|
|
65
|
+
elif self.activation == "gelu":
|
|
66
|
+
ff = ops.gelu(ff)
|
|
67
|
+
else:
|
|
68
|
+
raise ValueError(
|
|
69
|
+
f"Unsupported activation: {self.activation}"
|
|
70
|
+
)
|
|
71
|
+
|
|
72
|
+
ff = self.dropout(ff, training=training)
|
|
73
|
+
ff = self.linear2(ff)
|
|
74
|
+
|
|
75
|
+
x = self.norm2(
|
|
76
|
+
x + self.dropout2(ff, training=training)
|
|
77
|
+
)
|
|
78
|
+
|
|
79
|
+
return x
|
|
80
|
+
|
|
81
|
+
|
|
82
|
+
class QFormer(layers.Layer):
|
|
83
|
+
"""Layer ``QFormer``.
|
|
84
|
+
|
|
85
|
+
Example:
|
|
86
|
+
```python
|
|
87
|
+
import numpy as np
|
|
88
|
+
from k3_node.layers import QFormer
|
|
89
|
+
|
|
90
|
+
x = np.random.rand(1, 10, 8).astype("float32") # [batch, num_nodes, channels]
|
|
91
|
+
|
|
92
|
+
model = QFormer(input_dim=8, hidden_dim=16, output_dim=4, num_heads=2, num_layers=1)
|
|
93
|
+
print(tuple(model(x).shape)) # (1, 10, 4)
|
|
94
|
+
```
|
|
95
|
+
"""
|
|
96
|
+
def __init__(
|
|
97
|
+
self,
|
|
98
|
+
input_dim,
|
|
99
|
+
hidden_dim,
|
|
100
|
+
output_dim,
|
|
101
|
+
num_heads,
|
|
102
|
+
num_layers,
|
|
103
|
+
dropout=0.0,
|
|
104
|
+
activation="relu",
|
|
105
|
+
**kwargs,
|
|
106
|
+
):
|
|
107
|
+
super().__init__(**kwargs)
|
|
108
|
+
|
|
109
|
+
self.num_layers = num_layers
|
|
110
|
+
self.num_heads = num_heads
|
|
111
|
+
|
|
112
|
+
self.layer_norm = layers.LayerNormalization(
|
|
113
|
+
epsilon=1e-5
|
|
114
|
+
)
|
|
115
|
+
|
|
116
|
+
self.encoder = [
|
|
117
|
+
QFormerEncoderLayer(
|
|
118
|
+
input_dim=input_dim,
|
|
119
|
+
hidden_dim=hidden_dim,
|
|
120
|
+
num_heads=num_heads,
|
|
121
|
+
dropout=dropout,
|
|
122
|
+
activation=activation,
|
|
123
|
+
)
|
|
124
|
+
for _ in range(num_layers)
|
|
125
|
+
]
|
|
126
|
+
|
|
127
|
+
self.project = layers.Dense(output_dim)
|
|
128
|
+
|
|
129
|
+
def call(self, x, training=None):
|
|
130
|
+
x = self.layer_norm(x)
|
|
131
|
+
|
|
132
|
+
for layer in self.encoder:
|
|
133
|
+
x = layer(x, training=training)
|
|
134
|
+
|
|
135
|
+
return self.project(x)
|
|
136
|
+
|
|
137
|
+
def get_config(self):
|
|
138
|
+
config = super().get_config()
|
|
139
|
+
config.update({
|
|
140
|
+
"num_layers": self.num_layers,
|
|
141
|
+
"num_heads": self.num_heads,
|
|
142
|
+
})
|
|
143
|
+
return config
|
|
@@ -0,0 +1,106 @@
|
|
|
1
|
+
from typing import Optional
|
|
2
|
+
import keras
|
|
3
|
+
from keras import ops
|
|
4
|
+
|
|
5
|
+
|
|
6
|
+
class SGFormerAttention(keras.layers.Layer):
|
|
7
|
+
r"""The simple global attention mechanism from the
|
|
8
|
+
`"SGFormer: Simplifying and Empowering Transformers for
|
|
9
|
+
Large-Graph Representations"
|
|
10
|
+
<https://arxiv.org/abs/2306.10759>`_ paper.
|
|
11
|
+
|
|
12
|
+
Args:
|
|
13
|
+
channels (int): Size of each input sample.
|
|
14
|
+
heads (int, optional): Number of parallel attention heads.
|
|
15
|
+
(default: :obj:`1`)
|
|
16
|
+
head_channels (int, optional): Size of each attention head.
|
|
17
|
+
(default: :obj:`64`)
|
|
18
|
+
qkv_bias (bool, optional): If specified, add bias to query, key
|
|
19
|
+
and value in the self attention. (default: :obj:`False`)
|
|
20
|
+
|
|
21
|
+
Example:
|
|
22
|
+
```python
|
|
23
|
+
import numpy as np
|
|
24
|
+
from k3_node.layers import SGFormerAttention
|
|
25
|
+
|
|
26
|
+
x = np.random.rand(1, 10, 8).astype("float32") # [batch, num_nodes, channels]
|
|
27
|
+
|
|
28
|
+
attn = SGFormerAttention(channels=8, heads=2)
|
|
29
|
+
print(tuple(attn(x).shape)) # (1, 10, 64)
|
|
30
|
+
```
|
|
31
|
+
"""
|
|
32
|
+
def __init__(
|
|
33
|
+
self,
|
|
34
|
+
channels: int,
|
|
35
|
+
heads: int = 1,
|
|
36
|
+
head_channels: Optional[int] = 64,
|
|
37
|
+
qkv_bias: bool = False,
|
|
38
|
+
**kwargs,
|
|
39
|
+
):
|
|
40
|
+
super().__init__(**kwargs)
|
|
41
|
+
self.supports_masking = True
|
|
42
|
+
assert channels % heads == 0
|
|
43
|
+
if head_channels is None:
|
|
44
|
+
head_channels = channels // heads
|
|
45
|
+
|
|
46
|
+
self.channels = channels
|
|
47
|
+
self.heads = heads
|
|
48
|
+
self.head_channels = head_channels
|
|
49
|
+
self.qkv_bias = qkv_bias
|
|
50
|
+
|
|
51
|
+
inner_channels = head_channels * heads
|
|
52
|
+
self.q = keras.layers.Dense(inner_channels, use_bias=qkv_bias)
|
|
53
|
+
self.k = keras.layers.Dense(inner_channels, use_bias=qkv_bias)
|
|
54
|
+
self.v = keras.layers.Dense(inner_channels, use_bias=qkv_bias)
|
|
55
|
+
|
|
56
|
+
def compute_mask(self, inputs, mask=None):
|
|
57
|
+
return mask
|
|
58
|
+
|
|
59
|
+
def call(self, x, mask: Optional[any] = None):
|
|
60
|
+
shape = ops.shape(x)
|
|
61
|
+
B = shape[0]
|
|
62
|
+
N = shape[1]
|
|
63
|
+
|
|
64
|
+
qs = self.q(x)
|
|
65
|
+
ks = self.k(x)
|
|
66
|
+
vs = self.v(x)
|
|
67
|
+
|
|
68
|
+
qs = ops.reshape(qs, (B, N, self.heads, self.head_channels))
|
|
69
|
+
ks = ops.reshape(ks, (B, N, self.heads, self.head_channels))
|
|
70
|
+
vs = ops.reshape(vs, (B, N, self.heads, self.head_channels))
|
|
71
|
+
|
|
72
|
+
if mask is not None:
|
|
73
|
+
m = ops.expand_dims(ops.expand_dims(mask, -1), -1)
|
|
74
|
+
m = ops.cast(m, "bool")
|
|
75
|
+
vs = ops.where(m, vs, ops.zeros_like(vs))
|
|
76
|
+
|
|
77
|
+
epsilon = 1e-6
|
|
78
|
+
qs = ops.where(ops.equal(qs, 0.0), epsilon, qs)
|
|
79
|
+
ks = ops.where(ops.equal(ks, 0.0), epsilon, ks)
|
|
80
|
+
|
|
81
|
+
qs_norm = ops.norm(qs, axis=-1, keepdims=True)
|
|
82
|
+
ks_norm = ops.norm(ks, axis=-1, keepdims=True)
|
|
83
|
+
qs = qs / ops.maximum(qs_norm, 1e-12)
|
|
84
|
+
ks = ks / ops.maximum(ks_norm, 1e-12)
|
|
85
|
+
|
|
86
|
+
# numerator
|
|
87
|
+
kvs = ops.einsum("blhm,blhd->bhmd", ks, vs)
|
|
88
|
+
attention_num = ops.einsum("bnhm,bhmd->bnhd", qs, kvs)
|
|
89
|
+
n_float = ops.cast(N, vs.dtype)
|
|
90
|
+
attention_num = attention_num + n_float * vs
|
|
91
|
+
|
|
92
|
+
# denominator
|
|
93
|
+
all_ones = ops.ones((B, N), dtype=ks.dtype)
|
|
94
|
+
ks_sum = ops.einsum("blhm,bl->bhm", ks, all_ones)
|
|
95
|
+
attention_normalizer = ops.einsum("bnhm,bhm->bnh", qs, ks_sum)
|
|
96
|
+
attention_normalizer = ops.expand_dims(attention_normalizer, -1)
|
|
97
|
+
attention_normalizer = attention_normalizer + n_float
|
|
98
|
+
attn_output = attention_num / attention_normalizer
|
|
99
|
+
|
|
100
|
+
return ops.mean(attn_output, axis=2)
|
|
101
|
+
|
|
102
|
+
def __repr__(self) -> str:
|
|
103
|
+
return (f"{self.__class__.__name__}("
|
|
104
|
+
f"heads={self.heads}, "
|
|
105
|
+
f"head_channels={self.head_channels})")
|
|
106
|
+
|
|
@@ -0,0 +1,68 @@
|
|
|
1
|
+
import pytest
|
|
2
|
+
from keras import ops, random
|
|
3
|
+
|
|
4
|
+
from k3_node.layers import PerformerAttention, PolynormerAttention, QFormer
|
|
5
|
+
|
|
6
|
+
|
|
7
|
+
@pytest.mark.parametrize("in_channels", [32, 64])
|
|
8
|
+
@pytest.mark.parametrize("out_channels", [32, 64])
|
|
9
|
+
@pytest.mark.parametrize("heads", [4, 8])
|
|
10
|
+
@pytest.mark.parametrize("num_nodes", [4, 8])
|
|
11
|
+
def test_performer_attention(num_nodes, in_channels, out_channels, heads):
|
|
12
|
+
x = random.normal((1, num_nodes, in_channels))
|
|
13
|
+
mask = ops.ones([1, num_nodes])
|
|
14
|
+
attn = PerformerAttention(channels=out_channels, heads=heads)
|
|
15
|
+
out = attn(x, mask)
|
|
16
|
+
assert out.shape == (1, num_nodes, out_channels)
|
|
17
|
+
|
|
18
|
+
|
|
19
|
+
|
|
20
|
+
@pytest.mark.parametrize("in_channels", [32, 64])
|
|
21
|
+
@pytest.mark.parametrize("heads", [4, 8])
|
|
22
|
+
@pytest.mark.parametrize("num_nodes", [4, 8])
|
|
23
|
+
def test_polynormer_attention(num_nodes, in_channels, heads):
|
|
24
|
+
|
|
25
|
+
x = random.normal((1, num_nodes, in_channels))
|
|
26
|
+
|
|
27
|
+
mask = ops.ones([1, num_nodes])
|
|
28
|
+
|
|
29
|
+
attn = PolynormerAttention(
|
|
30
|
+
channels=in_channels,
|
|
31
|
+
heads=heads,
|
|
32
|
+
)
|
|
33
|
+
|
|
34
|
+
out = attn(x, mask)
|
|
35
|
+
|
|
36
|
+
assert out.shape == (1, num_nodes, heads * 64)
|
|
37
|
+
|
|
38
|
+
@pytest.mark.parametrize("input_dim", [16, 32])
|
|
39
|
+
@pytest.mark.parametrize("hidden_dim", [16, 32])
|
|
40
|
+
@pytest.mark.parametrize("output_dim", [16, 32])
|
|
41
|
+
@pytest.mark.parametrize("num_heads", [2, 4])
|
|
42
|
+
@pytest.mark.parametrize("num_layers", [1, 2])
|
|
43
|
+
@pytest.mark.parametrize("num_nodes", [4, 8])
|
|
44
|
+
def test_qformer(
|
|
45
|
+
input_dim,
|
|
46
|
+
hidden_dim,
|
|
47
|
+
output_dim,
|
|
48
|
+
num_heads,
|
|
49
|
+
num_layers,
|
|
50
|
+
num_nodes,
|
|
51
|
+
):
|
|
52
|
+
x = random.normal((1, num_nodes, input_dim))
|
|
53
|
+
|
|
54
|
+
attn = QFormer(
|
|
55
|
+
input_dim=input_dim,
|
|
56
|
+
hidden_dim=hidden_dim,
|
|
57
|
+
output_dim=output_dim,
|
|
58
|
+
num_heads=num_heads,
|
|
59
|
+
num_layers=num_layers,
|
|
60
|
+
)
|
|
61
|
+
|
|
62
|
+
out = attn(x)
|
|
63
|
+
|
|
64
|
+
assert out.shape == (
|
|
65
|
+
1,
|
|
66
|
+
num_nodes,
|
|
67
|
+
output_dim,
|
|
68
|
+
)
|
|
@@ -0,0 +1,91 @@
|
|
|
1
|
+
import numpy as np
|
|
2
|
+
import pytest
|
|
3
|
+
import keras
|
|
4
|
+
from keras import ops
|
|
5
|
+
|
|
6
|
+
from k3_node.layers.attention import (
|
|
7
|
+
SelfMultiheadAttentionWithPair,
|
|
8
|
+
TransformerEncoderLayerWithPair,
|
|
9
|
+
TriangleMultiplication,
|
|
10
|
+
OuterProduct,
|
|
11
|
+
)
|
|
12
|
+
|
|
13
|
+
|
|
14
|
+
def test_self_multihead_attention_with_pair():
|
|
15
|
+
bsz = 2
|
|
16
|
+
seq_len = 6
|
|
17
|
+
embed_dim = 32
|
|
18
|
+
num_heads = 4
|
|
19
|
+
|
|
20
|
+
x = ops.convert_to_tensor(np.random.randn(bsz, seq_len, embed_dim).astype("float32"))
|
|
21
|
+
attn_bias = ops.convert_to_tensor(np.random.randn(bsz, num_heads, seq_len, seq_len).astype("float32"))
|
|
22
|
+
padding_mask = ops.convert_to_tensor(np.zeros((bsz, seq_len), dtype="bool"))
|
|
23
|
+
|
|
24
|
+
layer = SelfMultiheadAttentionWithPair(embed_dim=embed_dim, num_heads=num_heads)
|
|
25
|
+
out = layer(x, key_padding_mask=padding_mask, attn_bias=attn_bias)
|
|
26
|
+
assert ops.shape(out) == (bsz, seq_len, embed_dim)
|
|
27
|
+
|
|
28
|
+
# Test return_attn=True
|
|
29
|
+
out, weights, probs = layer(x, key_padding_mask=padding_mask, attn_bias=attn_bias, return_attn=True)
|
|
30
|
+
assert ops.shape(out) == (bsz, seq_len, embed_dim)
|
|
31
|
+
assert ops.shape(weights) == (bsz, num_heads, seq_len, seq_len)
|
|
32
|
+
assert ops.shape(probs) == (bsz, num_heads, seq_len, seq_len)
|
|
33
|
+
|
|
34
|
+
|
|
35
|
+
def test_transformer_encoder_layer_with_pair():
|
|
36
|
+
bsz = 2
|
|
37
|
+
seq_len = 6
|
|
38
|
+
embed_dim = 32
|
|
39
|
+
num_heads = 4
|
|
40
|
+
|
|
41
|
+
x = ops.convert_to_tensor(np.random.randn(bsz, seq_len, embed_dim).astype("float32"))
|
|
42
|
+
attn_bias = ops.convert_to_tensor(np.random.randn(bsz, num_heads, seq_len, seq_len).astype("float32"))
|
|
43
|
+
|
|
44
|
+
layer = TransformerEncoderLayerWithPair(
|
|
45
|
+
embed_dim=embed_dim,
|
|
46
|
+
ffn_embed_dim=64,
|
|
47
|
+
attention_heads=num_heads,
|
|
48
|
+
post_ln=False,
|
|
49
|
+
)
|
|
50
|
+
out = layer(x, attn_bias=attn_bias)
|
|
51
|
+
assert ops.shape(out) == (bsz, seq_len, embed_dim)
|
|
52
|
+
|
|
53
|
+
# Post-LN
|
|
54
|
+
layer_post = TransformerEncoderLayerWithPair(
|
|
55
|
+
embed_dim=embed_dim,
|
|
56
|
+
ffn_embed_dim=64,
|
|
57
|
+
attention_heads=num_heads,
|
|
58
|
+
post_ln=True,
|
|
59
|
+
)
|
|
60
|
+
out_post = layer_post(x, attn_bias=attn_bias)
|
|
61
|
+
assert ops.shape(out_post) == (bsz, seq_len, embed_dim)
|
|
62
|
+
|
|
63
|
+
|
|
64
|
+
def test_triangle_multiplication():
|
|
65
|
+
bsz = 2
|
|
66
|
+
seq_len = 5
|
|
67
|
+
pair_dim = 16
|
|
68
|
+
hidden_dim = 8
|
|
69
|
+
|
|
70
|
+
pair = ops.convert_to_tensor(np.random.randn(bsz, seq_len, seq_len, pair_dim).astype("float32"))
|
|
71
|
+
|
|
72
|
+
tri_out = TriangleMultiplication(pair_dim=pair_dim, hidden_dim=hidden_dim, mode="outgoing")
|
|
73
|
+
out = tri_out(pair)
|
|
74
|
+
assert ops.shape(out) == (bsz, seq_len, seq_len, pair_dim)
|
|
75
|
+
|
|
76
|
+
tri_in = TriangleMultiplication(pair_dim=pair_dim, hidden_dim=hidden_dim, mode="incoming")
|
|
77
|
+
out = tri_in(pair)
|
|
78
|
+
assert ops.shape(out) == (bsz, seq_len, seq_len, pair_dim)
|
|
79
|
+
|
|
80
|
+
|
|
81
|
+
def test_outer_product():
|
|
82
|
+
bsz = 2
|
|
83
|
+
seq_len = 6
|
|
84
|
+
embed_dim = 32
|
|
85
|
+
pair_dim = 16
|
|
86
|
+
|
|
87
|
+
x = ops.convert_to_tensor(np.random.randn(bsz, seq_len, embed_dim).astype("float32"))
|
|
88
|
+
op = OuterProduct(embed_dim=embed_dim, pair_dim=pair_dim, hidden_dim=8)
|
|
89
|
+
out = op(x)
|
|
90
|
+
assert ops.shape(out) == (bsz, seq_len, seq_len, pair_dim)
|
|
91
|
+
|