AutoRAG 0.2.6__tar.gz → 0.2.8__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (448) hide show
  1. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/PKG-INFO +7 -6
  2. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/SOURCES.txt +16 -16
  3. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/requires.txt +2 -2
  4. {autorag-0.2.6 → autorag-0.2.8}/PKG-INFO +7 -6
  5. {autorag-0.2.6 → autorag-0.2.8}/README.md +2 -2
  6. autorag-0.2.8/autorag/VERSION +1 -0
  7. {autorag-0.2.6 → autorag-0.2.8}/autorag/dashboard.py +2 -2
  8. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/generation.py +2 -2
  9. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/generation.py +9 -2
  10. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/retrieval.py +5 -1
  11. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/retrieval_contents.py +2 -1
  12. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/retrieval.py +4 -3
  13. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/retrieval_contents.py +1 -1
  14. {autorag-0.2.6 → autorag-0.2.8}/autorag/evaluator.py +4 -4
  15. {autorag-0.2.6 → autorag-0.2.8}/autorag/node_line.py +1 -1
  16. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/run.py +5 -4
  17. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passageaugmenter/base.py +5 -25
  18. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passageaugmenter/run.py +1 -1
  19. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/run.py +3 -3
  20. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/base.py +1 -1
  21. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/run.py +1 -1
  22. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/similarity_percentile_cutoff.py +9 -2
  23. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/similarity_threshold_cutoff.py +7 -21
  24. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/base.py +1 -1
  25. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/flag_embedding.py +2 -2
  26. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/run.py +1 -1
  27. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/upr.py +9 -26
  28. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/promptmaker/run.py +3 -3
  29. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/base.py +3 -0
  30. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/query_decompose.py +1 -1
  31. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/run.py +4 -3
  32. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/base.py +1 -1
  33. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/run.py +3 -3
  34. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/vectordb.py +7 -1
  35. {autorag-0.2.6 → autorag-0.2.8}/autorag/utils/util.py +55 -3
  36. autorag-0.2.8/docs/source/api_spec/autorag.evaluation.metric.rst +45 -0
  37. autorag-0.2.8/docs/source/api_spec/autorag.evaluation.rst +53 -0
  38. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.rst +1 -1
  39. {autorag-0.2.6 → autorag-0.2.8}/docs/source/data_creation/data_format.md +7 -0
  40. {autorag-0.2.6 → autorag-0.2.8}/docs/source/data_creation/ragas.md +7 -0
  41. {autorag-0.2.6 → autorag-0.2.8}/docs/source/data_creation/tutorial.md +7 -0
  42. {autorag-0.2.6 → autorag-0.2.8}/docs/source/deploy/api_endpoint.md +7 -0
  43. {autorag-0.2.6 → autorag-0.2.8}/docs/source/deploy/web.md +7 -0
  44. {autorag-0.2.6 → autorag-0.2.8}/docs/source/evaluate_metrics/generation.md +7 -0
  45. {autorag-0.2.6 → autorag-0.2.8}/docs/source/evaluate_metrics/retrieval.md +7 -0
  46. {autorag-0.2.6 → autorag-0.2.8}/docs/source/evaluate_metrics/retrieval_contents.md +7 -0
  47. {autorag-0.2.6 → autorag-0.2.8}/docs/source/index.rst +5 -0
  48. {autorag-0.2.6 → autorag-0.2.8}/docs/source/install.md +7 -0
  49. {autorag-0.2.6 → autorag-0.2.8}/docs/source/local_model.md +19 -15
  50. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/generator/generator.md +7 -0
  51. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/generator/llama_index_llm.md +7 -0
  52. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/generator/openai_llm.md +7 -0
  53. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/generator/vllm.md +7 -0
  54. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/index.md +7 -0
  55. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_augmenter/passage_augmenter.md +7 -0
  56. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_augmenter/prev_next_augmenter.md +7 -0
  57. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_compressor/longllmlingua.md +7 -0
  58. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_compressor/passage_compressor.md +7 -0
  59. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_compressor/refine.md +8 -1
  60. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_compressor/tree_summarize.md +7 -0
  61. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/passage_filter.md +7 -0
  62. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/percentile_cutoff.md +7 -0
  63. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/recency_filter.md +7 -0
  64. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/similarity_percentile_cutoff.md +7 -0
  65. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/similarity_threshold_cutoff.md +7 -0
  66. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_filter/threshold_cutoff.md +7 -0
  67. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/cohere.md +7 -0
  68. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/colbert.md +7 -0
  69. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/flag_embedding_llm_reranker.md +8 -1
  70. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/flag_embedding_reranker.md +7 -0
  71. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/jina_reranker.md +7 -0
  72. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/koreranker.md +7 -0
  73. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/monot5.md +7 -0
  74. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/passage_reranker.md +7 -0
  75. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/rankgpt.md +7 -0
  76. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/sentence_transformer_reranker.md +7 -0
  77. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/tart.md +7 -0
  78. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/time_reranker.md +7 -0
  79. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/passage_reranker/upr.md +7 -5
  80. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/prompt_maker/fstring.md +7 -0
  81. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/prompt_maker/long_context_reorder.md +7 -0
  82. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/prompt_maker/prompt_maker.md +7 -0
  83. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/query_expansion/hyde.md +7 -0
  84. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/query_expansion/multi_query_expansion.md +7 -0
  85. autorag-0.2.8/docs/source/nodes/query_expansion/query_decompose.md +85 -0
  86. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/query_expansion/query_expansion.md +7 -0
  87. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/bm25.md +7 -0
  88. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/hybrid_cc.md +7 -0
  89. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/hybrid_dbsf.md +7 -0
  90. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/hybrid_rrf.md +7 -0
  91. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/hybrid_rsf.md +7 -0
  92. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/retrieval.md +7 -0
  93. {autorag-0.2.6 → autorag-0.2.8}/docs/source/nodes/retrieval/vectordb.md +7 -0
  94. {autorag-0.2.6 → autorag-0.2.8}/docs/source/optimization/custom_config.md +7 -0
  95. {autorag-0.2.6 → autorag-0.2.8}/docs/source/optimization/folder_structure.md +7 -0
  96. {autorag-0.2.6 → autorag-0.2.8}/docs/source/optimization/optimization.md +7 -0
  97. {autorag-0.2.6 → autorag-0.2.8}/docs/source/optimization/strategies.md +7 -0
  98. {autorag-0.2.6 → autorag-0.2.8}/docs/source/roadmap/modular_rag.md +7 -0
  99. {autorag-0.2.6 → autorag-0.2.8}/docs/source/structure.md +7 -0
  100. {autorag-0.2.6 → autorag-0.2.8}/docs/source/troubleshooting.md +7 -0
  101. {autorag-0.2.6 → autorag-0.2.8}/docs/source/tutorial.md +7 -0
  102. {autorag-0.2.6 → autorag-0.2.8}/pyproject.toml +2 -1
  103. {autorag-0.2.6 → autorag-0.2.8}/requirements.txt +3 -2
  104. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/metric/test_generation_metric.py +1 -1
  105. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/metric/test_retrieval_contents_metric.py +1 -1
  106. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/metric/test_retrieval_metric.py +13 -2
  107. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/test_evaluate_util.py +1 -1
  108. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/test_generation_evaluate.py +1 -1
  109. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/test_retrieval_contents_evaluate.py +1 -1
  110. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/evaluate/test_retrieval_evaluate.py +1 -1
  111. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passageaugmenter/test_run_passage_augmenter.py +1 -0
  112. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_run_passage_compressor_node.py +1 -0
  113. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_passage_filter_run.py +1 -0
  114. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_passage_reranker_run.py +1 -0
  115. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/promptmaker/test_prompt_maker_run.py +2 -1
  116. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_query_expansion_run.py +1 -0
  117. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_run_retrieval_node.py +1 -0
  118. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_vectordb.py +5 -5
  119. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/utils/test_util.py +25 -1
  120. autorag-0.2.6/autorag/VERSION +0 -1
  121. autorag-0.2.6/docs/source/api_spec/autorag.evaluate.metric.rst +0 -45
  122. autorag-0.2.6/docs/source/api_spec/autorag.evaluate.rst +0 -53
  123. autorag-0.2.6/docs/source/nodes/query_expansion/query_decompose.md +0 -26
  124. {autorag-0.2.6 → autorag-0.2.8}/.github/FUNDING.yml +0 -0
  125. {autorag-0.2.6 → autorag-0.2.8}/.github/dependabot.yml +0 -0
  126. {autorag-0.2.6 → autorag-0.2.8}/.github/workflows/publish.yml +0 -0
  127. {autorag-0.2.6 → autorag-0.2.8}/.github/workflows/sphinx.yml +0 -0
  128. {autorag-0.2.6 → autorag-0.2.8}/.github/workflows/test.yml +0 -0
  129. {autorag-0.2.6 → autorag-0.2.8}/.gitignore +0 -0
  130. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/dependency_links.txt +0 -0
  131. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/entry_points.txt +0 -0
  132. {autorag-0.2.6 → autorag-0.2.8}/AutoRAG.egg-info/top_level.txt +0 -0
  133. {autorag-0.2.6 → autorag-0.2.8}/CODE_OF_CONDUCT.md +0 -0
  134. {autorag-0.2.6 → autorag-0.2.8}/CONTRIBUTING.md +0 -0
  135. {autorag-0.2.6 → autorag-0.2.8}/LICENSE +0 -0
  136. {autorag-0.2.6 → autorag-0.2.8}/autorag/__init__.py +0 -0
  137. {autorag-0.2.6 → autorag-0.2.8}/autorag/cli.py +0 -0
  138. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/__init__.py +0 -0
  139. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/corpus/__init__.py +0 -0
  140. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/corpus/langchain.py +0 -0
  141. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/corpus/llama_index.py +0 -0
  142. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/__init__.py +0 -0
  143. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/base.py +0 -0
  144. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/llama_index.py +0 -0
  145. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/llama_index_default_prompt.txt +0 -0
  146. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/ragas.py +0 -0
  147. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/qacreation/simple.py +0 -0
  148. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/utils/__init__.py +0 -0
  149. {autorag-0.2.6 → autorag-0.2.8}/autorag/data/utils/util.py +0 -0
  150. {autorag-0.2.6 → autorag-0.2.8}/autorag/deploy.py +0 -0
  151. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/__init__.py +0 -0
  152. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/__init__.py +0 -0
  153. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/g_eval_prompts/coh_detailed.txt +0 -0
  154. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/g_eval_prompts/con_detailed.txt +0 -0
  155. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/g_eval_prompts/flu_detailed.txt +0 -0
  156. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/g_eval_prompts/rel_detailed.txt +0 -0
  157. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/metric/util.py +0 -0
  158. {autorag-0.2.6/autorag/evaluate → autorag-0.2.8/autorag/evaluation}/util.py +0 -0
  159. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/__init__.py +0 -0
  160. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/__init__.py +0 -0
  161. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/base.py +0 -0
  162. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/llama_index_llm.py +0 -0
  163. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/openai_llm.py +0 -0
  164. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/generator/vllm.py +0 -0
  165. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passageaugmenter/__init__.py +0 -0
  166. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passageaugmenter/pass_passage_augmenter.py +0 -0
  167. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passageaugmenter/prev_next_augmenter.py +0 -0
  168. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/__init__.py +0 -0
  169. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/base.py +0 -0
  170. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/longllmlingua.py +0 -0
  171. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/pass_compressor.py +0 -0
  172. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/refine.py +0 -0
  173. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagecompressor/tree_summarize.py +0 -0
  174. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/__init__.py +0 -0
  175. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/pass_passage_filter.py +0 -0
  176. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/percentile_cutoff.py +0 -0
  177. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/recency.py +0 -0
  178. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagefilter/threshold_cutoff.py +0 -0
  179. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/__init__.py +0 -0
  180. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/cohere.py +0 -0
  181. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/colbert.py +0 -0
  182. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/flag_embedding_llm.py +0 -0
  183. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/jina.py +0 -0
  184. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/koreranker.py +0 -0
  185. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/monot5.py +0 -0
  186. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/pass_reranker.py +0 -0
  187. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/rankgpt.py +0 -0
  188. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/sentence_transformer.py +0 -0
  189. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/tart/__init__.py +0 -0
  190. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/tart/modeling_enc_t5.py +0 -0
  191. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/tart/tart.py +0 -0
  192. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/tart/tokenization_enc_t5.py +0 -0
  193. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/passagereranker/time_reranker.py +0 -0
  194. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/promptmaker/__init__.py +0 -0
  195. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/promptmaker/base.py +0 -0
  196. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/promptmaker/fstring.py +0 -0
  197. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/promptmaker/long_context_reorder.py +0 -0
  198. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/__init__.py +0 -0
  199. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/hyde.py +0 -0
  200. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/multi_query_expansion.py +0 -0
  201. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/queryexpansion/pass_query_expansion.py +0 -0
  202. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/__init__.py +0 -0
  203. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/bm25.py +0 -0
  204. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/hybrid_cc.py +0 -0
  205. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/hybrid_dbsf.py +0 -0
  206. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/hybrid_rrf.py +0 -0
  207. {autorag-0.2.6 → autorag-0.2.8}/autorag/nodes/retrieval/hybrid_rsf.py +0 -0
  208. {autorag-0.2.6 → autorag-0.2.8}/autorag/schema/__init__.py +0 -0
  209. {autorag-0.2.6 → autorag-0.2.8}/autorag/schema/module.py +0 -0
  210. {autorag-0.2.6 → autorag-0.2.8}/autorag/schema/node.py +0 -0
  211. {autorag-0.2.6 → autorag-0.2.8}/autorag/strategy.py +0 -0
  212. {autorag-0.2.6 → autorag-0.2.8}/autorag/support.py +0 -0
  213. {autorag-0.2.6 → autorag-0.2.8}/autorag/utils/__init__.py +0 -0
  214. {autorag-0.2.6 → autorag-0.2.8}/autorag/utils/preprocess.py +0 -0
  215. {autorag-0.2.6 → autorag-0.2.8}/autorag/web.py +0 -0
  216. {autorag-0.2.6 → autorag-0.2.8}/docs/Makefile +0 -0
  217. {autorag-0.2.6 → autorag-0.2.8}/docs/make.bat +0 -0
  218. {autorag-0.2.6 → autorag-0.2.8}/docs/requirements.txt +0 -0
  219. {autorag-0.2.6 → autorag-0.2.8}/docs/source/CNAME +0 -0
  220. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/data_creation.png +0 -0
  221. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/data_folder.png +0 -0
  222. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/dcg.png +0 -0
  223. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/f1_score.png +0 -0
  224. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/map.png +0 -0
  225. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/mrr.png +0 -0
  226. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/ndcg.png +0 -0
  227. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/ndcg_formula.png +0 -0
  228. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/node_folder.png +0 -0
  229. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/node_line_folder.png +0 -0
  230. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/node_line_summary.png +0 -0
  231. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/node_lines.png +0 -0
  232. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/node_summary.png +0 -0
  233. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/normal_distribution.png +0 -0
  234. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/project_folder_example.png +0 -0
  235. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/project_folders.png +0 -0
  236. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/resources_folder.png +0 -0
  237. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/RAG_paradigms.png +0 -0
  238. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/advanced_RAG.png +0 -0
  239. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/cycle.png +0 -0
  240. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/merger.png +0 -0
  241. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/node_line_modular.png +0 -0
  242. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/roadmap/policy.png +0 -0
  243. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/samsung_sundae.jpeg +0 -0
  244. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/score_fusion.png +0 -0
  245. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/trial_folder.png +0 -0
  246. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/trial_json.png +0 -0
  247. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/trial_summary.png +0 -0
  248. {autorag-0.2.6 → autorag-0.2.8}/docs/source/_static/web_interface.png +0 -0
  249. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.data.corpus.rst +0 -0
  250. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.data.qacreation.rst +0 -0
  251. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.data.rst +0 -0
  252. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.data.utils.rst +0 -0
  253. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.generator.rst +0 -0
  254. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.passageaugmenter.rst +0 -0
  255. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.passagecompressor.rst +0 -0
  256. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.passagefilter.rst +0 -0
  257. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.passagereranker.rst +0 -0
  258. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.passagereranker.tart.rst +0 -0
  259. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.promptmaker.rst +0 -0
  260. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.queryexpansion.rst +0 -0
  261. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.retrieval.rst +0 -0
  262. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.nodes.rst +0 -0
  263. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.schema.rst +0 -0
  264. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/autorag.utils.rst +0 -0
  265. {autorag-0.2.6 → autorag-0.2.8}/docs/source/api_spec/modules.rst +0 -0
  266. {autorag-0.2.6 → autorag-0.2.8}/docs/source/conf.py +0 -0
  267. {autorag-0.2.6 → autorag-0.2.8}/docs/source/optimization/sample_full_config.yaml +0 -0
  268. {autorag-0.2.6 → autorag-0.2.8}/sample_config/compact_local.yaml +0 -0
  269. {autorag-0.2.6 → autorag-0.2.8}/sample_config/compact_openai.yaml +0 -0
  270. {autorag-0.2.6 → autorag-0.2.8}/sample_config/config_korean.yaml +0 -0
  271. {autorag-0.2.6 → autorag-0.2.8}/sample_config/extracted_sample.yaml +0 -0
  272. {autorag-0.2.6 → autorag-0.2.8}/sample_config/full.yaml +0 -0
  273. {autorag-0.2.6 → autorag-0.2.8}/sample_config/simple_local.yaml +0 -0
  274. {autorag-0.2.6 → autorag-0.2.8}/sample_config/simple_openai.yaml +0 -0
  275. {autorag-0.2.6 → autorag-0.2.8}/sample_dataset/README.md +0 -0
  276. {autorag-0.2.6 → autorag-0.2.8}/sample_dataset/eli5/load_eli5_dataset.py +0 -0
  277. {autorag-0.2.6 → autorag-0.2.8}/sample_dataset/hotpotqa/load_hotpotqa_dataset.py +0 -0
  278. {autorag-0.2.6 → autorag-0.2.8}/sample_dataset/msmarco/load_msmarco_dataset.py +0 -0
  279. {autorag-0.2.6 → autorag-0.2.8}/sample_dataset/triviaqa/load_triviaqa_dataset.py +0 -0
  280. {autorag-0.2.6 → autorag-0.2.8}/setup.cfg +0 -0
  281. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/corpus/test_base.py +0 -0
  282. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/corpus/test_langchain.py +0 -0
  283. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/corpus/test_llama_index_corpus.py +0 -0
  284. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/qacreation/test_base_qacreation.py +0 -0
  285. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/qacreation/test_llama_index_qacreation.py +0 -0
  286. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/qacreation/test_ragas_qa_creation.py +0 -0
  287. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/data/qacreation/test_simple.py +0 -0
  288. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/generator/test_generator_base.py +0 -0
  289. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/generator/test_llama_index_llm.py +0 -0
  290. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/generator/test_openai.py +0 -0
  291. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/generator/test_run_generator_node.py +0 -0
  292. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/generator/test_vllm.py +0 -0
  293. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passageaugmenter/test_base_passage_augmenter.py +0 -0
  294. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passageaugmenter/test_pass_passage_augmenter.py +0 -0
  295. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passageaugmenter/test_prev_next_augmenter.py +0 -0
  296. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_base_passage_compressor.py +0 -0
  297. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_longllmlingua.py +0 -0
  298. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_pass_compressor.py +0 -0
  299. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_refine.py +0 -0
  300. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagecompressor/test_tree_summarize.py +0 -0
  301. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_pass_passage_filter.py +0 -0
  302. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_passage_filter_base.py +0 -0
  303. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_percentile_cutoff.py +0 -0
  304. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_recency_filter.py +0 -0
  305. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_similarity_percentile_cutoff.py +0 -0
  306. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_similarity_threshold_cutoff.py +0 -0
  307. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagefilter/test_threshold_cutoff.py +0 -0
  308. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_cohere_reranker.py +0 -0
  309. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_colbert_reranker.py +0 -0
  310. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_flag_embedding.py +0 -0
  311. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_flag_embedding_llm.py +0 -0
  312. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_jina_reranker.py +0 -0
  313. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_koreranker.py +0 -0
  314. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_monot5.py +0 -0
  315. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_pass_reranker.py +0 -0
  316. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_passage_reranker_base.py +0 -0
  317. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_rankgpt.py +0 -0
  318. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_sentence_transformer.py +0 -0
  319. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_tart.py +0 -0
  320. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_time_reranker.py +0 -0
  321. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/passagereranker/test_upr.py +0 -0
  322. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/promptmaker/test_fstring.py +0 -0
  323. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/promptmaker/test_long_context_reorder.py +0 -0
  324. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/promptmaker/test_prompt_maker_base.py +0 -0
  325. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_hyde.py +0 -0
  326. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_multi_query_expansion.py +0 -0
  327. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_pass_query_expansion.py +0 -0
  328. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_query_decompose.py +0 -0
  329. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/queryexpansion/test_query_expansion_base.py +0 -0
  330. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_bm25.py +0 -0
  331. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_hybrid_base.py +0 -0
  332. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_hybrid_cc.py +0 -0
  333. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_hybrid_dbsf.py +0 -0
  334. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_hybrid_rrf.py +0 -0
  335. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_hybrid_rsf.py +0 -0
  336. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/nodes/retrieval/test_retrieval_base.py +0 -0
  337. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/schema/test_module_schema.py +0 -0
  338. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/schema/test_node_schema.py +0 -0
  339. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_cli.py +0 -0
  340. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_dashboard.py +0 -0
  341. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_deploy.py +0 -0
  342. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_evaluator.py +0 -0
  343. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_strategy.py +0 -0
  344. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_support.py +0 -0
  345. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/test_web.py +0 -0
  346. {autorag-0.2.6 → autorag-0.2.8}/tests/autorag/utils/test_preprocess.py +0 -0
  347. {autorag-0.2.6 → autorag-0.2.8}/tests/conftest.py +0 -0
  348. {autorag-0.2.6 → autorag-0.2.8}/tests/delete_tests.py +0 -0
  349. {autorag-0.2.6 → autorag-0.2.8}/tests/mock.py +0 -0
  350. {autorag-0.2.6 → autorag-0.2.8}/tests/requirements.txt +0 -0
  351. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/README.md +0 -0
  352. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/corpus_data_sample.parquet +0 -0
  353. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/data_creation/raw_dir/sample1.txt +0 -0
  354. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/data_creation/raw_dir/sample2.txt +0 -0
  355. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/data_creation/raw_dir/sample3.txt +0 -0
  356. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/full.yaml +0 -0
  357. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/qa_data_sample.parquet +0 -0
  358. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/qa_gen_prompts/prompt1.txt +0 -0
  359. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/qa_gen_prompts/prompt2.txt +0 -0
  360. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/qa_gen_prompts/prompt3.txt +0 -0
  361. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/qa_test_data_sample.parquet +0 -0
  362. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/config.yaml +0 -0
  363. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/0.parquet +0 -0
  364. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/1.parquet +0 -0
  365. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/2.parquet +0 -0
  366. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/3.parquet +0 -0
  367. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/4.parquet +0 -0
  368. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/5.parquet +0 -0
  369. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/best_5.parquet +0 -0
  370. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/generator/summary.csv +0 -0
  371. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/prompt_maker/0.parquet +0 -0
  372. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/prompt_maker/1.parquet +0 -0
  373. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/prompt_maker/best_0.parquet +0 -0
  374. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/prompt_maker/summary.csv +0 -0
  375. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/post_retrieve_node_line/summary.csv +0 -0
  376. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/query_expansion/0.parquet +0 -0
  377. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/query_expansion/1.parquet +0 -0
  378. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/query_expansion/2.parquet +0 -0
  379. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/query_expansion/best_0.parquet +0 -0
  380. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/query_expansion/summary.csv +0 -0
  381. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/pre_retrieve_node_line/summary.csv +0 -0
  382. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_compressor/0.parquet +0 -0
  383. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_compressor/best_0.parquet +0 -0
  384. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_compressor/summary.csv +0 -0
  385. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_reranker/0.parquet +0 -0
  386. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_reranker/1.parquet +0 -0
  387. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_reranker/best_0.parquet +0 -0
  388. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/passage_reranker/summary.csv +0 -0
  389. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/retrieval/0.parquet +0 -0
  390. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/retrieval/1.parquet +0 -0
  391. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/retrieval/best_0.parquet +0 -0
  392. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/retrieval/summary.csv +0 -0
  393. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/retrieve_node_line/summary.csv +0 -0
  394. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/0/summary.csv +0 -0
  395. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/config.yaml +0 -0
  396. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/query_expansion/0.parquet +0 -0
  397. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/query_expansion/1.parquet +0 -0
  398. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/query_expansion/2.parquet +0 -0
  399. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/query_expansion/best_0.parquet +0 -0
  400. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/query_expansion/summary.csv +0 -0
  401. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/pre_retrieve_node_line/summary.csv +0 -0
  402. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/passage_filter/0.parquet +0 -0
  403. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/passage_reranker/0.parquet +0 -0
  404. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/passage_reranker/1.parquet +0 -0
  405. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/passage_reranker/best_0.parquet +0 -0
  406. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/passage_reranker/summary.csv +0 -0
  407. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/retrieval/0.parquet +0 -0
  408. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/retrieval/1.parquet +0 -0
  409. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/retrieval/best_0.parquet +0 -0
  410. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/1/retrieve_node_line/retrieval/summary.csv +0 -0
  411. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/config.yaml +0 -0
  412. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/post_retrieve_node_line/prompt_maker/0.parquet +0 -0
  413. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/query_expansion/0.parquet +0 -0
  414. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/query_expansion/1.parquet +0 -0
  415. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/query_expansion/2.parquet +0 -0
  416. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/query_expansion/best_0.parquet +0 -0
  417. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/query_expansion/summary.csv +0 -0
  418. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/pre_retrieve_node_line/summary.csv +0 -0
  419. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_compressor/0.parquet +0 -0
  420. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_compressor/best_0.parquet +0 -0
  421. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_compressor/summary.csv +0 -0
  422. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_reranker/0.parquet +0 -0
  423. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_reranker/1.parquet +0 -0
  424. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_reranker/best_0.parquet +0 -0
  425. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/passage_reranker/summary.csv +0 -0
  426. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/retrieval/0.parquet +0 -0
  427. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/retrieval/1.parquet +0 -0
  428. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/retrieval/best_0.parquet +0 -0
  429. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/retrieval/summary.csv +0 -0
  430. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/2/retrieve_node_line/summary.csv +0 -0
  431. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/3/config.yaml +0 -0
  432. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/best.yaml +0 -0
  433. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/data/corpus.parquet +0 -0
  434. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/data/qa.parquet +0 -0
  435. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/bm25_porter_stemmer.pkl +0 -0
  436. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/chroma/6595d304-5270-4d9f-a267-c191366804ce/data_level0.bin +0 -0
  437. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/chroma/6595d304-5270-4d9f-a267-c191366804ce/header.bin +0 -0
  438. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/chroma/6595d304-5270-4d9f-a267-c191366804ce/length.bin +0 -0
  439. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/chroma/6595d304-5270-4d9f-a267-c191366804ce/link_lists.bin +0 -0
  440. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/resources/chroma/chroma.sqlite3 +0 -0
  441. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/result_project/trial.json +0 -0
  442. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/sample_contents_nqa.csv +0 -0
  443. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/sample_project/data/corpus.parquet +0 -0
  444. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/sample_project/data/qa.parquet +0 -0
  445. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/sample_project/resources/bm25_gpt2.pkl +0 -0
  446. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/sample_project/resources/bm25_porter_stemmer.pkl +0 -0
  447. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/simple.yaml +0 -0
  448. {autorag-0.2.6 → autorag-0.2.8}/tests/resources/test_bm25_retrieval.pkl +0 -0
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.1
2
2
  Name: AutoRAG
3
- Version: 0.2.6
3
+ Version: 0.2.8
4
4
  Summary: Automatically Evaluate RAG pipelines with your own data. Find optimal structure for new RAG product.
5
5
  Author-email: Marker-Inc <vkehfdl1@gmail.com>
6
6
  License: Apache License
@@ -210,16 +210,17 @@ Keywords: RAG,AutoRAG,autorag,rag-evaluation,evaluation,rag-auto,AutoML,AutoML-R
210
210
  Classifier: Intended Audience :: Developers
211
211
  Classifier: Intended Audience :: Information Technology
212
212
  Classifier: Intended Audience :: Science/Research
213
- Classifier: Programming Language :: Python :: 3.8
214
213
  Classifier: Programming Language :: Python :: 3.9
215
214
  Classifier: Programming Language :: Python :: 3.10
215
+ Classifier: Programming Language :: Python :: 3.11
216
+ Classifier: Programming Language :: Python :: 3.12
216
217
  Classifier: Topic :: Scientific/Engineering :: Artificial Intelligence
217
218
  Classifier: Topic :: Software Development :: Libraries
218
219
  Classifier: Topic :: Software Development :: Libraries :: Python Modules
219
220
  Requires-Python: >=3.8
220
221
  Description-Content-Type: text/markdown
221
222
  License-File: LICENSE
222
- Requires-Dist: numpy
223
+ Requires-Dist: numpy<2.0.0
223
224
  Requires-Dist: pandas
224
225
  Requires-Dist: tqdm
225
226
  Requires-Dist: tiktoken>=0.7.0
@@ -248,11 +249,11 @@ Requires-Dist: bert_score
248
249
  Requires-Dist: sentence-transformers
249
250
  Requires-Dist: FlagEmbedding
250
251
  Requires-Dist: ragas
251
- Requires-Dist: ray
252
252
  Requires-Dist: kiwipiepy
253
253
  Requires-Dist: llmlingua
254
254
  Requires-Dist: llama-index>=0.10.1
255
255
  Requires-Dist: llama-index-core>=0.10.1
256
+ Requires-Dist: llama-index-readers-file
256
257
  Requires-Dist: llama-index-embeddings-openai
257
258
  Requires-Dist: llama-index-embeddings-huggingface
258
259
  Requires-Dist: llama-index-llms-openai
@@ -504,11 +505,11 @@ autorag run_web --trial_path your/path/to/trial_path
504
505
 
505
506
  <img width="1491" alt="web_interface" src="https://github.com/Marker-Inc-Korea/AutoRAG/assets/96727832/f6b00353-f6bb-4d8f-8740-1c264c0acbb8">
506
507
 
507
- # Star History
508
+ # Star History
508
509
 
509
510
  [![Star History Chart](https://api.star-history.com/svg?repos=Marker-Inc-Korea/AutoRAG&type=Date)](https://star-history.com/#Marker-Inc-Korea/AutoRAG&Date)
510
511
 
511
- # Contributors
512
+ # Contributors
512
513
 
513
514
  Thanks go to these wonderful people:
514
515
 
@@ -38,20 +38,20 @@ autorag/data/qacreation/ragas.py
38
38
  autorag/data/qacreation/simple.py
39
39
  autorag/data/utils/__init__.py
40
40
  autorag/data/utils/util.py
41
- autorag/evaluate/__init__.py
42
- autorag/evaluate/generation.py
43
- autorag/evaluate/retrieval.py
44
- autorag/evaluate/retrieval_contents.py
45
- autorag/evaluate/util.py
46
- autorag/evaluate/metric/__init__.py
47
- autorag/evaluate/metric/generation.py
48
- autorag/evaluate/metric/retrieval.py
49
- autorag/evaluate/metric/retrieval_contents.py
50
- autorag/evaluate/metric/util.py
51
- autorag/evaluate/metric/g_eval_prompts/coh_detailed.txt
52
- autorag/evaluate/metric/g_eval_prompts/con_detailed.txt
53
- autorag/evaluate/metric/g_eval_prompts/flu_detailed.txt
54
- autorag/evaluate/metric/g_eval_prompts/rel_detailed.txt
41
+ autorag/evaluation/__init__.py
42
+ autorag/evaluation/generation.py
43
+ autorag/evaluation/retrieval.py
44
+ autorag/evaluation/retrieval_contents.py
45
+ autorag/evaluation/util.py
46
+ autorag/evaluation/metric/__init__.py
47
+ autorag/evaluation/metric/generation.py
48
+ autorag/evaluation/metric/retrieval.py
49
+ autorag/evaluation/metric/retrieval_contents.py
50
+ autorag/evaluation/metric/util.py
51
+ autorag/evaluation/metric/g_eval_prompts/coh_detailed.txt
52
+ autorag/evaluation/metric/g_eval_prompts/con_detailed.txt
53
+ autorag/evaluation/metric/g_eval_prompts/flu_detailed.txt
54
+ autorag/evaluation/metric/g_eval_prompts/rel_detailed.txt
55
55
  autorag/nodes/__init__.py
56
56
  autorag/nodes/generator/__init__.py
57
57
  autorag/nodes/generator/base.py
@@ -170,8 +170,8 @@ docs/source/api_spec/autorag.data.corpus.rst
170
170
  docs/source/api_spec/autorag.data.qacreation.rst
171
171
  docs/source/api_spec/autorag.data.rst
172
172
  docs/source/api_spec/autorag.data.utils.rst
173
- docs/source/api_spec/autorag.evaluate.metric.rst
174
- docs/source/api_spec/autorag.evaluate.rst
173
+ docs/source/api_spec/autorag.evaluation.metric.rst
174
+ docs/source/api_spec/autorag.evaluation.rst
175
175
  docs/source/api_spec/autorag.nodes.generator.rst
176
176
  docs/source/api_spec/autorag.nodes.passageaugmenter.rst
177
177
  docs/source/api_spec/autorag.nodes.passagecompressor.rst
@@ -1,4 +1,4 @@
1
- numpy
1
+ numpy<2.0.0
2
2
  pandas
3
3
  tqdm
4
4
  tiktoken>=0.7.0
@@ -27,11 +27,11 @@ bert_score
27
27
  sentence-transformers
28
28
  FlagEmbedding
29
29
  ragas
30
- ray
31
30
  kiwipiepy
32
31
  llmlingua
33
32
  llama-index>=0.10.1
34
33
  llama-index-core>=0.10.1
34
+ llama-index-readers-file
35
35
  llama-index-embeddings-openai
36
36
  llama-index-embeddings-huggingface
37
37
  llama-index-llms-openai
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.1
2
2
  Name: AutoRAG
3
- Version: 0.2.6
3
+ Version: 0.2.8
4
4
  Summary: Automatically Evaluate RAG pipelines with your own data. Find optimal structure for new RAG product.
5
5
  Author-email: Marker-Inc <vkehfdl1@gmail.com>
6
6
  License: Apache License
@@ -210,16 +210,17 @@ Keywords: RAG,AutoRAG,autorag,rag-evaluation,evaluation,rag-auto,AutoML,AutoML-R
210
210
  Classifier: Intended Audience :: Developers
211
211
  Classifier: Intended Audience :: Information Technology
212
212
  Classifier: Intended Audience :: Science/Research
213
- Classifier: Programming Language :: Python :: 3.8
214
213
  Classifier: Programming Language :: Python :: 3.9
215
214
  Classifier: Programming Language :: Python :: 3.10
215
+ Classifier: Programming Language :: Python :: 3.11
216
+ Classifier: Programming Language :: Python :: 3.12
216
217
  Classifier: Topic :: Scientific/Engineering :: Artificial Intelligence
217
218
  Classifier: Topic :: Software Development :: Libraries
218
219
  Classifier: Topic :: Software Development :: Libraries :: Python Modules
219
220
  Requires-Python: >=3.8
220
221
  Description-Content-Type: text/markdown
221
222
  License-File: LICENSE
222
- Requires-Dist: numpy
223
+ Requires-Dist: numpy<2.0.0
223
224
  Requires-Dist: pandas
224
225
  Requires-Dist: tqdm
225
226
  Requires-Dist: tiktoken>=0.7.0
@@ -248,11 +249,11 @@ Requires-Dist: bert_score
248
249
  Requires-Dist: sentence-transformers
249
250
  Requires-Dist: FlagEmbedding
250
251
  Requires-Dist: ragas
251
- Requires-Dist: ray
252
252
  Requires-Dist: kiwipiepy
253
253
  Requires-Dist: llmlingua
254
254
  Requires-Dist: llama-index>=0.10.1
255
255
  Requires-Dist: llama-index-core>=0.10.1
256
+ Requires-Dist: llama-index-readers-file
256
257
  Requires-Dist: llama-index-embeddings-openai
257
258
  Requires-Dist: llama-index-embeddings-huggingface
258
259
  Requires-Dist: llama-index-llms-openai
@@ -504,11 +505,11 @@ autorag run_web --trial_path your/path/to/trial_path
504
505
 
505
506
  <img width="1491" alt="web_interface" src="https://github.com/Marker-Inc-Korea/AutoRAG/assets/96727832/f6b00353-f6bb-4d8f-8740-1c264c0acbb8">
506
507
 
507
- # Star History
508
+ # Star History
508
509
 
509
510
  [![Star History Chart](https://api.star-history.com/svg?repos=Marker-Inc-Korea/AutoRAG&type=Date)](https://star-history.com/#Marker-Inc-Korea/AutoRAG&Date)
510
511
 
511
- # Contributors
512
+ # Contributors
512
513
 
513
514
  Thanks go to these wonderful people:
514
515
 
@@ -234,11 +234,11 @@ autorag run_web --trial_path your/path/to/trial_path
234
234
 
235
235
  <img width="1491" alt="web_interface" src="https://github.com/Marker-Inc-Korea/AutoRAG/assets/96727832/f6b00353-f6bb-4d8f-8740-1c264c0acbb8">
236
236
 
237
- # Star History
237
+ # Star History
238
238
 
239
239
  [![Star History Chart](https://api.star-history.com/svg?repos=Marker-Inc-Korea/AutoRAG&type=Date)](https://star-history.com/#Marker-Inc-Korea/AutoRAG&Date)
240
240
 
241
- # Contributors
241
+ # Contributors
242
242
 
243
243
  Thanks go to these wonderful people:
244
244
 
@@ -0,0 +1 @@
1
+ 0.2.8
@@ -77,7 +77,7 @@ def node_view(node_dir: str):
77
77
  'float': NumberFormatter(format='0.000'),
78
78
  'bool': BooleanFormatter(),
79
79
  }
80
- first_df = pd.read_parquet(os.path.join(node_dir, '0.parquet'))
80
+ first_df = pd.read_parquet(os.path.join(node_dir, '0.parquet'), engine='pyarrow')
81
81
 
82
82
  each_module_df_widget = pn.widgets.Tabulator(pd.DataFrame(columns=first_df.columns), name='Module DataFrame',
83
83
  formatters=bokeh_formatters,
@@ -87,7 +87,7 @@ def node_view(node_dir: str):
87
87
  if event.column == 'detail':
88
88
  filename = summary_df['filename'].iloc[event.row]
89
89
  filepath = os.path.join(node_dir, filename)
90
- each_module_df = pd.read_parquet(filepath)
90
+ each_module_df = pd.read_parquet(filepath, engine='pyarrow')
91
91
  each_module_df_widget.value = each_module_df
92
92
 
93
93
  df_widget = pn.widgets.Tabulator(summary_df, name='Summary DataFrame', formatters=bokeh_formatters,
@@ -4,8 +4,8 @@ from typing import List, Callable, Union, Dict
4
4
 
5
5
  import pandas as pd
6
6
 
7
- from autorag.evaluate.metric.generation import bleu, meteor, rouge, sem_score, g_eval, bert_score
8
- from autorag.evaluate.util import cast_metrics
7
+ from autorag.evaluation.metric.generation import bleu, meteor, rouge, sem_score, g_eval, bert_score
8
+ from autorag.evaluation.util import cast_metrics
9
9
 
10
10
  GENERATION_METRIC_FUNC_DICT = {func.__name__: func for func in
11
11
  [bleu, meteor, rouge, sem_score, g_eval, bert_score]}
@@ -15,12 +15,13 @@ from rouge_score import tokenizers
15
15
  from rouge_score.rouge_scorer import RougeScorer
16
16
 
17
17
  from autorag import embedding_models
18
- from autorag.evaluate.metric.util import calculate_cosine_similarity
19
- from autorag.utils.util import process_batch, openai_truncate_by_token
18
+ from autorag.evaluation.metric.util import calculate_cosine_similarity
19
+ from autorag.utils.util import process_batch, openai_truncate_by_token, convert_inputs_to_list
20
20
 
21
21
 
22
22
  def generation_metric(func):
23
23
  @functools.wraps(func)
24
+ @convert_inputs_to_list
24
25
  def wrapper(generation_gt: List[List[str]], generations: List[str], **kwargs) -> List[float]:
25
26
  """
26
27
  Compute generation metric.
@@ -39,6 +40,7 @@ def generation_metric(func):
39
40
  return wrapper
40
41
 
41
42
 
43
+ @convert_inputs_to_list
42
44
  def huggingface_evaluate(instance, key: str,
43
45
  generation_gt: List[List[str]], generations: List[str],
44
46
  **kwargs) -> List[float]:
@@ -70,6 +72,7 @@ def bleu(gt: List[str], pred: str, **kwargs) -> float:
70
72
  return sacrebleu.sentence_bleu(pred, gt, **kwargs).score
71
73
 
72
74
 
75
+ @convert_inputs_to_list
73
76
  def meteor(generation_gt: List[List[str]], generations: List[str],
74
77
  alpha: float = 0.9,
75
78
  beta: float = 3.0,
@@ -97,6 +100,7 @@ def meteor(generation_gt: List[List[str]], generations: List[str],
97
100
  return result
98
101
 
99
102
 
103
+ @convert_inputs_to_list
100
104
  def rouge(generation_gt: List[List[str]], generations: List[str],
101
105
  rouge_type: Optional[str] = 'rougeL',
102
106
  use_stemmer: bool = False,
@@ -141,6 +145,7 @@ def rouge(generation_gt: List[List[str]], generations: List[str],
141
145
  return result
142
146
 
143
147
 
148
+ @convert_inputs_to_list
144
149
  def sem_score(generation_gt: List[List[str]], generations: List[str],
145
150
  embedding_model: Optional[BaseEmbedding] = None,
146
151
  batch: int = 128) -> List[float]:
@@ -194,6 +199,7 @@ def sem_score(generation_gt: List[List[str]], generations: List[str],
194
199
  return result
195
200
 
196
201
 
202
+ @convert_inputs_to_list
197
203
  def g_eval(generation_gt: List[List[str]], generations: List[str],
198
204
  metrics: Optional[List[str]] = None,
199
205
  model: str = 'gpt-4-0125-preview',
@@ -283,6 +289,7 @@ async def async_g_eval(generation_gt: List[str], pred: str,
283
289
  return sum(g_eval_scores) / len(g_eval_scores)
284
290
 
285
291
 
292
+ @convert_inputs_to_list
286
293
  def bert_score(generation_gt: List[List[str]], generations: List[str],
287
294
  lang: str = 'en',
288
295
  batch: int = 128,
@@ -1,11 +1,15 @@
1
1
  import functools
2
2
  import itertools
3
- import math
4
3
  from typing import List
5
4
 
5
+ import math
6
+
7
+ from autorag.utils.util import convert_inputs_to_list
8
+
6
9
 
7
10
  def retrieval_metric(func):
8
11
  @functools.wraps(func)
12
+ @convert_inputs_to_list
9
13
  def wrapper(retrieval_gt: List[List[List[str]]], pred_ids: List[List[str]]) -> List[float]:
10
14
  results = []
11
15
  for gt, pred in zip(retrieval_gt, pred_ids):
@@ -9,11 +9,12 @@ from typing import List
9
9
 
10
10
  import numpy as np
11
11
 
12
- from autorag.utils.util import normalize_string
12
+ from autorag.utils.util import normalize_string, convert_inputs_to_list
13
13
 
14
14
 
15
15
  def retrieval_contents_metric(func):
16
16
  @functools.wraps(func)
17
+ @convert_inputs_to_list
17
18
  def wrapper(gt_contents: List[List[str]], pred_contents: List[List[str]]) -> List[float]:
18
19
  results = []
19
20
  for gt, pred in zip(gt_contents, pred_contents):
@@ -4,9 +4,10 @@ from typing import List, Callable, Any, Tuple, Optional, Union, Dict
4
4
 
5
5
  import pandas as pd
6
6
 
7
- from autorag.evaluate.metric import (retrieval_recall, retrieval_precision, retrieval_f1, retrieval_ndcg, retrieval_mrr,
8
- retrieval_map)
9
- from autorag.evaluate.util import cast_metrics
7
+ from autorag.evaluation.metric import (retrieval_recall, retrieval_precision, retrieval_f1, retrieval_ndcg,
8
+ retrieval_mrr,
9
+ retrieval_map)
10
+ from autorag.evaluation.util import cast_metrics
10
11
 
11
12
  RETRIEVAL_METRIC_FUNC_DICT = {func.__name__: func for func in
12
13
  [retrieval_recall, retrieval_precision, retrieval_f1, retrieval_ndcg, retrieval_mrr,
@@ -3,7 +3,7 @@ from typing import List, Callable, Any, Tuple
3
3
 
4
4
  import pandas as pd
5
5
 
6
- from autorag.evaluate.metric import retrieval_token_f1, retrieval_token_precision, retrieval_token_recall
6
+ from autorag.evaluation.metric import retrieval_token_f1, retrieval_token_precision, retrieval_token_recall
7
7
 
8
8
 
9
9
  def evaluate_retrieval_contents(retrieval_gt: List[List[str]], metrics: List[str]):
@@ -56,8 +56,8 @@ class Evaluator:
56
56
  raise ValueError(f"QA data path {qa_data_path} is not a parquet file.")
57
57
  if not corpus_data_path.endswith('.parquet'):
58
58
  raise ValueError(f"Corpus data path {corpus_data_path} is not a parquet file.")
59
- self.qa_data = pd.read_parquet(qa_data_path)
60
- self.corpus_data = pd.read_parquet(corpus_data_path)
59
+ self.qa_data = pd.read_parquet(qa_data_path, engine='pyarrow')
60
+ self.corpus_data = pd.read_parquet(corpus_data_path, engine='pyarrow')
61
61
  self.qa_data = cast_qa_dataset(self.qa_data)
62
62
  self.corpus_data = cast_corpus_dataset(self.corpus_data)
63
63
  self.project_dir = project_dir if project_dir is not None else os.getcwd()
@@ -184,7 +184,7 @@ class Evaluator:
184
184
  def _load_node_lines(yaml_path: str) -> Dict[str, List[Node]]:
185
185
  if not os.path.exists(yaml_path):
186
186
  raise ValueError(f"YAML file {yaml_path} does not exist.")
187
- with open(yaml_path, 'r') as stream:
187
+ with open(yaml_path, 'r', encoding='utf-8') as stream:
188
188
  try:
189
189
  yaml_dict = yaml.safe_load(stream)
190
190
  except yaml.YAMLError as exc:
@@ -299,7 +299,7 @@ class Evaluator:
299
299
 
300
300
  previous_node_dir = os.path.join(trial_path, previous_node_line, previous_node)
301
301
  best_file_pattern = f'{previous_node_dir}/best_*.parquet'
302
- previous_result = pd.read_parquet(glob.glob(best_file_pattern)[0])
302
+ previous_result = pd.read_parquet(glob.glob(best_file_pattern)[0], engine='pyarrow')
303
303
  return previous_result
304
304
 
305
305
  @staticmethod
@@ -38,7 +38,7 @@ def run_node_line(nodes: List[Node],
38
38
  qa_path = os.path.join(project_dir, "data", "qa.parquet")
39
39
  if not os.path.exists(qa_path):
40
40
  raise ValueError(f"qa.parquet does not exist in {qa_path}.")
41
- previous_result = pd.read_parquet(qa_path)
41
+ previous_result = pd.read_parquet(qa_path, engine='pyarrow')
42
42
 
43
43
  summary_lst = []
44
44
  for node in nodes:
@@ -4,8 +4,8 @@ from typing import Callable, List, Dict, Union
4
4
 
5
5
  import pandas as pd
6
6
 
7
- from autorag.evaluate import evaluate_generation
8
- from autorag.evaluate.util import cast_metrics
7
+ from autorag.evaluation import evaluate_generation
8
+ from autorag.evaluation.util import cast_metrics
9
9
  from autorag.strategy import measure_speed, filter_by_threshold, select_best
10
10
 
11
11
 
@@ -35,7 +35,7 @@ def run_generator_node(modules: List[Callable],
35
35
  node_dir = os.path.join(node_line_dir, "generator") # node name
36
36
  if not os.path.exists(node_dir):
37
37
  os.makedirs(node_dir)
38
- qa_data = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"))
38
+ qa_data = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"), engine='pyarrow')
39
39
  if 'generation_gt' not in qa_data.columns:
40
40
  raise ValueError("You must have 'generation_gt' column in qa.parquet.")
41
41
  generation_gt = list(map(lambda x: x.tolist(), qa_data['generation_gt'].tolist()))
@@ -51,7 +51,8 @@ def run_generator_node(modules: List[Callable],
51
51
  metric_names, metric_params = cast_metrics(strategies.get('metrics'))
52
52
  if metric_names is None or len(metric_names) <= 0:
53
53
  raise ValueError("You must at least one metrics for generator evaluation.")
54
- results = list(map(lambda result: evaluate_generator_node(result, generation_gt, strategies.get('metrics')), results))
54
+ results = list(
55
+ map(lambda result: evaluate_generator_node(result, generation_gt, strategies.get('metrics')), results))
55
56
 
56
57
  # save results to folder
57
58
  filepaths = list(map(lambda x: os.path.join(node_dir, f'{x}.parquet'), range(len(modules))))
@@ -1,5 +1,4 @@
1
1
  import functools
2
- import itertools
3
2
  import logging
4
3
  import os
5
4
  from pathlib import Path
@@ -7,13 +6,12 @@ from typing import List, Union, Tuple
7
6
 
8
7
  import numpy as np
9
8
  import pandas as pd
10
- import torch
11
9
 
12
10
  from autorag import embedding_models
13
- from autorag.evaluate.metric.util import calculate_cosine_similarity
11
+ from autorag.evaluation.metric.util import calculate_cosine_similarity
14
12
  from autorag.utils import (result_to_dataframe, validate_qa_dataset, fetch_contents, sort_by_scores,
15
13
  validate_corpus_dataset, cast_corpus_dataset)
16
- from autorag.utils.util import reconstruct_list, filter_dict_keys, select_top_k
14
+ from autorag.utils.util import filter_dict_keys, select_top_k, embedding_query_content
17
15
 
18
16
  logger = logging.getLogger("AutoRAG")
19
17
 
@@ -37,7 +35,7 @@ def passage_augmenter_node(func):
37
35
  assert "retrieved_ids" in previous_result.columns, "previous_result must have retrieved_ids column."
38
36
  ids = previous_result["retrieved_ids"].tolist()
39
37
 
40
- corpus_df = pd.read_parquet(os.path.join(data_dir, "corpus.parquet"))
38
+ corpus_df = pd.read_parquet(os.path.join(data_dir, "corpus.parquet"), engine='pyarrow')
41
39
  validate_corpus_dataset(corpus_df)
42
40
 
43
41
  # get top_k
@@ -59,8 +57,9 @@ def passage_augmenter_node(func):
59
57
 
60
58
  # set embedding model for getting scores
61
59
  embedding_model_str = kwargs.pop("embedding_model", 'openai')
60
+ embedding_model = embedding_models[embedding_model_str]
62
61
  query_embeddings, contents_embeddings = embedding_query_content(queries, augmented_contents,
63
- embedding_model_str, batch=128)
62
+ embedding_model, batch=128)
64
63
 
65
64
  # get scores from calculated cosine similarity
66
65
  augmented_scores = [
@@ -87,22 +86,3 @@ def passage_augmenter_node(func):
87
86
  return results['contents'].tolist(), results['ids'].tolist(), results['scores'].tolist()
88
87
 
89
88
  return wrapper
90
-
91
-
92
- def embedding_query_content(queries: List[str], contents_list: List[List[str]],
93
- embedding_model: str, batch: int = 128):
94
- embedding_model = embedding_models[embedding_model]
95
-
96
- # Embedding using batch
97
- embedding_model.embed_batch_size = batch
98
- query_embeddings = embedding_model.get_text_embedding_batch(queries)
99
-
100
- content_lengths = list(map(len, contents_list))
101
- content_embeddings_flatten = embedding_model.get_text_embedding_batch(list(
102
- itertools.chain.from_iterable(contents_list)))
103
- content_embeddings = reconstruct_list(content_embeddings_flatten, content_lengths)
104
-
105
- del embedding_model
106
- if torch.cuda.is_available():
107
- torch.cuda.empty_cache()
108
- return query_embeddings, content_embeddings
@@ -20,7 +20,7 @@ def run_passage_augmenter_node(modules: List[Callable],
20
20
  if not os.path.exists(node_line_dir):
21
21
  os.makedirs(node_line_dir)
22
22
  project_dir = pathlib.PurePath(node_line_dir).parent.parent
23
- qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"))
23
+ qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"), engine='pyarrow')
24
24
  retrieval_gt = qa_df['retrieval_gt'].tolist()
25
25
  retrieval_gt = [[[str(uuid) for uuid in sub_array] if sub_array.size > 0 else [] for sub_array in inner_array]
26
26
  for inner_array in retrieval_gt]
@@ -5,7 +5,7 @@ from typing import Callable, List, Dict
5
5
 
6
6
  import pandas as pd
7
7
 
8
- from autorag.evaluate.metric import retrieval_token_recall, retrieval_token_precision, retrieval_token_f1
8
+ from autorag.evaluation.metric import retrieval_token_recall, retrieval_token_precision, retrieval_token_f1
9
9
  from autorag.strategy import measure_speed, filter_by_threshold, select_best
10
10
  from autorag.utils.util import fetch_contents
11
11
 
@@ -40,8 +40,8 @@ def run_passage_compressor_node(modules: List[Callable],
40
40
  os.makedirs(save_dir)
41
41
 
42
42
  # make retrieval contents gt
43
- qa_data = pd.read_parquet(os.path.join(data_dir, "qa.parquet"))
44
- corpus_data = pd.read_parquet(os.path.join(data_dir, "corpus.parquet"))
43
+ qa_data = pd.read_parquet(os.path.join(data_dir, "qa.parquet"), engine='pyarrow')
44
+ corpus_data = pd.read_parquet(os.path.join(data_dir, "corpus.parquet"), engine='pyarrow')
45
45
  # check qa_data have retrieval_gt
46
46
  assert all(len(x[0]) > 0 for x in qa_data['retrieval_gt'].tolist()), \
47
47
  "Can't use passage compressor if you don't have retrieval gt values in QA dataset."
@@ -39,7 +39,7 @@ def passage_filter_node(func):
39
39
  ids = previous_result["retrieved_ids"].tolist()
40
40
 
41
41
  if func.__name__ == 'recency_filter':
42
- corpus_df = pd.read_parquet(os.path.join(project_dir, "data", "corpus.parquet"))
42
+ corpus_df = pd.read_parquet(os.path.join(project_dir, "data", "corpus.parquet"), engine='pyarrow')
43
43
  metadatas = fetch_contents(corpus_df, ids, column_name='metadata')
44
44
  times = [[time['last_modified_datetime'] for time in time_list] for time_list in metadatas]
45
45
  filtered_contents, filtered_ids, filtered_scores \
@@ -30,7 +30,7 @@ def run_passage_filter_node(modules: List[Callable],
30
30
  if not os.path.exists(node_line_dir):
31
31
  os.makedirs(node_line_dir)
32
32
  project_dir = pathlib.PurePath(node_line_dir).parent.parent
33
- qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"))
33
+ qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"), engine='pyarrow')
34
34
  retrieval_gt = qa_df['retrieval_gt'].tolist()
35
35
  retrieval_gt = [[[str(uuid) for uuid in sub_array] if sub_array.size > 0 else [] for sub_array in inner_array]
36
36
  for inner_array in retrieval_gt]
@@ -3,7 +3,8 @@ from typing import List, Tuple, Optional
3
3
  import numpy as np
4
4
  import torch.cuda
5
5
 
6
- from autorag.evaluate.metric.util import calculate_cosine_similarity
6
+ from autorag import embedding_models
7
+ from autorag.evaluation.metric.util import calculate_cosine_similarity
7
8
  from autorag.nodes.passagefilter.base import passage_filter_node
8
9
  from autorag.nodes.passagefilter.similarity_threshold_cutoff import embedding_query_content
9
10
 
@@ -31,7 +32,13 @@ def similarity_percentile_cutoff(queries: List[str], contents_list: List[List[st
31
32
  Default is 128.
32
33
  :return: Tuple of lists containing the filtered contents, ids, and scores
33
34
  """
34
- query_embeddings, content_embeddings = embedding_query_content(queries, contents_list, embedding_model, batch)
35
+ if embedding_model is None:
36
+ embedding_model = embedding_models['openai']
37
+ else:
38
+ embedding_model = embedding_models[embedding_model]
39
+
40
+ query_embeddings, content_embeddings = embedding_query_content(queries, contents_list, embedding_model,
41
+ batch)
35
42
 
36
43
  results = list(map(lambda x: similarity_percentile_cutoff_pure(x[0], x[1], x[2], x[3], x[4], percentile),
37
44
  zip(query_embeddings, content_embeddings, contents_list, ids_list, scores_list)))
@@ -1,13 +1,12 @@
1
- import itertools
2
1
  from typing import List, Tuple, Optional
3
2
 
4
3
  import numpy as np
5
4
  import torch.cuda
6
5
 
7
6
  from autorag import embedding_models
8
- from autorag.evaluate.metric.util import calculate_cosine_similarity
7
+ from autorag.evaluation.metric.util import calculate_cosine_similarity
9
8
  from autorag.nodes.passagefilter.base import passage_filter_node
10
- from autorag.utils.util import reconstruct_list
9
+ from autorag.utils.util import embedding_query_content
11
10
 
12
11
 
13
12
  @passage_filter_node
@@ -33,6 +32,11 @@ def similarity_threshold_cutoff(queries: List[str], contents_list: List[List[str
33
32
  Default is 128.
34
33
  :return: Tuple of lists containing the filtered contents, ids, and scores
35
34
  """
35
+ if embedding_model is None:
36
+ embedding_model = embedding_models['openai']
37
+ else:
38
+ embedding_model = embedding_models[embedding_model]
39
+
36
40
  query_embeddings, content_embeddings = embedding_query_content(queries, contents_list, embedding_model, batch)
37
41
 
38
42
  remain_indices = list(map(lambda x: similarity_threshold_cutoff_pure(x[0], x[1], threshold),
@@ -68,21 +72,3 @@ def similarity_threshold_cutoff_pure(query_embedding: str,
68
72
  if len(result) > 0:
69
73
  return result
70
74
  return [np.argmax(similarities)]
71
-
72
-
73
- def embedding_query_content(queries: List[str], contents_list: List[List[str]],
74
- embedding_model: Optional[str] = None, batch: int = 128):
75
- if embedding_model is None:
76
- embedding_model = embedding_models['openai']
77
- else:
78
- embedding_model = embedding_models[embedding_model]
79
-
80
- # Embedding using batch
81
- embedding_model.embed_batch_size = batch
82
- query_embeddings = embedding_model.get_text_embedding_batch(queries)
83
-
84
- content_lengths = list(map(len, contents_list))
85
- content_embeddings_flatten = embedding_model.get_text_embedding_batch(list(
86
- itertools.chain.from_iterable(contents_list)))
87
- content_embeddings = reconstruct_list(content_embeddings_flatten, content_lengths)
88
- return query_embeddings, content_embeddings
@@ -39,7 +39,7 @@ def passage_reranker_node(func):
39
39
 
40
40
  # time rerankers
41
41
  if func.__name__ == 'time_reranker':
42
- corpus_df = pd.read_parquet(os.path.join(project_dir, "data", "corpus.parquet"))
42
+ corpus_df = pd.read_parquet(os.path.join(project_dir, "data", "corpus.parquet"), engine='pyarrow')
43
43
  metadatas = fetch_contents(corpus_df, ids, column_name='metadata')
44
44
  times = [[time['last_modified_datetime'] for time in time_list] for time_list in metadatas]
45
45
  reranked_contents, reranked_ids, reranked_scores \
@@ -1,4 +1,4 @@
1
- from typing import List, Tuple
1
+ from typing import List, Tuple, Iterable
2
2
 
3
3
  import pandas as pd
4
4
  import torch
@@ -58,7 +58,7 @@ def flag_embedding_run_model(input_texts, model, batch_size: int):
58
58
  for batch_texts in tqdm(batch_input_texts):
59
59
  with torch.no_grad():
60
60
  pred_scores = model.compute_score(sentence_pairs=batch_texts)
61
- if batch_size == 1:
61
+ if batch_size == 1 or not isinstance(pred_scores, Iterable):
62
62
  results.append(pred_scores)
63
63
  else:
64
64
  results.extend(pred_scores)
@@ -34,7 +34,7 @@ def run_passage_reranker_node(modules: List[Callable],
34
34
  if not os.path.exists(node_line_dir):
35
35
  os.makedirs(node_line_dir)
36
36
  project_dir = pathlib.PurePath(node_line_dir).parent.parent
37
- qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"))
37
+ qa_df = pd.read_parquet(os.path.join(project_dir, "data", "qa.parquet"), engine='pyarrow')
38
38
  retrieval_gt = qa_df['retrieval_gt'].tolist()
39
39
  retrieval_gt = [[[str(uuid) for uuid in sub_array] if sub_array.size > 0 else [] for sub_array in inner_array]
40
40
  for inner_array in retrieval_gt]