Dataset from:An Evaluation of Large Language Models in Bioinformatics Research
收藏资源简介:
This repository contains the data and code to reproduce the results of our paper: Dataset from:An Evaluation of Large Language Models in Bioinformatics Research Authors: Hengchuang Yin Section_A_ddi: ddinter_positive_samples.csv: Positive drug–drug interaction (DDI) pairs curated from the DDInter database. ddinter_negative_samples.csv: Negative drug–drug interaction (DDI) pairs (no known interactions), used for supervised classification. drug_description_embeddings_all-mpnet-base-v2.npy: Drug description embeddings generated using the all-mpnet-base-v2 model. drug_description_embeddings_bge-large-en-v1.5.npy: Drug description embeddings generated using the bge-large-en-v1.5 model. drug_description_embeddings_e5-small-v2.npy: Drug description embeddings generated using the e5-small-v2 model. drug_description_embeddings_gtr-t5-large.npy: Drug description embeddings generated using the gtr-t5-large model. drug_description_embeddings_text_embedding_3_large.npy: Drug description embeddings generated using OpenAI's text-embedding-3-large model. drug_description_embeddings_text_embedding_3_small.npy: Drug description embeddings generated using OpenAI's text-embedding-3-small model. drug_description_embeddings_text_embedding_ada_002.npy: Drug description embeddings generated using OpenAI's text-embedding-ada-002 model.



