Determine similarity between datasets
Project description
pysimilarity
Pysimilarity is a library that contains several methods for determining similarities between groups. Currently, it supports calculating similarities using distances, and a classifier.
Install
pip install pysimilarity
Usage
from sklearn.datasets import load_iris
from pysimilarity import DistanceSimilarity
import pandas as pd
iris_dataset = load_iris()
iris_df = pd.DataFrame(iris_dataset['data'],columns=iris_dataset['feature_names']
)
iris_df['species'] = pd.Series(iris_dataset['target']).replace({0:'setosa', 1:'versicolor', 2:'virginica'})
dist_similarity = DistanceSimilarity()
setosa_data = iris_df.loc[iris_df.species == 'setosa']
setosa_similarity = dist_similarity.fit_transform(setosa_data.drop('species',axis=1)
,iris_df.drop('species',axis=1))
print(setosa_similarity) # Array of shape n_rows of iris_df.
Project details
Release history Release notifications | RSS feed
Download files
Download the file for your platform. If you're not sure which to choose, learn more about installing packages.
Source Distribution
pysimilarity-0.1.0.tar.gz
(8.1 kB
view details)
File details
Details for the file pysimilarity-0.1.0.tar.gz.
File metadata
- Download URL: pysimilarity-0.1.0.tar.gz
- Upload date:
- Size: 8.1 kB
- Tags: Source
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/2.0.0 pkginfo/1.4.2 requests/2.21.0 setuptools/40.8.0 requests-toolbelt/0.9.1 tqdm/4.28.1 CPython/3.7.3
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
31db17cb42dd1f0d8c5488c703613c65031cb86e88f1a32db10631009875b288
|
|
| MD5 |
30be258f867b08704187187f6d137ba9
|
|
| BLAKE2b-256 |
27a01813a6d3231ba982614422e913d0a3c2b6d576ed26f80fcf33c8c337bbc9
|