2022-01-08 12:02:42 +01:00
|
|
|
from models.sklearn import SKLearnModel
|
2022-01-17 11:43:51 +01:00
|
|
|
from sklearnex.ensemble import RandomForestClassifier
|
|
|
|
|
from sklearnex.ensemble import RandomForestRegressor
|
2022-01-26 23:22:43 +01:00
|
|
|
from .base import Model
|
2021-12-21 17:28:36 +01:00
|
|
|
|
2022-01-17 11:43:51 +01:00
|
|
|
default_feature_selector_classification = SKLearnModel(RandomForestClassifier(n_jobs=-1, max_depth=20, random_state=1), 'classification')
|
2021-12-21 17:28:36 +01:00
|
|
|
|
2022-01-26 23:22:43 +01:00
|
|
|
def get_model(model_name: str) -> Model:
|
2022-01-14 14:29:24 +01:00
|
|
|
|
2022-01-29 06:41:40 +01:00
|
|
|
def set_name(model: Model) -> Model:
|
|
|
|
|
model.name = model_name
|
|
|
|
|
return model
|
|
|
|
|
|
2022-01-26 23:22:43 +01:00
|
|
|
if model_name == 'LinearRegression':
|
|
|
|
|
from sklearn.linear_model import LinearRegression
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(LinearRegression(n_jobs=-1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'Lasso':
|
|
|
|
|
from sklearn.linear_model import Lasso
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(Lasso(alpha=100, random_state=1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'Ridge':
|
|
|
|
|
from sklearn.linear_model import Ridge
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(Ridge(alpha=0.1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'BayesianRidge':
|
|
|
|
|
from sklearn.linear_model import BayesianRidge
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(BayesianRidge(), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'KNN':
|
|
|
|
|
from sklearnex.neighbors import KNeighborsRegressor
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(KNeighborsRegressor(n_neighbors=25), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'AB':
|
|
|
|
|
from sklearn.ensemble import AdaBoostRegressor
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(AdaBoostRegressor(random_state=1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'MLP':
|
|
|
|
|
from sklearn.neural_network import MLPRegressor
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(MLPRegressor(hidden_layer_sizes=(100,20), max_iter=1000), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'RFR':
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(RandomForestRegressor(n_jobs=-1, max_depth=20, random_state=1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'SVR':
|
|
|
|
|
from sklearnex.svm import SVR
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(SVR(kernel='rbf', C=1e3, gamma=0.1), 'regression'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'StaticNaive':
|
|
|
|
|
from models.naive import StaticNaiveModel
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(StaticNaiveModel())
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'DNN':
|
|
|
|
|
from models.neural import LightningNeuralNetModel
|
|
|
|
|
from models.pytorch.neural_nets import MultiLayerPerceptron
|
|
|
|
|
import torch.nn.functional as F
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(LightningNeuralNetModel(
|
2022-01-26 23:22:43 +01:00
|
|
|
MultiLayerPerceptron(
|
|
|
|
|
hidden_layers_ratio = [1.0],
|
|
|
|
|
probabilities = False,
|
|
|
|
|
loss_function = F.mse_loss),
|
|
|
|
|
max_epochs=15
|
2022-01-29 06:41:40 +01:00
|
|
|
))
|
2021-12-21 17:28:36 +01:00
|
|
|
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'LogisticRegression_two_class':
|
|
|
|
|
from sklearn.linear_model import LogisticRegression
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(LogisticRegression(C=10, random_state=1, solver='liblinear', max_iter=1000), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'LogisticRegression_three_class':
|
|
|
|
|
from sklearnex.linear_model import LogisticRegression as LogisticRegression_EX
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(LogisticRegression_EX(C=10, random_state=1, max_iter=1000, n_jobs=-1), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'LDA':
|
|
|
|
|
from sklearn.discriminant_analysis import LinearDiscriminantAnalysis
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(LinearDiscriminantAnalysis(), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'KNN':
|
|
|
|
|
from sklearn.neighbors import KNeighborsClassifier
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(KNeighborsClassifier(), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'CART':
|
|
|
|
|
from sklearn.tree import DecisionTreeClassifier
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(DecisionTreeClassifier(max_depth=15, random_state=1), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'NB':
|
|
|
|
|
from sklearn.naive_bayes import GaussianNB
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(GaussianNB(), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'AB':
|
|
|
|
|
from sklearn.ensemble import AdaBoostClassifier
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(AdaBoostClassifier(n_estimators=15), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'RFC':
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(RandomForestClassifier(n_jobs=-1, max_depth=20, random_state=1), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'SVC':
|
|
|
|
|
from sklearn.svm import SVC
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(SVC(kernel='rbf', C=1e3, probability=True, random_state=1), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'XGB_two_class':
|
|
|
|
|
from xgboost import XGBClassifier
|
|
|
|
|
from models.xgboost import XGBoostModel
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(XGBoostModel(XGBClassifier(n_jobs=-1, max_depth = 20, random_state=1, objective='binary:logistic', use_label_encoder= False, eval_metric='mlogloss')))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'LGBM':
|
|
|
|
|
from lightgbm import LGBMClassifier
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(SKLearnModel(LGBMClassifier(n_jobs=-1, max_depth=20, random_state=1), 'classification'))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'StaticMom':
|
|
|
|
|
from models.momentum import StaticMomentumModel
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(StaticMomentumModel(allow_short=True))
|
2022-01-26 23:22:43 +01:00
|
|
|
elif model_name == 'Average':
|
|
|
|
|
from models.average import StaticAverageModel
|
2022-01-29 06:41:40 +01:00
|
|
|
return set_name(StaticAverageModel())
|
2022-01-26 23:22:43 +01:00
|
|
|
else:
|
|
|
|
|
raise Exception(f'Model {model_name} not found')
|