Customer Support/Contact

Departments
Book Series (99)	1410
Nachhaltigkeit	3
Gesundheitswesen	3
Humanities	2401
Natural Sciences	5426
Mathematics	229
Informatics	320
Physics	981
Chemistry	1370
Geosciences	131
Human medicine	246
Stomatology	10
Veterinary medicine	112
Pharmacy	147
Biology	837
Biochemistry, molecular biology, gene technology	121
Biophysics	25
Domestic and nutritional science	45
Agricultural science	1005
Forest science	201
Horticultural science	20
Environmental research, ecology and landscape conservation	148
Engineering	1817
Common	97
Leitlinien Unfallchirurgie 5. Auflage bestellen

Advanced Search

Schätzen der Klassenzugehörigkeitswahrscheinlichkeit zur Definition des Arbeitsbereichs von chemieinformatorischen Klassifikationsmodellen

Hard Copy
EUR 79.90

E-book
EUR 0.00

Download

PDF (4.7 MB)

Open Access CC BY 4.0

Schätzen der Klassenzugehörigkeitswahrscheinlichkeit zur Definition des Arbeitsbereichs von chemieinformatorischen Klassifikationsmodellen (English shop)

Miriam Mathea (Author)

Preview

Extract, PDF (210 KB)
Table of Contents, PDF (100 KB)

In der vorliegenden Arbeit wurden unterschiedliche Regressions- und Klassifikationstechniken hinsichtlich ihrer Fähigkeit analysiert, Klassenzugehörigkeits-Wahrscheinlichkeiten möglichst exakt schätzen zu können. Zusätzlich wurden der Effekt der Kalibrierung mittels logistischer Regression, sowie die Einflussfaktoren Korrektklassifizierungsrate, Korrelation der Daten und Datensatzgröße untersucht. Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer können verwendet werden um einen Anwendungsbereich für ein betrachtetes Klassifikations- oder Regressionsmodell zu definieren. Die Verwendung von Klassenzugehörigkeits-Wahrscheinlichkeits-schätzern zur Definition eines Anwendungsbereiches (Reject-Option) wurde verglichen mit dem Ansatz des Conformal Predictors.
Das Ergebnis ist, dass alle untersuchten Techniken (Random Forests, Random Forest Regression, Support Vector Machines, Support Vector Regression, K-Nächste-Nachbarn, Partial Least Squares Discriminant Analysis, Sparse Partial Least Squares Regression, Ridge Regression, Elastic Net, Least Absolute Shrinkage and Selection Operator) mit Ausnahme der Linearen Diskriminanz Analyse, der Neuronalen Netze und des Naive Bayesian Klassifikators von der Kalibrierung mittels logistischer Regression profitieren. Die erhaltenen Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer befinden sich danach näher an der wahren Wahrscheinlichkeit. Die größten Einflussfaktoren sind die Korrektklassifizierungsrate und die Korrelation der Daten. Bei einer Vielzahl der Techniken führt eine steigende Korrektklassifizierungsrate und eine abnehmende Korrelation der Daten zu schlechteren Schätzwerten. Die Bildung von Hetero-Ensemblen führt zu stabileren Schätzwerten. Gut kalibrierte Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer sind, verglichen mit dem Conformal Predictor, dazu in der Lage besonders effizient, ohne viele Objekte zu verlieren, einen Anwendungsbereich zu definieren.

This study analyses several regression- and classification techniques regarding their ability to estimate class-probabilities precisely. Furthermore the effect of the calibration (with use of logistic regression) and the influence factors: accuracy, correlation structure and data-set-size were analyzed. Class-probability-estimates can be used to define an applicability domain for a regression- or classification-model. The definition of an applicability domain by using class-probability-estimates (Reject Option) was compared to the approach of the Conformal Predictors.
In summary, all studied techniques (Random Forests, Random Forest Regression, Support Vector Machines, Support Vector Regression, K-Nearest-Neighbor, Partial Least Squares Discriminant Analysis, Sparse Partial Least Squares Regression, Ridge Regression, Elastic Net, Least Absolute Shrinkage and Selection Operator), except Linear Discriminant Analysis, Neural Networks and Naïve Bayesian Classifier benefit from calibration with logistic regression. The accuracy and the correlation structure have the strongest impact. The stability of class-probability-estimates improves by generating hetero-ensembles. Good calibrated class-probability-estimates are able to define an applicability domain in a very efficient way, compared to the conformal predictor.

ISBN-13 (Hard Copy)	9783736997226
ISBN-13 (eBook)	9783736987227
Final Book Format	A5
Language	German
Page Number	318
Lamination of Cover	matt
Edition	1
Publication Place	Göttingen
Place of Dissertation	Braunschweig
Publication Date	2018-01-29
General Categorization	Dissertation
Departments	Pharmaceutical chemistry
Keywords	Chemieinformatik, Klassenzugehörigkeitswahrscheinlichkeit, Arbeitsbereich