Meta tags:
description= Lernen Sie, wie logistische Regression funktioniert, wie Sie binäre und Mehrklassen-Klassifikatoren in Python mit scikit-learn trainieren und evaluieren.;
Headings (most frequently used words):
regression, logistische, in, python, klassifikation, und, einschränkungen, werden, machine, learning, mit, logistischer, so, funktioniert, binäre, warum, feature, skalierung, wichtig, ist, bewertung, eines, klassifikators, mehrklassen, regularisierung, verwendung, einer, pipeline, koeffizienten, inspizieren, vorteile, vs, verwandte, klassifikatoren, wichtigste, erkenntnisse, von, linearer, zu, wahrscheinlichkeiten, entscheidungsgrenze, log, odds, logit, wie, parameter, gelernt, wahrscheinlichkeits, scores, die, auc, roc, kurve, wann, verwendet, sollte,
Text of the page (most frequently used words):
#python (61), die (41), import (41), from (39), sklearn (38), data (36), und (29), regression (29), sie (26), scaler (21), der (20), standardscaler (19), kopieren (19), logistische (18), clf (18), logisticregression (18), lernen (16), das (16), mit (16), print (15), random_state (15), matplotlib (15), load_breast_cancer (14), x_test (14), y_test (14), feature (13), x_train (13), y_train (13), mysql (13), ist (12), train_test_split (12), mongodb (12), pipeline (11), scikit (11), modell (11), features (11), den (11), accuracy (11), skalierung (10), learn (10), eine (10), wie (10), koeffizienten (9), regularisierung (9), verwenden (9), klasse (9), ein (9), log (9), max_iter (9), auf (9), y_pred (9), alle (8), für (8), klassen (8), oder (8), auc (8), for (8), fit (8), target (8), preprocessing (8), linear_model (8), datasets (8), class (8), listen (8), html (7), verwendet (7), roc (7), ausgabe (7), methoden (7), als (7), werden (7), 1000 (7), predict (7), pipe (7), model_selection (7), x_test_sc (7), von (7), strings (7), elemente (7), mehrklassen (6), wird (6), penalty (6), sind (6), fit_transform (6), accuracy_score (6), test_size (6), x_train_sc (6), string (6), w3docs (5), über (5), tools (5), einer (5), klassifikation (5), eines (5), grid (5), immer (5), solver (5), lbfgs (5), genauigkeit (5), daten (5), kurve (5), recall (5), wahrscheinlichkeit (5), lineare (5), entfernen (5), erwartete (5), metrics (5), scores (5), wenn (5), transform (5), plt (5), dateien (5), erstellen (5), tutorial (5), tuples (5), formatter (5), color (5), json (4), generator (4), klassifikatoren (4), klassifikators (4), warum (4), funktioniert (4), search (4), standard (4), softmax (4), parameter (4), zur (4), nur (4), bei (4), konfusionsmatrix (4), präzision (4), sigmoid (4), funktion (4), linear (4), entscheidungsgrenze (4), odds (4), einen (4), predict_proba (4), first (4), test (4), probabilities (4), keine (4), the (4), dass (4), score (4), and (4), erste (4), schritte (4), dictionaries (4), set (4), listenelemente (4), durchlaufen (4), code (3), encoder (3), editor (3), quizze (3), übungen (3), php (3), javascript (3), css (3), einschränkungen (3), bewertung (3), wichtig (3), binäre (3), multinomial (3), kreuzvalidierung (3), kapitel (3), verhindert (3), datenlecks (3), durch (3), nearest (3), neighbors (3), kalibriert (3), entscheidungsbaum (3), nicht (3), stichproben (3), labels (3), wann (3), treiben (3), richtung (3), positive (3), worst (3), error (3), radius (3), coefficient (3), coefs (3), numpy (3), vorhersage (3), probability (3), new_sample (3), wert (3), bedeutet (3), null (3), zwei (3), 000 (3), samples (3), hat (3), benign (3), positiven (3), allen (3), tatsächlichen (3), viele (3), confusion_matrix (3), target_names (3), clf_sc (3), clf_raw (3), 114 (3), train (3), loss (3), wahrscheinlichkeiten (3), variablen (3), sets (3), hinzufügen (3), zugreifen (3), italiano (2), português (2), español (2), français (2), русский (2), deutsch (2), english (2), beautifier (2), diff (2), password (2), java (2), git (2), bücher (2), snippets (2), wichtigste (2), erkenntnisse (2), verwandte (2), vorteile (2), inspizieren (2), verwendung (2), this (2), page (2), hierarchisches (2), clustering (2), was (2), probleme (2), gut (2), behandelt (2), overfitting (2), dem (2), stärkere (2), siehe (2), vereinfacht (2), deployment (2), konvergenz (2), verbessert (2), schätzt (2), nein (2), nichtlinear (2), ensemble (2), gegenüber (2), groß (2), benötigen (2), sollte (2), negative (2), nach (2), bösartig (2), gutartig (2), area (2), sorted_idx (2), sort (2), absolute (2), jeder (2), werte (2), werten (2), predicted (2), 974 (2), sample (2), unscaled (2), einem (2), dabei (2), mehrere (2), mean (2), results (2), cross_val_score (2), 997 (2), proba (2), load_iris (2), datensatz (2), beispiel (2), ziel (2), kreuzentropie (2), minimiert (2), binären (2), roc_auc_score (2), y_proba (2), kann (2), sensitivität (2), aus (2), vorhergesagten (2), metriken (2), logistic (2), breast (2), cancer (2), disp (2), confusionmatrixdisplay (2), pyplot (2), 200 (2), scaling (2), more (2), mittelwert (2), standardmäßig (2), avg (2), malignant (2), classification_report (2), scale (2), 569 (2), p̂ᵢ (2), gibt (2), anderen (2), interpretierbar (2), wₙxₙ (2), des (2), schwellenwert (2), sagt (2), vorher (2), dieses (2), spam (2), kein (2), klick (2), machine (2), learning (2), handling (2), zahlen (2), limit (2), update (2), drop (2), collection (2), delete (2), insert (2), datenbank (2), einführung (2), schleifen (2), verbinden (2), ändern (2), hash (2), 2026, rechte, vorbehalten, entwickler, gemacht, sprache, datenschutzrichtlinie, kontakt, uns, unternehmen, probier, üben, kostenlose, tutorials, beispiele, web, seit, 2014, next, previous, yes, helpful, überlappende, kontrollieren, kleiner, abstimmung, bewerten, statt, besonders, unausgewogenen, bündeln, vor, training, beschleunigt, skalieren, mithilfe, schwellenwertbildung, dieser, zugewiesen, kontinuierliche, instanzbasiert, weniger, achsenausgerichtet, probabilistische, erforderlich, algorithmus, neuronale, netze, geeignet, sehr, komplexe, interaktionen, regularisieren, stark, korrelierten, wenden, minmaxscaler, empfindlich, wechseln, polynomfeatures, setzt, voraus, abhilfemaßnahme, einschränkung, datensätze, skaliert, vielen, bevor, komplexere, modelle, ausprobiert, entscheidungsbäume, schnelle, basislinie, aussagekräftig, interpretierbares, beziehung, zwischen, annähernd, wahrscheinlichkeitsschätzungen, 9947, 9989, 0266, 2893, texture, 3206, top, absolutem, gewicht, feature_names, argsort, abs, shape, n_features, binary, classification, coef_, value, trainierten, zeigen, welche, größere, bedeuten, stärkeren, einfluss, übernimmt, intern, rufen, rohen, 11359025, 88640975, new, raw, verbindet, vorverarbeitung, einzigen, objekt, versehentliche, finden, besten, generalisiert, systematische, suche, hyperparameter, std, scoring, 100, 001, stärke, gesteuert, regularisierungsstärke, kleineres, kehrwert, sauber, none, kombiniert, erfordert, saga, mix, elasticnet, treibt, einige, genau, implizite, selektion, lasso, schrumpft, gegen, behält, ridge, auswirkung, typ, bestraft, große, verhindern, bietet, typen, 003, 964, 036, 011, 876, 113, three, default, iris, enthält, drei, blumenarten, natürliches, mehr, erweitert, automatisch, einzelnes, ausgabeschicht, trainiert, gemeinsam, dies, allgemeinen, genauer, ältere, one, rest, ovr, strategie, separaten, klassifikator, pro, trainierte, ansatz, nahe, fast, perfekt, einordnet, erfahren, vollständige, gezeichnet, interpretiert, anstelle, harten, abgerufen, wahrscheinlichkeits, medizinischen, diagnose, oft, wichtiger, übersehener, bösartiger, befund, schlimmer, falscher, alarm, negativen, korrekt, abgelehnt, spezifität, harmonisches, mittel, erkannt, wirklich, positiv, bedeutung, formel, metrik, wichtige, show, 150, dpi, png, savefig, tight_layout, title, blues, cmap, plot, display_labels, allein, irreführend, sein, unausgewogen, daraus, abgeleiteten, passen, trainingsdatensatz, denselben, angepassten, zum, transformieren, trainings, testdaten, scaled, with, without, needs, iterations, may, warn, about, convergence, gradientenbasierte, optimierung, ohne, dominiert, großen, mittlerer, gradientenaktualisierungen, verlangsamt, lässt, versagen, transformiert, jedes, einheitsvarianz, erreicht, zurückgehaltenen, beachten, learns, hinzufügt, generalisierung, weighted, macro, precision, support, evaluate, when, are, similar, converges, faster, reliably, split, into, load, folgende, wisconsin, numerische, binäres, enthalten, sodass, externen, benötigt, niedrigerer, besser, anders, linearen, geschlossene, lösung, kostenfunktion, iterativen, optimierer, gelernt, koeffizient, änderung, einheitserhöhung, konstant, gehalten, macht, logarithmus, quotenverhältnisses, zeigt, parametern, logit, entspricht, definiert, hyperebene, raum, beiden, trennt, überschreitet, andernfalls, gewichtete, summe, eingabe, quetscht, jede, reelle, zahl, bereich, liefert, gültige, wahrscheinlichkeitsschätzung, kontinuierlichen, würde, man, könnten, vorhersagen, außerhalb, liegen, wären, löst, problem, indem, kombination, geleitet, linearer, bevorzugen, angepasst, umgang, problemen, jenseits, reinen, aufbau, überwachter, klassifikationsalgorithmus, stichprobe, bestimmten, gehört, trotz, begriffs, namen, kategorialen, krankheit, gesund, klassifikationsaufgaben, trainieren, evaluieren, logistischer, http, anfragen, pytest, pakete, virtuelle, umgebungen, tooling, best, practices, threading, asyncio, concurrency, csv, random, sys, itertools, collections, ausnahmen, auslösen, library, addieren, umkehren, duplikate, how, enums, abstrakte, kapselung, polymorphismus, dataclasses, static, classmethod, property, magic, methods, advanced, oop, match, anweisung, enumerate, zip, map, comprehensions, kontextmanager, rekursion, closures, generatoren, decorators, args, kwargs, type, hints, intermediate, query, find, join, table, order, where, select, tabelle, einstieg, cross, validation, bootstrap, aggregation, means, kategoriale, multiple, polynomiale, streudiagramm, normalverteilung, datenverteilung, perzentil, standardabweichung, median, modus, kreisdiagramme, histogramme, balken, scatter, subplot, beschriftungen, linie, marker, plotting, django, scipy, pandas, modules, löschen, schreiben, lesen, dateiverarbeitung, file, formatierung, benutzereingabe, try, except, pip, regex, math, datumsangaben, module, scope, iteratoren, vererbung, objekte, arrays, lambda, funktionen, while, else, tupeln, gruppieren, operatoren, booleans, casting, datentypen, kommentare, syntax, variablennamen, aktualisieren, tupel, entpacken, tuple, sortieren, slicen, home, ausgabevariablen, verschachtelte, modifizieren, list, comprehension, zusammenführen, globale, format, escape, zeichen, dictionary, verketten, zuweisen, aufrufen, anmelden, durchsuchen, formatters, url, reverse, sha256, md5, length, calculator, colors, hsl, hex, mixer, converter, picker, general, kurse,
Text of the page (random words):
en addieren error handling and the standard library ausnahmen auslösen collections itertools os sys random csv dateien concurrency in python asyncio threading python tooling and best practices virtuelle umgebungen pakete pytest http anfragen machine learning mit logistischer regression in python lernen sie wie logistische regression funktioniert wie sie binäre und mehrklassen klassifikatoren in python mit scikit learn trainieren und evaluieren logistische regression ist ein überwachter klassifikationsalgorithmus der die wahrscheinlichkeit schätzt dass eine stichprobe zu einer bestimmten klasse gehört trotz des begriffs regression im namen wird sie für klassifikationsaufgaben verwendet zur vorhersage eines kategorialen labels wie spam kein spam krankheit gesund oder klick kein klick dieses kapitel behandelt wie logistische regression funktioniert die sigmoid funktion und log odds aufbau eines binären klassifikators in python mit scikit learn bewertung eines klassifikators jenseits der reinen genauigkeit umgang mit mehrklassen problemen regularisierung und wann sie angepasst werden sollte feature skalierung und warum sie wichtig ist wann logistische regression gegenüber anderen klassifikatoren zu bevorzugen ist so funktioniert logistische regression von linearer regression zu wahrscheinlichkeiten lineare regression sagt einen kontinuierlichen wert vorher würde man sie für klassifikation verwenden könnten die vorhersagen außerhalb von 0 1 liegen und wären als wahrscheinlichkeiten nicht interpretierbar logistische regression löst dieses problem indem die lineare kombination durch die sigmoid funktion geleitet wird σ z 1 1 e z kopieren dabei ist z w w x w x wₙxₙ die gewichtete summe der eingabe features die sigmoid funktion quetscht jede reelle zahl in den bereich 0 1 und liefert so eine gültige wahrscheinlichkeitsschätzung entscheidungsgrenze das modell sagt klasse 1 vorher wenn die wahrscheinlichkeit einen schwellenwert standard 0 5 überschreitet andernfalls klasse 0 ŷ 1 if σ z 0 5 ŷ 0 if σ z 0 5 kopieren der schwellenwert σ z 0 5 entspricht z 0 der die entscheidungsgrenze definiert eine hyperebene im feature raum die die beiden klassen trennt log odds logit der logarithmus des quotenverhältnisses zeigt warum das modell in den parametern linear ist log p 1 p w w x wₙxₙ kopieren jeder koeffizient wᵢ gibt die änderung der log odds für eine einheitserhöhung in feature xᵢ an wenn alle anderen features konstant gehalten werden das macht die logistische regression interpretierbar wie parameter gelernt werden anders als bei der linearen regression gibt es keine geschlossene lösung das modell minimiert die log loss kostenfunktion kreuzentropie mit einem iterativen optimierer standardmäßig lbfgs in scikit learn loss 1 m σ yᵢ log p̂ᵢ 1 yᵢ log 1 p̂ᵢ kopieren ein niedrigerer log loss bedeutet dass die vorhergesagten wahrscheinlichkeiten besser auf die tatsächlichen labels kalibriert sind binäre klassifikation in python das folgende beispiel verwendet den breast cancer wisconsin datensatz 569 stichproben 30 numerische features binäres ziel bösartig 1 gutartig 0 er ist in scikit learn enthalten sodass keine externen dateien benötigt werden from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler from sklearn metrics import accuracy_score classification_report 1 load data data load_breast_cancer x y data data data target x 569 30 y 0 malignant 1 benign 2 split into train 80 and test 20 x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 3 scale features logistic regression converges faster and more reliably when features are on a similar scale scaler standardscaler x_train_sc scaler fit_transform x_train x_test_sc scaler transform x_test 4 train clf logisticregression max_iter 1000 random_state 42 clf fit x_train_sc y_train 5 evaluate y_pred clf predict x_test_sc print f accuracy accuracy_score y_test y_pred 3f print classification_report y_test y_pred target_names data target_names kopieren erwartete ausgabe accuracy 0 974 precision recall f1 score support malignant 0 98 0 95 0 96 43 benign 0 97 0 99 0 98 71 accuracy 0 97 114 macro avg 0 97 0 97 0 97 114 weighted avg 0 97 0 97 0 97 114 kopieren das modell erreicht 97 genauigkeit auf den zurückgehaltenen daten beachten sie dass scikit learns logisticregression standardmäßig l2 regularisierung hinzufügt c 1 0 was die generalisierung verbessert warum feature skalierung wichtig ist logistische regression verwendet gradientenbasierte optimierung ohne skalierung dominiert ein feature mit großen werten z b mittlerer radius 14 die gradientenaktualisierungen verlangsamt die konvergenz oder lässt den solver versagen standardscaler transformiert jedes feature auf null mittelwert und einheitsvarianz from sklearn linear_model import logisticregression from sklearn datasets import load_breast_cancer from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler data load_breast_cancer x y data data data target x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 without scaling needs more iterations may warn about convergence clf_raw logisticregression max_iter 200 random_state 42 clf_raw fit x_train y_train print f unscaled accuracy clf_raw score x_test y_test 3f with scaling scaler standardscaler clf_sc logisticregression max_iter 200 random_state 42 clf_sc fit scaler fit_transform x_train y_train print f scaled accuracy clf_sc score scaler transform x_test y_test 3f kopieren passen sie den scaler immer nur auf den trainingsdatensatz an und verwenden sie denselben angepassten scaler zum transformieren von trainings und testdaten das verhindert datenlecks bewertung eines klassifikators genauigkeit allein kann irreführend sein wenn die klassen unausgewogen sind verwenden sie eine konfusionsmatrix und die daraus abgeleiteten metriken from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler from sklearn metrics import confusion_matrix confusionmatrixdisplay import matplotlib pyplot as plt data load_breast_cancer x y data data data target x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 scaler standardscaler x_train_sc scaler fit_transform x_train x_test_sc scaler transform x_test clf logisticregression max_iter 1000 random_state 42 clf fit x_train_sc y_train y_pred clf predict x_test_sc cm confusion_matrix y_test y_pred disp confusionmatrixdisplay cm display_labels data target_names disp plot cmap blues plt title logistic regression breast cancer plt tight_layout plt savefig confusion_matrix png dpi 150 plt show kopieren wichtige metriken aus der konfusionsmatrix metrik formel bedeutung präzision tp tp fp von allen vorhergesagten positiven wie viele sind wirklich positiv recall sensitivität tp tp fn von allen tatsächlichen positiven wie viele hat das modell erkannt f1 score 2 p r p r harmonisches mittel aus präzision und recall spezifität tn tn fp von allen tatsächlichen negativen wie viele hat das modell korrekt abgelehnt bei der medizinischen diagnose ist der recall sensitivität oft wichtiger als die präzision ein übersehener bösartiger befund ist schlimmer als ein falscher alarm wahrscheinlichkeits scores und die auc roc kurve anstelle einer harten vorhersage kann die wahrscheinlichkeit der positiven klasse mit predict_proba abgerufen werden from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler from sklearn metrics import roc_auc_score data load_breast_cancer x y data data data target x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 scaler standardscaler clf logisticregression max_iter 1000 random_state 42 clf fit scaler fit_transform x_train y_train probability of the positive class benign 1 y_proba clf predict_proba scaler transform x_test 1 print f auc roc roc_auc_score y_test y_proba 3f kopieren erwartete ausgabe auc roc 0 997 kopieren ein auc wert nahe 1 0 bedeutet dass das modell positive stichproben fast perfekt über negative einordnet im kapitel zur auc roc kurve erfahren sie wie die vollständige kurve gezeichnet und interpretiert wird mehrklassen klassifikation wenn das ziel mehr als zwei klassen hat erweitert scikit learn die logistische regression automatisch ab scikit learn 1 5 verwendet der lbfgs solver immer den multinomial softmax ansatz der ein einzelnes modell mit einer softmax ausgabeschicht trainiert und die kreuzentropie über alle klassen gemeinsam minimiert dies ist im allgemeinen genauer als die ältere one vs rest ovr strategie die einen separaten binären klassifikator pro klasse trainierte der iris datensatz enthält drei blumenarten ein natürliches mehrklassen beispiel from sklearn datasets import load_iris from sklearn linear_model import logisticregression from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler from sklearn metrics import accuracy_score data load_iris x y data data data target x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 scaler standardscaler x_train_sc scaler fit_transform x_train x_test_sc scaler transform x_test from scikit learn 1 5 multinomial softmax is the default for lbfgs clf logisticregression solver lbfgs max_iter 1000 random_state 42 clf fit x_train_sc y_train y_pred clf predict x_test_sc print f accuracy accuracy_score y_test y_pred 3f class probabilities for the first three test samples print n class probabilities first 3 samples for proba in clf predict_proba x_test_sc 3 print f p 3f for p in proba kopieren erwartete ausgabe accuracy 1 000 class probabilities first 3 samples 0 011 0 876 0 113 0 964 0 036 0 000 0 000 0 003 0 997 kopieren regularisierung regularisierung bestraft große koeffizienten um overfitting zu verhindern scikit learn bietet zwei typen über den parameter penalty parameter typ auswirkung penalty l2 standard ridge schrumpft alle koeffizienten gegen null behält alle features penalty l1 lasso treibt einige koeffizienten genau auf null implizite feature selektion penalty elasticnet mix kombiniert l1 und l2 erfordert solver saga penalty none keine keine regularisierung nur verwenden wenn die daten groß und sauber sind die stärke der regularisierung wird durch c gesteuert der kehrwert der regularisierungsstärke kleineres c bedeutet stärkere regularisierung from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn model_selection import cross_val_score from sklearn preprocessing import standardscaler from sklearn pipeline import pipeline import numpy as np data load_breast_cancer x y data data data target results for c in 0 001 0 01 0 1 1 0 10 0 100 0 pipe pipeline scaler standardscaler clf logisticregression c c max_iter 1000 random_state 42 scores cross_val_score pipe x y cv 5 scoring accuracy results c scores mean print f c c 7 3f cv accuracy scores mean 4f scores std 4f kopieren dabei wird kreuzvalidierung verwendet um den c wert zu finden der am besten generalisiert für eine systematische suche über mehrere hyperparameter siehe grid search verwendung einer pipeline eine pipeline verbindet die vorverarbeitung und das modell zu einem einzigen objekt das verhindert versehentliche datenlecks und vereinfacht kreuzvalidierung und deployment from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn model_selection import train_test_split from sklearn preprocessing import standardscaler from sklearn pipeline import pipeline from sklearn metrics import accuracy_score data load_breast_cancer x y data data data target x_train x_test y_train y_test train_test_split x y test_size 0 2 random_state 42 pipe pipeline scaler standardscaler clf logisticregression c 1 0 max_iter 1000 random_state 42 pipe fit x_train y_train y_pred pipe predict x_test print f accuracy accuracy_score y_test y_pred 3f predict probabilities on a new sample raw unscaled new_sample x_test 1 first test sample print f predicted class pipe predict new_sample 0 print f class probability pipe predict_proba new_sample 0 kopieren erwartete ausgabe accuracy 0 974 predicted class 1 class probability 0 11359025 0 88640975 kopieren die pipeline übernimmt die skalierung intern sie rufen predict mit rohen feature werten auf koeffizienten inspizieren die trainierten koeffizienten zeigen welche features die vorhersage in richtung jeder klasse treiben größere absolute werte bedeuten einen stärkeren einfluss from sklearn datasets import load_breast_cancer from sklearn linear_model import logisticregression from sklearn preprocessing import standardscaler import numpy as np data load_breast_cancer x y data data data target scaler standardscaler clf logisticregression max_iter 1000 random_state 42 clf fit scaler fit_transform x y sort by absolute coefficient value coefs clf coef_ 0 shape n_features for binary classification sorted_idx np argsort np abs coefs 1 print f feature 35 coefficient 12 print 48 for i in sorted_idx 5 print f data feature_names i 35 coefs i 12 4f kopieren erwartete ausgabe top 5 features nach absolutem gewicht feature coefficient worst texture 1 3206 radius error 1 2893 worst radius 1 0266 area error 0 9989 worst area 0 9947 kopieren negative koeffizienten nach skalierung treiben in richtung klasse 0 bösartig positive koeffizienten treiben in richtung klasse 1 gutartig vorteile und einschränkungen wann logistische regression verwendet werden sollte sie benötigen wahrscheinlichkeitsschätzungen nicht nur klassen labels die beziehung zwischen features und den log odds ist annähernd linear sie benötigen ein interpretierbares modell koeffizienten sind aussagekräftig als schnelle basislinie bevor komplexere modelle wie entscheidungsbäume oder ensemble methoden ausprobiert werden datensätze sind groß logistische regression skaliert gut mit vielen stichproben einschränkungen einschränkung abhilfemaßnahme setzt eine lineare entscheidungsgrenze voraus verwenden sie polynomfeatures oder wechseln sie zu entscheidungsbaum k nearest neighbors empfindlich gegenüber feature skalierung wenden sie immer standardscaler oder minmaxscaler an probleme bei stark korrelierten features entfernen oder regularisieren sie mit l1 penalty l1 nicht geeignet für sehr komplexe feature interaktionen verwenden sie ensemble methoden oder neuronale netze logistische regression vs verwandte klassifikatoren algorithmus entscheidungsgrenze skalierung erforderlich probabilistische ausgabe logistische regression linear ja ja kalibriert entscheidungsbaum nichtlinear achsenausgerichtet nein ja weniger kalibriert k nearest ne...
|