[Excel] Gemiddelde zonder extremen . .

Pagina: 1
Acties:
  • 2.604 views sinds 30-01-2008
  • Reageer

  • Togt
  • Registratie: Februari 2000
  • Laatst online: 24-08-2021
Ik ben bezig een performance-meting te maken in Excel, op basis van tracefiles die ik parse in Excel.

De waardes uit de tracefiles krijg ik nu in 1 kolom, ik zie echter dat er tussen een stuk of 100 metingen van rond de 0,5 seconde een aantal (5) metingen zitten van wel 1400 sec.

Dat trekt mijn gemiddelde dusdanig over de scheef dat ik geen standaard deviatie truc uit kan halen. Ik kan niet vinden welke formule ik kan gebruiken om automatisch de extremen eruit te gooien voordat het gemiddelde wordt berekend.

PS. ik wil niet een hardgecodeerde limiet neerzetten als: knip alle metingen eruit boven de 30 sec oid, omdat bij het meten van andere onderdelen van de applicatie 1400sec misschien wel normaal is.

  • paknaald
  • Registratie: Juni 2001
  • Laatst online: 27-07 08:44
Ik denk dat je niet ontkomt aan het zelf kiezen van een limiet. Deze limiet hoeft niet hardgecodeerd te zijn; je kunt ook denken aan het laten vallen van alle waarnemingen buiten een standaarddeviatie (of meerdere) van het gemiddelde. Die past zich aan naar gelang de data en geeft toch een vaste limiet per dataset.

edit:
Dat is trouwens een kontoplossing voor één outlier.. ff verder denken


Ach ja, daar kun je de Z-waarde voor gebruiken, maar dan is de limiet nog steeds hardgecodeerd, al is het op een afgeleide van de dataset.

[ Voor 26% gewijzigd door paknaald op 14-09-2006 12:09 ]


  • Togt
  • Registratie: Februari 2000
  • Laatst online: 24-08-2021
Tja, ik denk dat ik daar dan niet aan ontkom, gewoon afknippen wat niet binnen 3xdeviatie valt ofzo. . Zolang er genoeg metingen zijn zal dit niet teveel impact hebben op het gemiddelde.

Dank voor je snelle antwoord!

  • Togt
  • Registratie: Februari 2000
  • Laatst online: 24-08-2021
Tja,
Ik kom er toch nog niet uit!!! Het blijkt toch erg lastig te zijn om de extremen eruit te filteren door middel van een berekening op basis van het gemiddelde, zeker als deze zo vertekent is vanwege een paar grote waardes!! Heeft iemand nog een andere methode?

Ik zat te denken aan het nemen van een median van een gesorteerde lijst met meetwaarden. Dan wel weer het probleem van Median: max 30 waardes . . .

Verwijderd

"< dan waarde#" in formule opnemen. Echter horen extremen erbij en krijg je een minder nauwkeurige database.

  • paknaald
  • Registratie: Juni 2001
  • Laatst online: 27-07 08:44
Je kunt eens op Google zoeken naar "detecting outliers". In verschillende links (zoals deze) leggen ze allerlei methodes uit hoe je (wiskundig) outliers kunt bepalen. Wellicht kun je zoiets in Excel gebruiken.

De makkelijkste is (waarde -/- gemiddelde)/standaarddeviatie = Z-waarde
code:
1
(A1-AVERAGE(A1:A50))/STDEV(A1:A50)

Bij deze methode moet je nog steeds een harde bovengrens kiezen. Er zijn ook geavanceerdere methodes.

[ Voor 6% gewijzigd door paknaald op 18-09-2006 17:56 ]


  • DigiK-oz
  • Registratie: December 2001
  • Laatst online: 27-07 11:56
Kun je geen TRIMMEAN gebruiken? Hiermee kun je een bepaald percentage van de metingen uitsluiten (bijvoorbeeld kleinste en grootste 10%)

Whatever


Verwijderd

Sloompie schreef op maandag 18 september 2006 @ 18:13:
Kun je geen TRIMMEAN gebruiken? Hiermee kun je een bepaald percentage van de metingen uitsluiten (bijvoorbeeld kleinste en grootste 10%)
Kan misschien, maar dat zijn van die gekunstelde functies (m.a.w. je kan alleen maar doen wat MS bedacht heeft).

Het simpelste is gewoon:

{=average(if(a1:a1000)<b1;if(a1:a1000>b2;(a1:a1000)))}

met a1:a1000 de data en b1 en b2 de criteria.

  • Togt
  • Registratie: Februari 2000
  • Laatst online: 24-08-2021
Heel hartelijk dank voor de antwoorden!
Detecting outliers is in principe wat ik wil doen, maar die TRIMMEAN is al een perfecte!! Nu nog inbakken in mijn Macro!

Heel hartelijk dank guys!!! Dit is dan zo'n vraag waar je zonder de juiste steekwoorden gewoon niet uitkomt in Google of help!
Pagina: 1