f-test, t-test, statistická významnost

AAndyy10.10.2015 20:19 (Upr. 10.10.2015 23:34) Nahlásit
Dobrý den, už druhý den si lámu hlavu se statistickým zhodnocením a stále jsem se nepohla z místa. Mám např. stanovení vápníku v krvi u šesti ryb z jedné skupiny a u sedmi ryb z druhé skupiny (každá skupina je jiný druh a já mám statisticky zhodnotit f-testem, t-testem a statistickou významností p, jaký je mezi těmito dvěmi skupinami rozdíl).
1. skupina:2,925; 2,553; 4,897; 2,589; 2,831; 2,724; vypočítala jsem průměr 3,087 a směrodatnou odchylku 0,820;
2. skupina 2,793; 3,141; 2,386; 2,840; 2,581; 2,664; 2,424; průměr 2,690; směrodatná odchylka 0,227. A dál sem se nedostala, netuším co s čím a jak. Našla jsem si různé vzorečky a charakteristiku na f-test, t-test a p, ale je to pro mě nepochopitelné. Našel by se tu někdo, kdo by dokázal někomu tak nechápavému, jako jsem já vysvětlit co s tím mám dělat, protože já už jsem úplně v koncích. :-(

Odpovědi

Přidat odpověď ▾

Diskuze

Cenobita.10.10.2015 23:09 (Upr. 11.10.2015 10:06) Nahlásit
když si to dáš do Excelu tak se to počítá: ulož to jako "Priklad.csv"

2,925;2,793;
2,553;3,141;
4,897;2,386;
2,589;2,84;
2,831;2,581;
2,724;2,664;
;2,424;
1.skupiny;2.skupiny;
=AVERAGEA(A1:A6);=AVERAGEA(B1:B7);Aritmetický průměr
=SMODCH.VÝBĚR(A1:A6);=SMODCH.VÝBĚR(B1:B7);Směrodatná odchylka
"=FTEST(A1:A6;B1:B6)";F-Test
"=TTEST(A1:A6;B1:B7;2;2)";T-Test

zde si přečti F-Test:

http://cit.vfu.cz/statpotr/POTR/Teorie/Predn3/Ftest.htm

1.skupiny 2.skupiny
3,0865 2,689857143 Aritmetický průměr
0,898087691 0,262119202 Směrodatná odchylka
0,01570772 F-Test
0,285948545 T-Test

Máš chybu ve druhém výpočtu, správně má být arit. průměr: 2,689857143
a správně má být směrod odchylka: 0,262119202
AAndyy10.10.2015 23:31 Nahlásit
Aritmetický průměr a SD jsem schopná vypočítat a F-test jsem si přečetla, ale když vidím ty vzorce f-testu a t-testu, tak je mi jasný, že to nikdy nemůžu pochopit. Potřebuju poradit, nejlépe krok po kroku na tomto příkladu, co a kam se dosazuje do vzorce f-testu a t-testu a proč (nějak srozumitelněji, pro opravdu nechápavé jedince). Jinak děkuji Cenobita. za odpověď.
Cenobita.11.10.2015 00:22 (Upr. 11.10.2015 00:53) Nahlásit
Ten F-test se provede porovnáním dvou směrodatných odchylek, já to počítám v Excelu takto:

=FTEST(A1:A6;B1:B6)

F-Test: p=0,01570772
=================

Zde je to celé vysvětlené na příkladech:

MODELOVÉ PŘÍKLADY

http://cit.vfu.cz/statpotr/POTR/priklady.htm#Pr7
AAndyy11.10.2015 00:33 (Upr. 11.10.2015 00:41) Nahlásit
Není f-test spíše rozdíl dvou rozptylů? Aspoň takto se to píše v nadpisu té stránky cit.vfu.cz...
Cenobita.11.10.2015 00:35 (Upr. 11.10.2015 00:56) Nahlásit
F-Test je porovnání dvou sad měření. V Excelu lze spočítat výběrem dvou sad hodnot a pak se automaticky porovnají rozptyly, můžeš to porovnat ručně, ale je to poměrně složité jsou tam ty kvantily, ani už to ručně neumím.

mezi rozptyly souborů byl zjištěn statisticky významný rozdíl když (p<0,05)

Což je tvůj příklad a případ.
AAndyy11.10.2015 00:47 Nahlásit
Děkuji a ten statisticky významný rozdíl zjistím jak?
Cenobita.11.10.2015 00:50 (Upr. 11.10.2015 00:53) Nahlásit
Kdy ti výjde F-Test: p=0,01570772, je to hodnota menší než 0,05, tzn. že mezi rozptyly souborů byl zjištěn statisticky významný rozdíl (p<0,05).
AAndyy11.10.2015 01:01 Nahlásit
Moc děkuju a zkusila jsem T-test u hodnot 1.skupiny: 2,925; 2,553; 4,897; 2,589; 2,831; 2,724 u 2.skupiny: 2,793; 3,141; 2,386; 2,84; 2,581; 2,664; 2,424 a vyšlo mi 1,122539394, je to správně, nebo úplná blbost? Pokusila jsem se to spočítat podle vzorce ručně, protože v excelu nevím, co kam zadat.
Cenobita.11.10.2015 01:10 (Upr. 11.10.2015 01:56) Nahlásit
Je to jak říkáš blbost, mě to vyšlo jinak, výsledek je dole.
Cenobita.11.10.2015 01:20 (Upr. 11.10.2015 01:56) Nahlásit
OK já jen ověřuji, že to je to opravdu správně (protože v tom prvním příkladu byla také chyba). Takže otevři si texťák a ulož si do něj toto (do souboru, priklad.csv) jak to otevřeš v Excelu, tak se to samo vypočítá:

2,925;2,793;
2,553;3,141;
4,897;2,386;
2,589;2,84;
2,831;2,581;
2,724;2,664;
;2,424;
1.skupiny;2.skupiny;
=AVERAGEA(A1:A6);=AVERAGEA(B1:B7);Aritmetický průměr
=SMODCH.VÝBĚR(A1:A6);=SMODCH.VÝBĚR(B1:B7);Směrodatná odchylka
"=FTEST(A1:A6;B1:B6)";F-Test
"=TTEST(A1:A6;B1:B7;2;2)";T-Test
Cenobita.11.10.2015 01:22 (Upr. 11.10.2015 01:57) Nahlásit
toto jsou výsledky:

1.skupiny 2.skupiny
3,0865 2,689857143 Aritmetický průměr
0,898087691 0,262119202 Směrodatná odchylka
0,01570772 F-Test
0,285948545 T-Test

to znamená, že mezi rozptyly souborů byl zjištěn statisticky významný rozdíl (p<0,05).
AAndyy11.10.2015 01:25 Nahlásit
Tohle bych všechno jakš takš chápala (konečně :-)), ale ještě nevím, jak vypočítat studentův T-test.
AAndyy11.10.2015 01:35 Nahlásit
A nevíš proč jsou tam ty dvě dvojky (strany 2, typ 2 - v excelu), ty tam jsou vždy nebo jen v tomto případě? Jinak opět DĚKUJU :-*
Cenobita.11.10.2015 01:40 (Upr. 11.10.2015 02:26) Nahlásit
No je to tak v tom příkladu (podrobně to nevím je to potřeba nastudovat):

první číslo: 2 - dvojstraný test
druhé číslo: podle F-Testu

více návod níže

Do řádku Strany (příp. Chvosty - podle verze MS Excel) zadat 2 (dvojstranný t-test) a do řádku Typ zadat 3 (podle výsledku předchozího F-testu: dva výběry s různým rozptylem).



http://cit.vfu.cz/statpotr/POTR/priklady.htm#Pr7

a vysvětluje to ta wikipedie:

http://cs.wikipedia.org/wiki/T_test
AAndyy11.10.2015 01:45 Nahlásit
v excelu mi ty výsledky vycházejí furt jinak, mám stejný aritmetický průměr, ale SD mám 0,820 a 0,243 a f-test 0,00940
Cenobita.11.10.2015 01:47 (Upr. 11.10.2015 01:51) Nahlásit
děláš to z csv ?

Můžeš mít jinou verzi Excelu takže ty funkce musíš asi vyplnit ručně, bůhví jak se ty verze mezi sebou liší Microsoft to stále mění.
AAndyy11.10.2015 01:51 Nahlásit
Úplně se bojím říct, že ani nevím co csv, dělám to v obyčejném excelu, ale mělo by to všude vycházet stejně, nebo ne? :-D
AAndyy11.10.2015 01:54 Nahlásit
Mám to stejné a stejně zadané, ale mám jiný výsledky, to už bude asi zavařený mozek. :-)
Cenobita.11.10.2015 01:59 (Upr. 11.10.2015 02:03) Nahlásit
Ve výsledcích nemůže být rozdíl, nějak špatně to zpracovává tvůj Excel ... ten můj správně, už to mám ověřené že to dělám dobře, zkontroluj zda je vše dobře zadané.

OK ale to je pracné stačí otevřít texťák vkopírovat tam zdrojový kód uložit a přejmenovat na TXT>CSV, pak to stačí otevřít a všechno se to samo vypočítá bez práce :-) Toto vkopíruj do textu:

2,925;2,793;
2,553;3,141;
4,897;2,386;
2,589;2,84;
2,831;2,581;
2,724;2,664;
;2,424;
1.skupiny;2.skupiny;
=AVERAGEA(A1:A6);=AVERAGEA(B1:B7);Aritmetický průměr
=SMODCH.VÝBĚR(A1:A6);=SMODCH.VÝBĚR(B1:B7);Směrodatná odchylka
"=FTEST(A1:A6;B1:B6)";F-Test
"=TTEST(A1:A6;B1:B7;2;2)";T-Test
Cenobita.11.10.2015 02:02 (Upr. 11.10.2015 02:03) Nahlásit
To bohužel zda 2 nebo 3 nevím to souvisí s F-Testem, ale musíš si to někde přečíst, já nevím co tam zadat, ve skriptech to nemáte ?, já bych to musel vyhledat na netu.
AAndyy11.10.2015 02:08 Nahlásit
Ve skriptech mám právě akorát ten pro mě nepochopitelný vzorec a teprve v excelu jsem narazila na stránku a typ, takže vůbec nevím, proč to tam je, ale pohledám to. Moc děkuju za obrovskou pomoc.
Cenobita.11.10.2015 02:14 (Upr. 11.10.2015 02:22) Nahlásit
Hlavně bych doporučoval zvládnout ten Excel. Statistické výpočty jsou obecně velmi složité, hlavně náročné na čas a často se člověk sekne, Excel chyby nedělá.
AAndyy11.10.2015 02:17 Nahlásit
Je mi jasné, že není chyba v excelu. :-D
Cenobita.11.10.2015 02:20 (Upr. 11.10.2015 02:21) Nahlásit
To jsem nemyslel na tebe, ale že ten Excel udělá výpočty, které by trvaly hodinu na pár vteřin.

http://support.office.com/cs-cz/article/T-TEST-funkce-d4e08ec3-c545-485f-962e-276f7cbed055

T.TEST(matice1,matice2,chvosty,typ)

Syntaxe funkce T.TEST má následující argumenty:

Matice1: Povinný argument. Jedná se o první množinu dat.
Matice2: Povinný argument. Jedná se o druhou množinu dat.
Chvosty: Povinný argument. Určuje, zda se jedná o jednostranné či dvoustranné rozdělení. Pokud chvosty = 1, použije funkce T.TEST jednostranné rozložení. Pokud chvosty = 2, použije funkce T.TEST dvojstranné rozložení.

Typ: Povinný argument. Jedná se o typ t-testu, který má být proveden.

1 Párovaný
2 Dvojvýběrový s rovností rozptylů
3 Dvojvýběrový s nerovností rozptylů
AAndyy11.10.2015 02:29 Nahlásit
Takže to chápu tak,že by rozptyly u obou skupin musely být rovny, což nejsou, takže by tam měla být ta 3?
Cenobita.11.10.2015 02:31 Nahlásit
No to já zase nevím, ta rovnost nemusí být zcela přesně, ale takové "přibližná", to musíš dohledat v těch příkladech ze zemědělky viz výše nebo na netu.
AAndyy11.10.2015 02:33 Nahlásit
Dobře, ještě jednou moc děkuju a už spíše dobré ráno než dobrou noc. :-)
AAndyy11.10.2015 04:28 Nahlásit
Kdyby to ještě někoho zajímalo, tak jsem vykoumala, že typ 3 se dává, když F-test výjde menší než 0,05 a typ 2, když F-test výjde větší než 0,05.
Přidat komentář do diskuze ▾