連貫分成文字的連貫與概念的連貫。
若要讓前言的段落之間互相有連貫,最簡單的作法就是後一段的主題句包含前一段的重要內容的關鍵字,亦即文字的連貫。
例如:前一段介紹量表,後一段可以在主題句中也提到此量表。
若是在下一段的第三句之後才出現上一段的關鍵字,就太慢了!
2015年4月23日 星期四
OTES改版後的少量分析結果
目前以40人的資料進行EFA,分析結果似乎沒有比改版前好多少。
分析結果是2或3因素結構(圖),第一因素有7題(可解釋變異量54.5%),第二因素有6題(可解釋變異量9.2%),第三因素有2題(可解釋變異量3.2%)。還有一題(第12題:準時出席)似乎不屬於任一個因素,其因素負荷量小於0.3,而且遠低於多數題目的因素負荷量。
圖、OTES陡坡圖
目前納入分析的人數不多,因此估計結果的誤差可能比較大。
我只是想先看分析結果的趨勢所以先分析。
等人數累積多一點,分析結果應該會比較穩定。
但是我猜應該還是2因素結構,可解釋變異量也不會有大幅的改變。
若想對照OTES改版前的分析結果,可點選下列網址:
http://littlegreenivy.blogspot.tw/2014/01/otes.html
http://littlegreenivy.blogspot.tw/2014/05/otesefa.html
分析結果是2或3因素結構(圖),第一因素有7題(可解釋變異量54.5%),第二因素有6題(可解釋變異量9.2%),第三因素有2題(可解釋變異量3.2%)。還有一題(第12題:準時出席)似乎不屬於任一個因素,其因素負荷量小於0.3,而且遠低於多數題目的因素負荷量。
圖、OTES陡坡圖
目前納入分析的人數不多,因此估計結果的誤差可能比較大。
我只是想先看分析結果的趨勢所以先分析。
等人數累積多一點,分析結果應該會比較穩定。
但是我猜應該還是2因素結構,可解釋變異量也不會有大幅的改變。
若想對照OTES改版前的分析結果,可點選下列網址:
http://littlegreenivy.blogspot.tw/2014/01/otes.html
http://littlegreenivy.blogspot.tw/2014/05/otesefa.html
2015年4月21日 星期二
在前言凸顯賣點的方法
1.在前言比較前面的段落提到賣點的關鍵字,例如:unidimensionality。
2.在主題句提到賣點,並專段撰寫。例如:unidimensionality的意義與價值、interval score的應用與價值、大樣本可使結果比較穩定分別用一段撰寫。
只說:賣點不凸顯,並不是一個明確的建議。
2.在主題句提到賣點,並專段撰寫。例如:unidimensionality的意義與價值、interval score的應用與價值、大樣本可使結果比較穩定分別用一段撰寫。
只說:賣點不凸顯,並不是一個明確的建議。
2015年4月16日 星期四
OTK衛教研究之人數估計
以下為以G power軟體使用OTK衛教預試的結果預估之收案人數。
|
|
核心價值
|
生理OT
|
|
實驗組平均
|
7
|
7.25
|
|
對照組平均a
|
13.25
|
15.5
|
|
實驗組得分之標準差
|
2.83
|
5.32
|
|
對照組得分之標準差a
|
1.26
|
0.71
|
|
ES (d)
|
2.853
|
2.17
|
|
Power
|
0.8
|
0.8
|
|
一組所需人數
|
4
|
5
|
a 因為收案困難,此處之對照組得分為實驗組之前測分數。
由於生理OT所需人數比較多,所以我取人數多的結果,至少需10位個案/家屬。
考量流失率(預估30%)的問題,需招募16人(無條件進入並且湊成偶數之結果)。
2015年4月2日 星期四
2015/3/23報告記錄:確認目前的衛教是預試或正式收案
報告內容:OTK衛教內容與實施方式
報告目的:確認目前的衛教是預試或正式收案
I.
概念釐清
A.
看實施方式的判斷依據:1)研究設計可否達成研究目的。2)研究設計是否可行。
B.
實驗組與對照組的病人與家屬應如何達到配對的隨機分派,以確保二組的個案與人數比例相近
C.
目前的研究設計,最直接的結果應該是OTK測驗的分數。但這對臨床人員/個案的意義有限,他們重視的還是臨床上的成效。然而臨床成效的影響因子眾多,可能衛教之後,臨床成效的提升仍然有限。所以要探討可能影響蒐集可能影響OTES與ADL CAT的因素。到底OTK增加之後,為什麼ADL會提升?
II.
研究設計:
A.
將同時收個案與家屬改為可收個案或家屬,並進行配對的隨機分派以確保二組的個案與人數比例相近。
B.
個別化衛教的成果比較方式:比較的時候可以做組內和組間的比較。組內的比較就是個人的前後測差異,組間的則是共同題的前後測差異。
*衛教一定要個別化,才能符合個案/家屬的需求。
*衛教一定要個別化,才能符合個案/家屬的需求。
C.
列出明確的收案條件,整理清楚中風個案/家屬未能參與研究的原因與各原因相對的人數,並加入流程圖中。
表、個案與家屬拒絕的原因
表、個案與家屬拒絕的原因
|
個案未能參與的原因
|
家屬未能參與的原因
|
|
個案有其它重大疾病診斷(例如:帕金森、癌症、失智症)
|
-
|
|
個案隔離
|
-
|
|
個案病情不穩,無法定期上OT
|
-
|
|
個案即將出院
|
-
|
|
認知能力受損(例如:失語症)
|
無意願參與
|
|
不識字
|
不識字
|
|
聽不懂國語
|
聽不懂國語
|
|
治療時間滿,想要休息
|
時間無法配合
|
|
無意願參與
|
收案時未遇到家屬(已向治療師詢問,治療師表示家屬晚上才會來)
|
*橘底為不符合收案標準,直接排除。白底為符合條件者拒絕的原因。
III.
報告時的注意事項:下次討論時需列出自己的困難與希望聽到建議的部分。
IV.
下次討論前需要準備的資料
A.
整理目前衛教測驗分數彙整,分2個面向(OT核心價值、生理OT)估計所需的樣本數
B.
寄信給老師和怡靜2個面向的題目。
C.
進行配對的隨機分派的作法。
2015年4月1日 星期三
[Rasch] person reliability的意義(待確認)
Person reliability是羅序分析的信度指標。
但是我不太瞭解person reliability的概念應該如何解釋。
以下是我整理自己的概念之後,對於person reliability的概念說明。
錯誤理解:person reliability與Cronbach's α 是類似的概念,數值通常也差不多。
正確的概念:person reliability是由每個人能力估計的標準誤 (standard error, SE)所計算出來的數值。當SE越小,person reliability越大,表示這個工具能夠越精準地估計人的能力。
Cronbach's α 是由題目間的相關所計算出來的數值。當題目間相關越高,Cronbach's α值越大,表示題目越相似。
然而,當題目過於相似,Cronbach's α 會很大,但是在羅序分析中,可能就無法準確估計到某些能力的人。例如:題目難度集中在中間,在估計能力偏高或偏低的人時,SE就會很大。
當SE大,person reliability就會小。
因此 person reliability和Cronbach's α是不一樣的。
但是我不太瞭解person reliability的概念應該如何解釋。
以下是我整理自己的概念之後,對於person reliability的概念說明。
錯誤理解:person reliability與Cronbach's α 是類似的概念,數值通常也差不多。
正確的概念:person reliability是由每個人能力估計的標準誤 (standard error, SE)所計算出來的數值。當SE越小,person reliability越大,表示這個工具能夠越精準地估計人的能力。
Cronbach's α 是由題目間的相關所計算出來的數值。當題目間相關越高,Cronbach's α值越大,表示題目越相似。
然而,當題目過於相似,Cronbach's α 會很大,但是在羅序分析中,可能就無法準確估計到某些能力的人。例如:題目難度集中在中間,在估計能力偏高或偏低的人時,SE就會很大。
當SE大,person reliability就會小。
因此 person reliability和Cronbach's α是不一樣的。
[Rasch]階難度沒有倒置 (disordering)的概念、意義、圖示與處理方法
階難度沒有倒置 (disordering)的定義:
在羅序分析當中,如果使用PCM進行分析,每題都會得到一組階難度的估計值。若由階難度的數值由低階排到高階是按照由小到大的順序,則表示沒有倒置。
階難度沒有倒置的意義:
1.表示每個選項都有人作答,而且不會有那個選項的作答人數特別少。
2.無多餘的選項。
Ref. Hsiao, Y.Y., et al., Examining unidimensionality and improving reliability for the eight subscales of the SF-36 in opioid-dependent patients using Rasch analysis. Qual Life Res, 2014.
呈現有無倒置的適當圖示:The response category probability curve

左圖為沒有倒置的作答機率曲線。每條曲線表示每個選項在所有能力的情況下被選到的機率。而每個選項在不同的能力狀況下,都有機會是最可能被選到的選項。例如能力值落在-0.4~-0.1,最可能被選到的選項是2。
右圖為有倒置的作答機率曲線。選項2的曲線在任何時候都低於其它曲線。表示這一群作答者幾乎沒有人選2。
發現階難度有倒置的處理方法:
1.不處理。因為這可能是這一群作答者的特性。換一群作答者不一定會有倒置的情況。
2.合併選項再重新分析。例如:將0-1-2-3合併成0-1-2,把原本的2和3合併成一個選項。
階難度倒置的錯誤解釋:
disordering of the step, indicating that the response categories could not effectively differentiate the patients from each other and were thus redundant.
Ref. Hsieh, C.L., et al., A Rasch analysis of the Frenchay Activities Index in patients with spinal cord injury. Spine (Phila Pa 1976), 2007. 32(4): p. 437-42.
在羅序分析當中,如果使用PCM進行分析,每題都會得到一組階難度的估計值。若由階難度的數值由低階排到高階是按照由小到大的順序,則表示沒有倒置。
階難度沒有倒置的意義:
1.表示每個選項都有人作答,而且不會有那個選項的作答人數特別少。
2.無多餘的選項。
Ref. Hsiao, Y.Y., et al., Examining unidimensionality and improving reliability for the eight subscales of the SF-36 in opioid-dependent patients using Rasch analysis. Qual Life Res, 2014.
呈現有無倒置的適當圖示:The response category probability curve

左圖為沒有倒置的作答機率曲線。每條曲線表示每個選項在所有能力的情況下被選到的機率。而每個選項在不同的能力狀況下,都有機會是最可能被選到的選項。例如能力值落在-0.4~-0.1,最可能被選到的選項是2。
右圖為有倒置的作答機率曲線。選項2的曲線在任何時候都低於其它曲線。表示這一群作答者幾乎沒有人選2。
發現階難度有倒置的處理方法:
1.不處理。因為這可能是這一群作答者的特性。換一群作答者不一定會有倒置的情況。
2.合併選項再重新分析。例如:將0-1-2-3合併成0-1-2,把原本的2和3合併成一個選項。
階難度倒置的錯誤解釋:
disordering of the step, indicating that the response categories could not effectively differentiate the patients from each other and were thus redundant.
Ref. Hsieh, C.L., et al., A Rasch analysis of the Frenchay Activities Index in patients with spinal cord injury. Spine (Phila Pa 1976), 2007. 32(4): p. 437-42.
2015年3月17日 星期二
判斷異常作答需考量的事(項目反應理論)
最近要看一筆資料的作答情況是否異常,再決定是要刪除人或是刪除量表題目。
異常作答的概念是指不該得高分的人得了高分,不該得低分的人得了低分。
在教育領域出現異常作答,最常見的原因有可能是猜測或作弊。
實際判斷異常作答的時候,我認為有二個議題需要考量:
1.在那個能力範圍內算是合理?
合理的意思是當人的能力超過某個範圍,就應該答對或答錯(或者得高分/低分)。
但是範圍的界定並沒有一定的標準。因為每一題的試題難度估計都有誤差,如果是採二參數或三參數模式分析,還須考量鑑別度的問題。
所以到底這個能力範圍應該設定多寬,會是個問題。
我目前是把題目難度±1當作範圍的界定依據(因為題目難度的誤差通常不會超過1,所以我以大約2個標準差作為判斷依據)。
在這個範圍之內,我認為答對答錯都有可能(或者每個選項都有可能)。
當人的能力超過某個範圍,就不應該答對或答錯(或得最低/最高分)了!
2.那種作答結果算是異常?
當題目是二分題(只有對錯或是否),判斷上比較容易。
只要當人的能力超過某個範圍,就不應該答對或答錯(或得最低/最高分)了!
異常作答的概念是指不該得高分的人得了高分,不該得低分的人得了低分。
在教育領域出現異常作答,最常見的原因有可能是猜測或作弊。
實際判斷異常作答的時候,我認為有二個議題需要考量:
1.在那個能力範圍內算是合理?
合理的意思是當人的能力超過某個範圍,就應該答對或答錯(或者得高分/低分)。
但是範圍的界定並沒有一定的標準。因為每一題的試題難度估計都有誤差,如果是採二參數或三參數模式分析,還須考量鑑別度的問題。
所以到底這個能力範圍應該設定多寬,會是個問題。
我目前是把題目難度±1當作範圍的界定依據(因為題目難度的誤差通常不會超過1,所以我以大約2個標準差作為判斷依據)。
在這個範圍之內,我認為答對答錯都有可能(或者每個選項都有可能)。
當人的能力超過某個範圍,就不應該答對或答錯(或得最低/最高分)了!
2.那種作答結果算是異常?
當題目是二分題(只有對錯或是否),判斷上比較容易。
只要當人的能力超過某個範圍,就不應該答對或答錯(或得最低/最高分)了!
但是,當題目是多點計分,例如:1-2-3-4-5,過了我們限定的範圍之後,作答者合理的作答反應到底是什麼呢?是123與345嗎?
可是,當作答者能力在最高/低的時候還得3分合理嗎?
而且,也沒有一個臨界點可以作為判斷標準:只要能力在某個範圍之內,作答者一定只會得4分,絕對不會得5分。
通常只有機率高低的問題,沒有一定。
我目前是把能力大於題目難度+1的人當作高分群,高分群不可能得1、2分。
能力小於題目難度-1的人當作低分群,低分群不可能得4、5分。
至於得3分的人,只在能力最高和能力最低的人看是否有出現,以判斷異常。
以上是我的一點想法,歡迎大家分享意見。
可是,當作答者能力在最高/低的時候還得3分合理嗎?
而且,也沒有一個臨界點可以作為判斷標準:只要能力在某個範圍之內,作答者一定只會得4分,絕對不會得5分。
通常只有機率高低的問題,沒有一定。
我目前是把能力大於題目難度+1的人當作高分群,高分群不可能得1、2分。
能力小於題目難度-1的人當作低分群,低分群不可能得4、5分。
至於得3分的人,只在能力最高和能力最低的人看是否有出現,以判斷異常。
以上是我的一點想法,歡迎大家分享意見。
2015年3月15日 星期日
增加OTK衛教人數的可能方法
因為願意參與OTK衛教的人數過少,所以我想了幾個可能可以增加收案人數的方法,以改善原本的研究設計之不足。
這些方法應該可以合併使用。
又,如果一個時段有二人願意參與,可考慮二人同時進行衛教。
原本的研究設計:
參與者:中風個案或家屬(註:更早之前的參與者為中風個案與家屬,但目前的名單沒有符合此條件的參與者)
流程:參與者每日接受0.5-1小時的衛教(約需3日才能完成),並於衛教前後一日完成OTK測驗。
衛教時間:個案接受治療的時間、家屬/個案有空的時間
可能的方法一:
邀請對象:中風個案或家屬
流程:個案或家屬同意參與之後,立即完成前測
↓
約1次完整的時間,把1.5-2小時的衛教內容講完
↓
衛教後隔日進行後測
衛教時間:家屬/個案有空的時間
優點:縮短研究所需天數,可以收到快出院的個案
缺點:仍需要同一位家屬參與3次、個案或家屬不一定願意抽1.5-2小時聽OTK
可能的方法二:
邀請對象:中風家屬
流程:發意願調查表給晚上才會出現的家屬(請個案或看護轉交)
↓
家屬同意參與之後,立即完成前測
↓
約1次完整的時間,把1.5-2小時的衛教內容講完(日夜皆可)
↓
衛教後隔日進行後測
優點:(1)縮短研究所需天數,可以收到快出院的個案家屬。(2)配合家屬到院時間提供衛教,可能可以找到較多家屬。
缺點:(1)仍需要同一位家屬參與3次。(2)個案或家屬不一定願意抽1.5-2小時聽OTK。(3)家屬在晚上已經累了,不想聽衛教。
這些方法應該可以合併使用。
又,如果一個時段有二人願意參與,可考慮二人同時進行衛教。
原本的研究設計:
參與者:中風個案或家屬(註:更早之前的參與者為中風個案與家屬,但目前的名單沒有符合此條件的參與者)
流程:參與者每日接受0.5-1小時的衛教(約需3日才能完成),並於衛教前後一日完成OTK測驗。
衛教時間:個案接受治療的時間、家屬/個案有空的時間
可能的方法一:
邀請對象:中風個案或家屬
流程:個案或家屬同意參與之後,立即完成前測
↓
約1次完整的時間,把1.5-2小時的衛教內容講完
↓
衛教後隔日進行後測
衛教時間:家屬/個案有空的時間
優點:縮短研究所需天數,可以收到快出院的個案
缺點:仍需要同一位家屬參與3次、個案或家屬不一定願意抽1.5-2小時聽OTK
可能的方法二:
邀請對象:中風家屬
流程:發意願調查表給晚上才會出現的家屬(請個案或看護轉交)
↓
家屬同意參與之後,立即完成前測
↓
約1次完整的時間,把1.5-2小時的衛教內容講完(日夜皆可)
↓
衛教後隔日進行後測
優點:(1)縮短研究所需天數,可以收到快出院的個案家屬。(2)配合家屬到院時間提供衛教,可能可以找到較多家屬。
缺點:(1)仍需要同一位家屬參與3次。(2)個案或家屬不一定願意抽1.5-2小時聽OTK。(3)家屬在晚上已經累了,不想聽衛教。
2015年2月10日 星期二
[思考]把原始分數轉為等距量尺 (interval scale) 的意義為何?
我最近看了一些羅序分析的文章,部分文章的研究目的是把量表的原始分數(通常為序列量尺)轉換為等距量尺 (interval scale)的型態。
然而我有一個疑問:如果量表應用於特定族群的羅序分析的結果只能應用在驗證的族群上(例如:SCI一年以上、中風後半年),
當驗證的族群比較侷限的時候,將量表分數轉為等距量尺的意義是否很有限?
例如:分數只適用於中風後半年的人,而此分數未必適用於中風未滿半年或半年以上的人,因為這些人參數估計的結果未必和中風後剛好半年的人相似。
我的想法是:如果驗證的對象涵蓋範圍比較廣,像是中風後半年以上、慢性思覺失調症,
把量表的原始分數轉換為等距量尺的分數以供後人對照與參考,意義較大。
如果驗證的對象涵蓋範圍較窄,像是職業災害後一個月、中風後三個月,
把量表的原始分數轉換為等距量尺則比較像是附加產品或中間產物,目的是要進行下一步的運算(例如計算反應性)。
不知道這樣的想法是否合理?
再麻煩大家提供意見囉!謝謝。
然而我有一個疑問:如果量表應用於特定族群的羅序分析的結果只能應用在驗證的族群上(例如:SCI一年以上、中風後半年),
當驗證的族群比較侷限的時候,將量表分數轉為等距量尺的意義是否很有限?
例如:分數只適用於中風後半年的人,而此分數未必適用於中風未滿半年或半年以上的人,因為這些人參數估計的結果未必和中風後剛好半年的人相似。
我的想法是:如果驗證的對象涵蓋範圍比較廣,像是中風後半年以上、慢性思覺失調症,
把量表的原始分數轉換為等距量尺的分數以供後人對照與參考,意義較大。
如果驗證的對象涵蓋範圍較窄,像是職業災害後一個月、中風後三個月,
把量表的原始分數轉換為等距量尺則比較像是附加產品或中間產物,目的是要進行下一步的運算(例如計算反應性)。
不知道這樣的想法是否合理?
再麻煩大家提供意見囉!謝謝。
訂閱:
文章 (Atom)
