|
亞太科學教育論壇,第六期,第一冊,文章二(二零零五年六月) 陳素芬、張大慈、林立元、陳曉郁 大學生科技跨領域學程之課程評量 |
| 上一頁 內容 下一頁 | |
|
|
貳、 課程評量文獻探討
大學課程的評量方式與目的約可分為三類。第一類是課程研究,著重課程理念與結構分析,但不涉及學生特質、學習過程或個別教師的信念與教學等。第二類是績效評鑒,重於檢視課程對學生的學習及人格發展的影響。第三類是效能指標,乃直接就修課人數與修讀情形等設立指標判斷某些教育效能。研究者對第一類研究主要在檢視課程的本質與架構,包含目標、理念、必選修課及相關規定等。例如, 美國大學協會 (Association of American Colleges ,簡稱 AAC) (1991) 建議大學課程應考量四個基本要素:課程的一致性 (curricular coherence) 、批判觀點 (critical perspective) 、學習連結 (connected learning) ,及包容性 (inclusiveness) 。 AAC 強調目標、課程、教學與評鑒之間的一致性,並指出應明確地將課程目標傳達給師生。而課程中也應促進學生的批判思考能力,例如:能容納他人的批評、挑戰自己的想法、願意修改根深蒂固的觀念等。另外, AAC 提出五項關於學習之連結的建議,其中涵蓋經驗與知識的連結、課堂內容與真實世界的連結、將課堂內所學的內容應用在課堂外的情境當中、原則與概念的統整,以及鼓勵學生檢驗異於自己原有想法的主張等。最後,課程應儘量納入不同類型的學生,去除某些可能造成特定族群(如女性或男性)學生修讀的障礙。至於基礎概論課程則應以引導學生入門為主,而不是以排除無法勝任的學生為目標。況且好的課程應能讓學生在不同階段 (entry points) 進入到該主修領域。 Lattuca 和 Stark (1994) 根據這四項基本要素,進一步分析十門學科的課程結構,發現理工科系普遍在課程的一致性上表現優良,惟多重視學生被動性地吸收現有的科學知識而非反省這些知識,缺乏培養學生批判性思考能力的規劃。此外,理工科系的課程在學習連結方面的表現亦不明顯,教授們多半覺得大學生應先學習基本知識,等到上研究所之後再著重學習連結的部分。 Lattuca 和 Stark 也指出,理工科系課程的包容性很差,若學生沒有從高中階段就按部就班地跟著學校課程的安排多選修數理科目,則未來不易進入理工科系就讀。除了 AAC 的標準之外, 美國科學研究院 (National Research Council)(1996 ; 1999) 及 美國國家科學基金會 (National Science Foundation)(1996) 都曾經針對大學的數學、理、工科系課程提出建議,這些建議亦可用來評量課程的適當性。
第二類的評量是以量化的方式,如以前測、後測或問卷以檢驗某單一課程是否達到最起碼的標準,或比較幾個課程之間的效果。常見的方式大致分成二種。其一是根據課程目標制訂測驗的內容,以評鑒學生在修完課程後,是否達到預期的目標,如學生的知識、實驗技巧與興趣是否提升等;此類評量直接取其目標作為評量標準。也有學者 ( 如 Scriven, 1980) 深入探討課程目標是否適當或者是否符合公平原則,這可歸類在前一段所討論的課程理念分析。舉例而言, Bennett(2001) 曾針對大專生學習評量的效度提出討論,認為唯一真正有效度的評量方式就是檢測同一批學生從入學到畢業期間智能增長的情形,即價值增長 (value added) 。同樣的思維也可用以評量學生的態度與技能。在實踐上,從價值增長的觀點進行的課程評量應注意至少三個可能的問題。第一,各大學自有它不同的辦學目標,且通常含括多個面向,無法以學生少數項目的能力作為總體指標。尤其是各單位對於應列為首要評量的面向很難有共識,如果採用價值增長的方式恐怕無法面面俱到。第二,有些教育結果並不是在畢業時就已顯現出來,因此可能要把校友也納入評量的範圍內,讓校友也成為研究對象。第三,在研究時必須掌握學生修課的起點與修畢的時間點。對於不用事先申請即可修讀的課程,如輔系或學程等,相當不易掌握修讀對象及施行前、後測的時間點。最後,價值增長的評量過程頗複雜又相當耗費財力,有可能降低教學單位的實施意願。
其二是由學生畢業後的表現倒推得知其課程的影響力。這對大學課程評鑒來說尤其重要,因為各個學生選修課程不一,以此方式比較能看出不同課程的成效。譬如在通識或共同必修方面, Ratcliff (1992) 曾用課群分析模式 (Course Cluster Analysis Model) 估計不同課程對不同類型學生產生的影響。其作法是將不同類型的學生 ( 如轉學生與非轉學生、住宿生與通勤生等 ) 分組進行比較,依修課記錄分成幾種修課模式 (coursework taken patterns) ,然後將學生的修課分數和 GRE (Graduate Record Examinations) 分數相互比較。該評量方式的優點是可以知道某一門課對於不同類型學生的教學成效,而學校可根據此項結果修訂課程。該評量方式的缺點則是學生必須參加類似 GRE 的標準測驗或畢業考試,而這些考試常局限在測驗語文或推理等基本能力,並不適合用於評估專業科目,如物理或跨領域課程等。另外一種評量專業領域的方式是在學生畢業數年後,追蹤學生核心課程的平均分數、教師對該名學生的評價 (instructors’ ranking) 、學期成績總平均 (overall GPA) 和他日後成就之間的關係。若評量者對成就能有清楚的定義,那麼這會是相當客觀的評量方式,評量結果具說服力。但它的缺點是無法在短期內給予課程及時、有益的回饋藉以改進課程。
第三,由學生的修讀情形可形成數項評量指標,提供課程修正時作為參考。例如,在 美國及荷蘭等休學率較高的國家,其休學率反應學生在大學�堛瑣A應情形、學生對於投資報酬率的估算,以及學生個人的學習動機與經濟狀況 (Beekhoven, De Jong, & Van Hout, 2003) 。因此,若分析學生的修課模式 (coursework taken patterns) ,尤其是依序修過哪些課。然後將之與將該生休學與否這點比對,可找出哪些課程有助於學生在入學後的學習與適應。更進一步可清楚某些課程對於某些背景的學生可能有關鍵性地正面或負面影響。
總之,直至目前為止,對於大學跨領域課程的評量方式及內容,專家學者們並無定論 (Klein, 1999) 。上述三類評量各有其優點與限制。 Farmer 和 Napieralski (1997) 以及 Field, Lee 和 Field (1994) 曾指出:高等教育的課程評量趨勢已漸由量化轉為質化、從總結性評量 (summative evaluation) 拓展到形成性評量 (formative evaluation) 、從單一價值判斷到重視多元評量,這和整體教育評量的趨勢一致。但對於大部分不具教育學背景的教授及行政人員而言,他們無法根據這樣的敘述具體地判斷學程的成效以及應改進之處。因此,本研究其中一個目的就是要研擬具體指標以進行跨領域學程的評量。
Copyright (C) 2005 HKIEd APFSLT. Volume 6, Issue 1, Article 2 (June, 2005). All Rights Reserved.