教育評價的算法轉(zhuǎn)型_第1頁
教育評價的算法轉(zhuǎn)型_第2頁
教育評價的算法轉(zhuǎn)型_第3頁
教育評價的算法轉(zhuǎn)型_第4頁
教育評價的算法轉(zhuǎn)型_第5頁
已閱讀5頁,還剩7頁未讀 繼續(xù)免費閱讀

下載本文檔

版權(quán)說明:本文檔由用戶提供并上傳,收益歸屬內(nèi)容提供方,若內(nèi)容存在侵權(quán),請進行舉報或認領(lǐng)

文檔簡介

/教育評價的算法轉(zhuǎn)型【摘要】伴隨著算法從“人為加減乘除”的公式演變?yōu)椤澳茏寵C器自動運行”的代碼,原本受控于人、服務(wù)于人的算法也將變得不再百分百“聽話”,乃至因此將教育評價置于前所未有的挑戰(zhàn)之中。歷史地看,公式之上的教育評價不僅意味著觀念解放、方法改進與權(quán)力創(chuàng)新,也面臨著因為“人的誤解和濫用”而徒增的精神幻想、價值沖突和現(xiàn)實霸權(quán)。現(xiàn)實地看,代碼驅(qū)動的教育評價雖有益于祛魅幻想、調(diào)適沖突和制衡霸權(quán),卻可能因為“把人排除在外”而墮入觀念失調(diào)、方法失格和權(quán)力失范之中。由此看來,教育評價的算法進路非但無法被表述為從公式到代碼的必然進步,反而有必要將之澄清為前所未有的教育評價挑戰(zhàn)。相應(yīng)地,接受算法主體以更新觀念、吸納算法決策以創(chuàng)變方法、引入算法治理以改善權(quán)力,也就構(gòu)成了教育評價回應(yīng)算法轉(zhuǎn)型的時代進路。【關(guān)鍵詞】教育評價;人工智能;算法;公式;代碼 ChatGPT的成功表明了算法之于人工智能的重要性。這除了可以驗證謝諾夫斯基“算法才是智能時代的核心驅(qū)動力量”[1]的前瞻性觀點,更將從根本上改變?nèi)藗儗τ跀?shù)據(jù)和算法的認識。要知道,自2012年美國前總統(tǒng)奧巴馬提出“數(shù)據(jù)是未來的石油”的看法以來,大數(shù)據(jù)便成了世界各國爭奪人工智能技術(shù)高地的關(guān)鍵領(lǐng)域。與之不同,ChatGPT的核心工作機制是提示學(xué)習(xí)(Prompting),該機制去除了模型對數(shù)據(jù)的依賴,或者說它解放了大模型,不再走多任務(wù)、子任務(wù)的訓(xùn)練路向,而是借助大模型已經(jīng)擁有的全局數(shù)據(jù)內(nèi)在統(tǒng)計概率的優(yōu)點,以生成任何內(nèi)容。[2]如此一來,算法也將因為ChatGPT擁有了先于數(shù)據(jù)的技術(shù)地位。如此一來,算法之于教育評價的重要性也將從“幕后”走向“臺前”。 在此背景下,伴隨著算法從“人為加減乘除”的公式演變?yōu)椤澳茏寵C器自動運行”的代碼①,原本受控于人、服務(wù)于人的算法也將變得不再百分百“聽話”。如此一來,即便算法之于教育評價的前提性和重要性依然不容置喙,但這樣的微妙變化卻可能將教育評價置于前所未有的挑戰(zhàn)之中。相應(yīng)地,追溯公式之上的教育評價,澄清代碼驅(qū)動的教育評價,不僅有益于呈現(xiàn)教育評價的算法起源、演進及進路,更可為教育評價回應(yīng)算法轉(zhuǎn)型提供引玉之磚。 一、教育評價的算法起源 盡管在今日之人看來,教育評價可以使用公式進行加減乘除,以求得各種平均分、方差、相關(guān)系數(shù)、中位數(shù)和標準值已經(jīng)是不言而喻之事。然而,一旦人們將教育評價的視角拉回到歷史現(xiàn)場,基于公式的教育評價也就顯得不再“事有必至、理有固然”。要知道,對不曾放棄追問終極意義的教育評價而言,用算法將問題公式化不僅遠離了形而上的思辨?zhèn)鹘y(tǒng),也意味著回避人類現(xiàn)實及其意義。因此之故,人們有必要在現(xiàn)代化進程中澄清“教育評價何以能使用公式”。 人類開啟現(xiàn)代化的重要標志便是,由哥白尼引發(fā)的天文學(xué)革命不僅促進了人們對自然的全新理解,更通過自然的數(shù)學(xué)化而為社會生活的合理設(shè)計與理性選擇奠定了觀念基礎(chǔ)。[3]167比如,伽利略在《試金者》曾留下了“自然數(shù)學(xué)化”的標志性話語,“哲學(xué)被寫在那本永遠在我們眼前打開著的偉大之書上。我指的是宇宙,但如果我們不先學(xué)會語言和把握符號,就無法理解它。本書以數(shù)學(xué)語言書寫,符號就是三角形、圓和其他圖形,沒有這些符號的幫助,便無法理解它的片言片語。沒有這些符號,人們只能在黑暗中徒勞地摸索。”[4]18這種因為現(xiàn)代天文學(xué)成功而試圖將數(shù)學(xué)納入到人類基本事務(wù)的觀念,它一方面可以歸因于由哥白尼引發(fā)的天文學(xué)革命啟發(fā)了越來越多的思想家,開始將自然數(shù)學(xué)化的努力由科學(xué)領(lǐng)域向社會領(lǐng)域進行全方位移植。[3]163另一方面則是因為,從17世紀開始,亞里士多德的自然概念及其“圓滿實現(xiàn)”受到了根本性批駁,所以思想家們才會對構(gòu)造一幅可以用數(shù)學(xué)進行計算的世界圖景充滿了興趣。[5]164以此推之,基于公式的教育評價其實源于這樣一種觀念的誕生,“數(shù)學(xué)結(jié)果既是具體、明確、客觀的數(shù)字,也是獨立于其觀測之外的結(jié)論,更代表著遺傳于無法動搖的牛頓學(xué)術(shù)大廈的、名副其實的柏拉圖式事實”[6]144。 在此觀念背景下,教育評價方才可能接受公式,并據(jù)此開啟了自身的算法之旅。如此轉(zhuǎn)變的出發(fā)點在于,如果可以去除那些變化、特殊、偶然、不穩(wěn)定、非理性、不一致的教育內(nèi)涵及其細節(jié),那么教育中人能否像天文學(xué)家揭示宇宙真理一般尋找可以用公式予以描述甚至放之四海而皆準的教育規(guī)律?從此之后,教育的經(jīng)驗、傳統(tǒng)和文化不僅被褫奪了評價的權(quán)威意義,還因之被降格為了沉耽于直覺、充滿偏見、混亂不堪且需要被拯救的舊迷津,而公式則順勢被推崇為了祛魅這些迷思的新工具。同時,教育除了要遵從人類的先天稟賦、后天理智與公序良俗,還要受到數(shù)學(xué)背后邏輯、規(guī)律和秩序的引領(lǐng)。相應(yīng)地,教育評價也因為公式的引入而實現(xiàn)以下三點進步。 第一,基于公式的觀念解放。將公式引入教育評價意味著鼓勵人們站在由現(xiàn)代數(shù)學(xué)成就構(gòu)成的“阿基米德點”之上,用一種與自身感受無關(guān)但同樣事實清楚、論證合理且意義明確的方式,重新理解現(xiàn)實與真相、人類與世界之間的關(guān)系。如此觀念解放之于教育評價的意義在于:當(dāng)公式被成功引入教育評價之后,那些在個體尺度上混亂不堪的事實,不僅在群體尺度上涌現(xiàn)出了清晰且美妙的規(guī)律,那些雜亂無章、直觀狹隘、封閉循環(huán)的經(jīng)驗性謬誤也有機會在數(shù)學(xué)的尺度上得到檢驗和澄清;與此同時,講感覺不講邏輯、喜歡籠統(tǒng)不重視精確、容易受文字而非事物因果關(guān)系的影響、盲從于權(quán)威與教條而不尊重客觀事實的教育評價也受到了根本性挑戰(zhàn)和制約;更重要的是,現(xiàn)代數(shù)學(xué)的成功啟發(fā)教育評價放棄了對經(jīng)驗的沉迷與對意義的苛求,轉(zhuǎn)而換之以對公式的接受、信奉和推崇,進而允許、支持和驅(qū)動了現(xiàn)代教育用更準確、更高效的方式對教育活動、教育過程和教育結(jié)果作出判斷。這不僅從根本上拓展和豐富了教育評價的指導(dǎo)性觀念,更讓后續(xù)的方法改進和權(quán)力創(chuàng)新成為可能。 第二,基于公式的方法改進。當(dāng)教育開始嘗試應(yīng)用公式作為評價的尺度之后,它意味著,教育評價開始從猶疑走向肯定、從模糊走向精確、從神秘走向公開、從可描述走向可比較;不再片面倚重形而上推理、不再以感性經(jīng)驗作為判斷事物的依據(jù),而是要通過可重復(fù)、可檢驗的計算以發(fā)現(xiàn)教育規(guī)律;相應(yīng)地,能否借由公式進行計算從此便成了教育模仿自然科學(xué)的方法橋梁。自此,教育不僅致力于提出可用于計算的假設(shè)、給出可用于計算的操作性定義、采用計算的方式處理經(jīng)驗和材料,與此同時,能否計算、如何計算抑或與計算的接近程度也順勢構(gòu)成了衡量教育評價是否科學(xué)的標桿。在此基礎(chǔ)上,公式在教育評價中的成功應(yīng)用不僅直接孕育了以經(jīng)典測量理論、項目反應(yīng)理論和概化理論為代表的方法改進,更成功解決了教育評價的精確性、完備性、一致性等方法難題。 第三,基于公式的權(quán)力創(chuàng)新。只要教育評價追求滿足公式化的數(shù)學(xué)條件,那么它就必須體現(xiàn)出某種一致性、精確性和完備性。反言之,公式代表著有益于教育受到約束、凝聚共識,以及形成預(yù)期的規(guī)范依據(jù)及其相應(yīng)的權(quán)力。這樣的權(quán)力可以概括為價值預(yù)設(shè)和路徑規(guī)劃。其中,基于公式的價值預(yù)設(shè)在于確定教育評價的特定問題,從而在數(shù)學(xué)層面規(guī)定“評什么”;基于公式的路徑規(guī)劃在于確定教育評價的具體策略,從而在數(shù)學(xué)層面決定“如何評”。在此基礎(chǔ)上,只要在教育評價植入必要的公式,便能引領(lǐng)人們朝著算法預(yù)設(shè)的方向進行選擇和發(fā)展,以及帶來一些人對另一些人所希望和預(yù)定的影響。其中,頗具代表性的權(quán)力創(chuàng)新便是指向平均標準的公式。歷史而言,人們不僅借助指向平均標準的教育評價實現(xiàn)了向多數(shù)人的機會開放和資源傾斜,也因此在經(jīng)年累月的實踐應(yīng)用中實現(xiàn)了對裙帶關(guān)系、任人唯親、階層歧視的制衡。[7]40更重要的是,指向平均標準的公式,既奠定了銜接上下、整合四方、可統(tǒng)一比較的教育評價制度,也為解決教育評價中人才選拔、資源分配、督導(dǎo)管理的信息不對稱提供了可能,更讓教育的成本控制、規(guī)模擴大、效率增加、條件改善擁有了清晰可鑒的評價依據(jù)。 辯證地看,公式的引入既重塑了教育評價的觀念與方法,也讓教育評價在更大范圍發(fā)揮出了影響人和規(guī)范人的效果,更讓多數(shù)人因此而受益。不過,當(dāng)初伽利略將數(shù)學(xué)形容為自然科學(xué)的語言,但他并沒有將人類的情感、成就和洞見包含在內(nèi)。可是,后來之人沿著伽利略的理想走下去時,他們不但因為自然的數(shù)學(xué)化出賣了人類生存的完整性,更因此把值得人類紀念的文化積淀及其洞見都劃給虛幻的、不真實的部類。[8]52所以,就算公式之上的教育評價取得了可謂豐碩的成就,但人的誤解和濫用讓它始終面臨著“阿喀琉斯之踵”。 其一,始于公式的精神幻想。“用數(shù)學(xué)的專門符號來陳述,它既不擴張,也不加深,更不補足我們的知識。它只是把我們的知識變成數(shù)學(xué)語言。它的計算是在我們早已熟知的一些代數(shù)式中的反復(fù)推演。其結(jié)果并沒有告訴我們關(guān)于個別事項的任何情形。”[9]同理,教育評價僅憑公式得出的結(jié)果非但無助于增加自身的見解,反而更像是對已有知識的包裝、重復(fù)和循環(huán)。加之,幾乎每個數(shù)學(xué)公理都能僅憑自身首尾一貫地演繹下去,以至于人們幾乎能夠證明他們打算采取的任何假設(shè)。[10]在此意義上,公式之上教育評價的最大風(fēng)險并不在于公式無法兌現(xiàn)其承諾,而在于數(shù)學(xué)公式就像某種“致幻劑”一般,總能使教育“如愿”從中發(fā)現(xiàn)“新規(guī)律”,或者悟出某種“新道理”。在這種“自欺”的數(shù)字幻想中,原本用于消解教育直觀經(jīng)驗及其內(nèi)部循環(huán)的數(shù)學(xué)公式,也只會被人們運用得如同“俘虜”一般,任其牽往任何一個方向,以迎合他們對已知、簡單和確定的本能偏好。相應(yīng)地,公式之上的教育評價之所以令人感到信服,既不是因為公式開啟了教育評價的新視角與新觀念,也并非教育評價可以憑借公式克服自身的混亂與假象,更無法歸結(jié)為教育評價因為公式加深了對問題的理解,而是公式賦予了某些人這樣的精神幻想:因為公式建立在無可辯駁的數(shù)學(xué)成就之上,所以基于公式的教育評價結(jié)果不僅牢不可破,且不言自明。 其二,始于公式的價值沖突。盡管公式之上的教育評價在方法層面取得了巨大突破,但由于這套方法的前提并不完全適用于人,以至于教育評價始終因為公式而面臨著難以消解的價值沖突。19世紀初的天文學(xué)家是為了解決不同人觀測星球時可能發(fā)生的誤差,方才發(fā)明了“平均計算法”,即把所有獨立測量的結(jié)果相加,求其平均分,然后得到平均測量值。[6]144從他們的觀測來看,平均分比任何單一數(shù)據(jù)都更準確,也更能體現(xiàn)研究對象的真實狀況。受此啟發(fā),指向平均標準的種種公示方能被用于教育評價。不過,這套算法的數(shù)學(xué)前提是:(1)群體中的每一個體都是相同的;(2)群體中的所有個體都必須保持不變。[7]47可是,宇宙中的真理可以用牛頓定律這樣的算法來進行演示并在方法上得到證明,其關(guān)鍵在于它是獨立于觀測之外的事實。但是,教育非但無法獨立于人而存在,甚至于,教育的人、事、物在多數(shù)情況下也難以保持相同,反而可能因為變得不同才顯得有意義——不然成長也就變成了于教育無意義的概念。進一步來講,這種因為在教育評價中倡導(dǎo)公式應(yīng)用而導(dǎo)致的價值沖突表現(xiàn)為:它既在群體層面減少了裙帶關(guān)系和任人唯親的教育現(xiàn)象,也讓家庭背景不利的學(xué)生擁有了更多機會,更使得教育的操作性、針對性與有效性得到了加強。而為之付出的代價卻是,教育評價正在迫使個人在虛構(gòu)的數(shù)學(xué)規(guī)律指引下走向標準且狹隘的賽道,而且個人在教育中的選擇也越來越少,甚至于每個人身上的特色和稟賦都可能因為無法平均且不標準而成為一種累贅、一道障礙,抑或成功路上的“絆腳石”。 其三,始于公式的現(xiàn)實霸權(quán)。近20年來,伴隨著國際比較、排名和循證教育的興起,“教育結(jié)果能夠測量并且應(yīng)該被測量”已經(jīng)成為支配教育的基本規(guī)則。[11]源于此,今日教育評價應(yīng)該關(guān)注什么、討論什么、追求什么往往都是由公式說了算。更具體來講,基于公式的教育評價有時并不是在用公式開啟思考的新視角、消解自身的假象抑或加深對問題的理解,而是在構(gòu)造可以讓公式得到更好應(yīng)用的教育評價。因此之故,公式也在教育評價中獲得了現(xiàn)實霸權(quán)。它暗示著:(1)如果沒有公式,教育評價就會失去科學(xué)的授信;(2)任何教育評價都要以在公式上得到表達為榮。無論是成績單和排行榜的風(fēng)靡云涌,還是指標體系和測評模型的比比皆是,都可以在一定程度上佐證這一點觀點。反過來講,如果人們試圖在教育評價中探究那些與公式無關(guān)卻于教育有重要價值的內(nèi)容,不僅會顯得勢單力孤,也難以獲得理解與支持。同時,明明可以被人明確感受且能予以說明的評價結(jié)論,也非得在公式的尺度上予以現(xiàn)實方才能令人信服。更有甚者,那些現(xiàn)實中明明沒有被回答(或者無法被回答)的教育評價問題,卻總能被人以某種公式的形式予以回答。所以,人們才會在全球教育評價中看到,諸如責(zé)任感、想象力、同理心這類無法(也無需)在公式尺度上得到證明的教育品質(zhì),它們要么被邊緣化,要么被包裝成某種“既不科學(xué)、也沒價值、甚至有些滑稽”的公式,以便擁有新的合理性來源。 二、教育評價的算法演進 時至今日,公式依然在教育評價中發(fā)揮著廣泛而重要的作用。只不過,從人們誤解和濫用公式所徒增的精神幻想、價值沖突和規(guī)則霸權(quán)來看,即便加減乘除依然可以在教育評價中發(fā)揮作用,但為此的代價可能已經(jīng)超出它本身的價值。這樣的得不償失也引申出了以下問題:在這個技術(shù)日新月異、環(huán)境不斷變化、需求與時俱進的世界中,如何在教育評價中尋求超越公式的更好算法?在如此問題的促逼之下,代碼驅(qū)動的算法演進順勢支撐起了教育評價的全新想象。 (1)基于代碼的幻想祛魅。必須承認的是,無論基于公式的教育評價如何強調(diào)自身的客觀性,它實際上都離不開人的見識及其局限。因為任何在教育評價中被使用的公式都包括了設(shè)計者的“目的”。比如,皮爾遜對其方法的承諾,被歸因于他的優(yōu)生學(xué)假定中所涉及的那種相關(guān)性,而尤爾的堅持則被歸因于他對關(guān)注改善窮人的社會問題的實用利益。[12]說到底,那些在教育評價中被廣泛使用的公式必須由設(shè)計者指定一個包含選定解釋變量的數(shù)學(xué)函數(shù),并通過回歸分析來確定數(shù)據(jù)與這些分析選擇之間的擬合優(yōu)度。這樣固然可以保留人的特色和優(yōu)勢,卻也使人的先驗觀念與本能偏好形成了無從克服的謬誤,乃至加劇了人們試圖從公式中尋求“終極目的”的精神幻想。與之不同,機器學(xué)習(xí)這類算法并不依賴變量之間函數(shù)關(guān)系的先驗規(guī)范。[13]它們可以通過挖掘數(shù)據(jù)以識別數(shù)據(jù)之間的模式和相關(guān)性,然后將數(shù)據(jù)壓縮成信息,進而把信息消化為知識。[14]12所以,算法驅(qū)動的教育評價可以在更大程度上回避人的干擾和偏見。[15]加之,從基因編程、支持向量機、反向傳播、貝葉斯推理等機器學(xué)習(xí)算法表現(xiàn)出來的潛力來看[14]65-70,代碼驅(qū)動的教育評價除了可以規(guī)避公式的先驗假設(shè)、價值偏好與人為干擾,還能借由反向推理、逆向演繹、交叉驗證對教育評價中的經(jīng)典理論進行挑戰(zhàn)和補充。由此看來,代碼驅(qū)動的教育評價不僅有益于拆穿那些用公式對已有知識的包裝、重復(fù)和循環(huán),也有能力擺脫“人”的自欺、偏狹與干擾,更有機會讓那些因為人們誤解公式而強加于教育評價的精神幻想無所遁形。 (2)基于代碼的價值調(diào)適。在沒有“能讓機器自動運行”的代碼之前,靠得住卻可能不合時宜的公式可能已經(jīng)引領(lǐng)教育評價走到了“在減加乘除中力求不變或相同”的死胡同。這其中的緣由既不是因為人們不夠努力、聰明和善良,也并不意味著公式的不可信和不可用,而是任何教育問題一旦訴諸公式進行處理和表達,那么它便只能在數(shù)學(xué)尺度之上進行解釋和解決。與之不同,盡管代碼擁有一定的數(shù)學(xué)基礎(chǔ),但它卻可以在不同于數(shù)學(xué)的尺度下,對教育中的人、事、物作出評價。究其原因,一方面代碼既沒有現(xiàn)實世界中黑白分明的唯一屬性,也不從屬于某種抽象的統(tǒng)一架構(gòu)。[16]138所以,基于代碼的教育評價不僅沒有十七世紀之前的本質(zhì)主義包袱,也不必拘泥于公式背后的僵化前提和固定假設(shè)。另一方面,讓每個人在教育中得到適合自己的評價,無法在人為加減乘除的公式中被想象和實現(xiàn)。不過,從ChatGPT背后的算法演進來看,代碼驅(qū)動的教育評價可以調(diào)用的個性化技術(shù)已然得到了前所未有的豐富與加強。[17]在這幅由代碼描摹的未來圖景中,教育評價的根本價值有能力從“平均標準”走向“平等適合”。它意味著,基于代碼的教育評價將不再迫使每個人遵循相同且僵化的標準化系統(tǒng),而是立足于讓每個人成為更好的自己;為賦能個人學(xué)習(xí)和發(fā)展而開展教育評價的算法設(shè)計,而不是純粹為了輸出排名與分級;更自然地反映個體的能力、基礎(chǔ)和天賦,而不是屈從于固定的背景變量(如年齡、身份);深度挖掘不為人知卻于人有益的個性化規(guī)律,而不是拘泥于所謂平均水平與標準模型。這樣的價值調(diào)適除了可以彌補公式之于教育評價的先天不足,還能讓教育評價因為代碼而展現(xiàn)出溫暖人心、催人奮進之效。 (3)基于代碼的權(quán)力制衡。公式之所以能在教育評價中構(gòu)成現(xiàn)實霸權(quán),顯然無法歸結(jié)于數(shù)學(xué)的規(guī)定或不足,而是人們總能夠“如愿”揣測那些基于公式的評價設(shè)計,并據(jù)此獲得某種優(yōu)勢。比如,一旦人們知曉了某種成績單與排行榜的計算公式,也就知道了“通往成功的規(guī)則”,相應(yīng)地,公式也就影響了在教育中影響人們選擇及其行為的決定性力量。并且,無論這樣的公式有著怎樣的局限甚至謬誤,人們都會根據(jù)這些公式來優(yōu)化自己的行為,進而反過來強化公式的合理性。[18]其結(jié)果則如法伊爾阿本德所喻,“把標準建立在一種實踐之上并以此為滿足,便可能會使這種實踐的缺點永世長存”[19]。由此看來,消解始于公式的現(xiàn)實霸權(quán),關(guān)鍵不在于設(shè)計出在數(shù)學(xué)上更為精美的公式,而是要引入新的算法設(shè)計,以制衡公式的現(xiàn)實影響力,即讓人們試圖揣摩教育評價的公式以獲得優(yōu)勢成為不可能。與教育評價中有賴于人進行設(shè)計和解讀的公式相比,“基于代碼的算法將由數(shù)字系統(tǒng)進行實施,而非人類;它具備適應(yīng)性,能夠隨情況變化而變化;它將用代碼來書寫,而不必仰仗人類的自然語言”[20]69。由此看來,代碼不僅能塑造比公式靈活且不易為人所模仿的評價規(guī)則,還能從另一個角度挑戰(zhàn)那些因為人們對公式的濫用而被奉若圭臬的評價規(guī)則,乃至讓“唯分數(shù)”這類對數(shù)學(xué)規(guī)則的拙劣模仿變得無所遁形。 上述因為代碼而可能實現(xiàn)的幻想祛魅、價值調(diào)適與權(quán)力制衡固然可以填補因為公式而留下的教育評價缺憾。但這一切得以成立的基礎(chǔ),卻有賴于“非人力所能及”的數(shù)據(jù)、技術(shù)和應(yīng)用。因此之故,代碼驅(qū)動的教育評價很可能衍生出“把人排除在外”的觀念失調(diào)、方法失格和權(quán)力失范。 第一,始于代碼的觀念失調(diào)。對過去的教育評價而言,“誰來評價”“評價什么”與“為什么評價”都是與人有關(guān)的問題,并受制于人的觀念。代碼的加入?yún)s可能讓這一切發(fā)生顛覆性變化,進而從根本上沖擊教育評價的固有觀念。首先,波蘭尼曾在《個人知識》中指出“人類知道的遠比其能表達出來的更多”[21]。也正是在此觀念基礎(chǔ)上,人類必須也必將構(gòu)成教育評價的主體。因為無論公式可以在多大程度上揭示教育評價的真相,但總有公式之外的謎題有待人類去揭開。然而,以ChatGPT為代表的代碼卻正在使“波蘭尼悖論”發(fā)生逆轉(zhuǎn)。因為代碼可以依托自我學(xué)習(xí),進而表達出超乎人類所知的內(nèi)容。[22]在此情形下,“誰來評價”也就構(gòu)成了新的問題。其次,沒有公式之前的教育評價是“面對面”的直接評價某人、某事與某物(真實的一階對象);公式之上的教育評價是對“與人、事、物有關(guān)的因素”進行間接評價(抽象的二階對象);代碼驅(qū)動的教育評價則可以在不直接面對人、事、物,甚至無須知道這些因素是否它們有關(guān)的前提下,通過對數(shù)據(jù)背后的數(shù)據(jù)進行挖掘和排列(無序的三階對象),進而做出評價。而這也將使“評價什么”成為了新問題。最后,正是鑒于代碼可能從根本上改變教育評價的主體觀與對象觀,所以教育評價的傳統(tǒng)價值觀可能很難發(fā)揮一以貫之的效用——為什么評價就此變成了一個問題。一方面,由于代碼對教育評價主體的介入,代碼追逐有用性、高效性的工具理性可能與人類堅持自由、平等、正義、公平的價值理性構(gòu)成沖突;另一方面,代碼對非線性、反身性、動態(tài)性、互聯(lián)性的“無序”偏好,也將進一步?jīng)_擊立足標準、排序、分級、分類的價值觀。總之,面對代碼驅(qū)動的教育評價,人們固然可以期待它對人們誤解公式的精神幻想予以祛魅,但也不應(yīng)忽視它有可能從根本上沖擊人們固有的評價觀念,乃至使之面臨失去方向和慣例的風(fēng)險。 第二,始于代碼的方法失格。代碼驅(qū)動的教育評價之所以能調(diào)適始于公式的價值沖突,其中最為關(guān)鍵的原因便是它既能做到那些“非人力所能及”的評價,也能用“迎合人、取悅?cè)恕钡姆绞阶鞒觥皞€性化”評價。這既是代碼的方法優(yōu)勢,也是其弊端所在。一方面,如今的代碼不僅可以從混亂、瑣碎、海量的數(shù)據(jù)中發(fā)現(xiàn)那些“深不可測”且“不為人所知”的新知識,更驅(qū)動著由歸納演繹向數(shù)據(jù)分析、由知識理性向計算理性、由人類認知向機器認知的方法轉(zhuǎn)型。然而也正源于此,代碼驅(qū)動的教育評價即便可以展現(xiàn)出個性化與柔性化的效用,甚至可以用一種匪夷所思且截然不同于人的方式作出教育評價,但人們卻不知道它為什么如此有用,以及為什么作出這樣的評價。如此一來,代碼驅(qū)動的教育評價也將變成一個巨大的“黑箱”。相應(yīng)地,原本因為公式而走向公開且可檢驗的教育評價,也將因此而變得神秘莫測。這樣的教育評價就算可以調(diào)適某些價值沖突,但也可能因此失去“強調(diào)理解和追求真相”的品格。另一方面,如赫拉利所言,“正因為對人類的理解如此狹隘,所以算法創(chuàng)了一個新的社會系統(tǒng),鼓勵我們順從人類最基本的本能,同時阻礙我們發(fā)揮人類完整的潛能”[23]226。以此推之,代碼驅(qū)動的教育評價極可能扎根于某些根深蒂固、普遍存在且令人愉悅的低階需求(如物質(zhì)與本能),而無法顧及那些不易覺察、稀有獨特甚至令人感到困難的高階需求(如求知和創(chuàng)造)。就像人類使用美圖秀秀欺騙自己以愉悅世人一般,代碼驅(qū)動的教育評價也可以“一鍵過濾”令人不悅的結(jié)果抑或?qū)ζ溥M行“智能潤色”,以便自己在教育中感到無限滿足。由此帶來的惡果則是,代碼驅(qū)動的教育評價不僅有可能把人類活動降格到“本能”層次之上,還會失去“為了促進人的改變而不惜羽毛”的品格,更有可能因此丟掉警醒人、糾正人和引領(lǐng)人的意義。除此之外,那些因為代碼而被贊美的個性化評價方法,除了可以彌補公式對于個體的疏忽,是不是也有可能助漲人們對個體、自我與特殊的關(guān)注,反而使那些在平均標準中被強調(diào)的共同目的、共通渠道、共有規(guī)則、共享價值被遮蔽和堵塞。倘若如此,代碼驅(qū)動的教育評價將不得不面臨因為“個性化”而損失整體性關(guān)切的風(fēng)險。 第三,始于代碼的權(quán)力失范。教育評價作為“指揮棒”,它除了需要揭示教育的真相,更意味著執(zhí)教育牛耳的“權(quán)柄”。并且,無論公式之上的教育評價可能給人帶來了正面或負面的影響,它都是屬于“人”的事。然而,如今基于代碼的智能機器興起標志著,權(quán)力第一次從人類轉(zhuǎn)移到其他物種手中。[23]166如此一來,一旦將公式切換為代碼,教育評價這根“指揮棒”的權(quán)柄也將不再百分百屬于人,一些專屬于代碼的能力和偏好也將帶來前所未有的問題惡化、教育偏見與對人壓迫。其一,對問題的惡化。鑒于代碼必然偏好那些已經(jīng)存在且能反復(fù)檢驗的事實及其數(shù)據(jù),故而代碼驅(qū)動的教育評價在解決問題的同時也會惡化已有問題。比如,即便代碼可以作出客觀的教育評價,但這樣評價可能既代表不了正義,也難以為人所接受——因為代碼的客觀只能揭示現(xiàn)有教育是什么樣,而無法回答教育應(yīng)該是什么樣;代碼的精確雖有益于發(fā)現(xiàn)“小數(shù)點”后的教育真相,卻也可能將圍繞教育評價的競爭拓展到“小數(shù)點”之后;代碼的公正確實有利于制衡教育評價中的人性弱點,但它也會重復(fù)和鞏固世界上已經(jīng)存在的不公——就像讓代碼基于現(xiàn)有數(shù)據(jù)創(chuàng)建“好學(xué)校”的模型,現(xiàn)有的好學(xué)校一樣會被代碼評為好學(xué)校。這一切的根本緣由在于,只要代碼仍是基于已有數(shù)據(jù)的挖掘和分析,那么這樣的評價既不能在“沒有重復(fù)”之處發(fā)現(xiàn)意義,也難以發(fā)現(xiàn)不同于“過去”的道理,更無法向那些“沒有數(shù)據(jù)”的未來予以開放。[24]其二,對教育的偏見。代碼因為可以一視同仁才能構(gòu)成令人信服的立場約束,而教育卻是因為允許接受人的差異才令人向往;代碼因為可以超越人類的主觀局限方才能發(fā)現(xiàn)新知,教育卻是因為“在主觀上始終相信人可以改變并為之努力”才顯得有意義;代碼因為可以規(guī)避人的錯誤才能增益教育,而“教育卻是因為懂得寬容錯誤才會讓美麗行為得以發(fā)生”[25]。面對兩者之間無從克服的差異,一旦教育評價毫無保留地陷入代碼的偏好之中,這樣的教育不僅極有可能因為代碼偏向統(tǒng)一、確定和可控的趨勢,而讓自身追求多元、成長和創(chuàng)新的本能受到壓抑,甚至于失去助人擺脫舊習(xí)、超越自我與重獲新生的應(yīng)有之義。其三,對人的壓迫。代碼已經(jīng)讓基于侵入式監(jiān)視和強制系統(tǒng)的行為干預(yù)成為可能。[26]這樣一來,無論人們是否情愿和理解,他們都可能因為攝于代碼的威力而在教育評價中接受某種“必然結(jié)果”。其因在于,從人與代碼的互動邏輯來看,人除了可以被歸納成某種數(shù)據(jù)樣態(tài)之外,也可能讓自己被改造成符合數(shù)據(jù)要求的模樣。這也就是說,人們無法在教育評價中排除曲解人以迎合代碼的可能——這也正是代碼之于人最為深重的壓迫。 三、教育評價的算法進路 列舉上述代碼僭越于人的觀念失調(diào)、方法失格和權(quán)力失范,既無意也無法證明,代碼驅(qū)動的教育評價必然走向“死胡同”,或者教育評價不應(yīng)追求從公式到代碼的算法演進。但這確實意味著,人們有必要清醒地追問,面對撲面而來的算法演進趨勢,教育評價是否應(yīng)該對代碼倒屣相迎?抑或像當(dāng)年義無反顧地使用公式那般,毫無保留地擁抱代碼,然后在解決問題的同時,留下一堆左右為難的難題?也正是由于這類問題的存在,教育評價的算法進路無法被概括為從公式到代碼的必然進步,更應(yīng)考慮何以因應(yīng)其中的觀念之變、方法之變和權(quán)力之變。 (一)教育評價的觀念更新:接受算法主體 從觀念的角度來看,從公式到代碼的算法演進之所以絕非易事,因為它關(guān)系到絕不僅僅是數(shù)學(xué)的優(yōu)劣與技術(shù)的好壞,而是關(guān)系到“人類能否/如何接受算法主體”這一亙古未有的問題。要知道,文字、印刷與廣播的發(fā)明雖然改變了人類的生活,但卻沒有為之增加新的“成員”,而計算機、互聯(lián)網(wǎng)連同人工智能的出現(xiàn)卻讓人類生活嵌入了算法這一全新主體。[23]165-177在此背景下,“能否/如何接受算法主體”也就構(gòu)成了教育評價的歷史性命題。它預(yù)示著,從公式到代碼的教育評價除了需要徹底的主體反思,還需要進一步解放思想,以實現(xiàn)觀念的代際交替。 (1)教育評價的主體反思。盡管公式和代碼都屬于算法,但兩者有著本質(zhì)上的不同,公式是基于人的判斷和選擇,而代碼則意味著由智能機器自動完成。由此出發(fā),面對可以獨立于人的算法主體,人們除了必要反思“何為教育評價主體”的問題,比如,什么樣的教育評價仍必須由人來作出?什么樣的教育評價需要由人與算法來合作完成?什么樣的教育評價可以委托給算法?還包括由“教育評價主體變化”所衍生出的問題。比如,當(dāng)代碼作出教育評價時,根據(jù)概率判斷引發(fā)算法歧視等道德問題,它應(yīng)該由“誰”來責(zé)任?當(dāng)代碼與人的評價不一致時,人們究竟應(yīng)該聽“誰”的?如果人們在教育評價中聽命于代碼,人們又當(dāng)如何確保這樣的代碼能與人的目的保持一致?當(dāng)人們開始在教育評價中思考這些史無前例的問題時,一些更有活力且與這個時代相匹配的主體觀念也將得以涌現(xiàn)。而這些問題的答案不僅關(guān)系到教育評價能否妥善應(yīng)對始于代碼的主體失調(diào),更將為解決教育評價的對象失調(diào)與價值失調(diào)奠定思路和基調(diào)。 (2)教育評價的思想解放。盡管人機協(xié)同、人機一體、人機共生已經(jīng)因為“能讓機器自動運行”的代碼(或者叫人工智能)成為了這個時代朗朗上口的時髦詞匯,但要讓人們真的接受由獨立于人的代碼所作出的判斷和決策,卻并非理所當(dāng)然之事。[27]同理,在教育評價中接受算法主體更像是個充斥著離經(jīng)叛道的問題。所以,正如沒有人會在1792年為劍橋大學(xué)威廉·法里希用公式為學(xué)生評分而雀躍,[28]也鮮有人在2020年為英國在中高考中使用“神秘代碼”為學(xué)生評定成績而喝彩[29]。這也反過來表明,代碼驅(qū)動的教育評價需要的不是掌聲和鮮花,而是思想解放。這一切就像當(dāng)年人們解放思想以接受公式之上的教育評價一般,今人要真的接受代碼驅(qū)動的教育評價,就必須從書本的固有概念、陳舊話語與過時理論中解脫出來,進而以更加開放、多元、包容的心態(tài)和視角去審視教育評價中“人與算法”的關(guān)系,學(xué)會“如何與算法共存”,進而重塑教育評價的范式。 (3)教育評價的代際交替。若以算法為界,人們大致可以劃分出以下三代教育評價:第一代評價,沒有公式之前的教育評價,它主要是人類憑借自身的觀察、體驗、經(jīng)歷及相對應(yīng)的思辨對教育進行具體、深入的評價;第二代評價,公式之上的教育評價,它主要是人類借由數(shù)學(xué)的概念、方法和規(guī)則及相應(yīng)的計算對教育作出精確、普適的客觀評價;第三代評價,代碼驅(qū)動的教育評價,它主要是依托數(shù)據(jù)的搜集、處理和分析及由此構(gòu)成的智能機器對教育作出獨立于人甚至超越于人的評價。這三代教育評價并非簡單的替代或者包含關(guān)系,而是各有所長、相互兼容的關(guān)系。究其原因,教育評價若離開了“人”,則可能陷入徒勞無益的計算;教育評價若離開了“公式”,則容易陷入言之無物的猶疑、籠統(tǒng)和神秘;教育評價若離開了“代碼”,則無力擺脫“人”的局限及其錯誤。因此之故,從公式到代碼的教育評價確有必要在主體反思和思想解放的基礎(chǔ)上推動自身觀念的代際交替:正因為三代教育評價都存在“無可替代”的作用,且都能以自己的方式對教育作出貢獻,所以,在教育評價中接受算法主體,既不是要盲目推崇代碼的作用,也不易片面夸大代碼的風(fēng)險,而是要鼓勵人們?nèi)ダ斫馊逃u價的起源及特征,甄別三者的效用及差異,以及探索三者的組合關(guān)系、遞進關(guān)系、耦合關(guān)系和系統(tǒng)關(guān)系。由此看來,教育評價的算法轉(zhuǎn)型終究需要在觀念上指向?qū)Α叭恕迸c“公式”的傳承、改變和超越,而非對它們的否定、替換和復(fù)制。 (二)教育評價的方法創(chuàng)變:吸納算法決策 歷史地看,正因為借助公式有助于解決那些無法依靠經(jīng)驗和思辨予以解決的評價問題,所以,即便曾經(jīng)基于公式的教育評價在方法層面存在諸多不足,但它依然可以因為創(chuàng)造性地解決了教育評價的諸多難題而被稱為方法進步。類似地,若要將代碼驅(qū)動的算法演進視作教育評價的方法進步,既不必以犧牲之前方法的基礎(chǔ)與優(yōu)勢為代價,也不應(yīng)歸咎于這樣的方法能以“神秘莫測”的方式作出令人滿意的個性化評價,而應(yīng)考慮其能否在教育評價已有方法基礎(chǔ)上創(chuàng)造性地解決某些僅憑人和公式所無法回答的難題。由此出發(fā),吸納算法決策的教育評價方才能在方法層面顯現(xiàn)出令人期待的意義和路徑。 首先,算法決策之于教育評價的方法意義。在人類“自我證實”的動機驅(qū)使之下,無論是人本身還是訴諸公式,都不足以對“教育究竟對人產(chǎn)生了什么作用”作出超越于人類局限及其利益偏見的評價。這既是教育評價面臨的根本性問題,也是醫(yī)學(xué)在一百年前開始騰飛的起點。因為與“期望效應(yīng)”類似的“安慰劑效應(yīng)”被彼時醫(yī)學(xué)視作了“精神幻想”,并用隨機雙盲的實驗方法予以刺破。誠然,教育的對象和條件決定了它無法像醫(yī)學(xué)那般開展實驗,但現(xiàn)代醫(yī)學(xué)敢于解決這個問題以及由此構(gòu)成的成就,依然足以鼓勵教育評價嘗試以下可能:與需要由人設(shè)計和選擇的公式不同,以機器學(xué)習(xí)為代表的代碼可以訴諸不與人直接發(fā)生關(guān)系(難以被人操縱)的數(shù)據(jù),以模擬、還原和預(yù)演教育的結(jié)果及其規(guī)律,從而在擺脫人類利益、本能及其偏見的尺度上創(chuàng)造性地回答“教育到底有什么用”。如此一來,正如當(dāng)年教育評價引入公式既不是因為數(shù)學(xué)簡單,也不是因為它能令人收獲更多歡喜,而是教育評價唯有憑借公式方才能刺破人類的狹隘觀念、經(jīng)驗窠臼與直覺迷思。 其次,算法決策之于教育評價的方法路徑。隨著算法正在展現(xiàn)出獨立于人的決策能力及其優(yōu)勢,它不僅比基于先驗信念、直覺和共識的方式更加準確,而且不會因為人的介入而產(chǎn)生利益攸關(guān)的偏差,更重要的是,隨著技術(shù)的迭代升級,這樣的決策成本正在日益降低。[30]在此背景下,如果人們不是按照既有的科研思路和流程框架來設(shè)計教育評價的算法決策應(yīng)用,而是將之視作教育評價的變革性力量,算法決策有機會從以下三個方面助推教育評價的方法創(chuàng)變。一是基于代碼的生成式評價。教育對象的可得性、可操控性、充足性和貼切性給評價帶來的最直接困境便是,評價者非但難以對人進行全面評價和過程評價,更無法對其施加操控來檢驗評價的理論假設(shè)。然而,隨著ChatGPT展現(xiàn)出的智能“通用”和“涌現(xiàn)”,已經(jīng)有越來越多研究者開始意識到,始于代碼的智能機器不僅可以用作人類研究對象的“代理”,研究者還能對其行為和互動過程進行觀察和干預(yù),以獲得與研究目的相貼合的樣本。[31]在此意義上,代碼可以通過“模擬人”或者“編譯生成式受試者”的方式,以實現(xiàn)無法在現(xiàn)實世界中被觀察和操作的生成式教育評價。二是基于代碼的因果式評價。基于公式的教育評價只能止步于“相關(guān)”,而無非通達“因果”。這也是定量評價被構(gòu)弊的最大原因。因為它不僅時常得出“貌似有關(guān)”的結(jié)果,還容易導(dǎo)致“用之前的答案來解決現(xiàn)在的問題”“用多數(shù)人的成功掩蓋少數(shù)人的失敗”這類“相關(guān)錯誤”。現(xiàn)如今,因果學(xué)習(xí)的出現(xiàn)有機會改變這一局面。因果學(xué)習(xí)可以將代碼的力量和因果推論的原理相結(jié)合,使用特定數(shù)據(jù)集而非不加甄選的數(shù)據(jù)來訓(xùn)練模型,以揭示數(shù)據(jù)中暗含的因果關(guān)系。[32]由此出發(fā),代碼亦可基于特定數(shù)據(jù)集以構(gòu)建可以發(fā)現(xiàn)、識別、推論復(fù)雜因果機制與因果效應(yīng)的因果式教育評價。三是基于代碼的人機協(xié)同式評價。正因為智能時代人與機器的關(guān)系不是替代,而是協(xié)同,所以,基于智能機器的第五科研范式就是要發(fā)揮和結(jié)合人類智能與機器智能的各自優(yōu)勢,以促進人類知識生產(chǎn)的疊加效應(yīng)、倍增效應(yīng)和放大效應(yīng)。[33]類似地,基于代碼的人機協(xié)同式評價并不是要讓人屈從于代碼抑或讓代碼迎合人的喜好,而是要那些不同于人的觀點得以涌現(xiàn),進而讓人與代碼分別用自己擅長的方式對教育作出評價。中國知網(wǎng)的學(xué)術(shù)精要與專家評價的交相輝映已為此給出了可供借鑒的路徑。 (三)教育評價的權(quán)力改善:引入算法規(guī)制 回顧公式之上的算法起源與代碼驅(qū)動的算法演進,這里面的權(quán)力風(fēng)險既有人們對算法的誤解與濫用,也不乏算法本身的不足與局限。因此之故,在教育評價中引入算法治理也就構(gòu)成了制衡公式的現(xiàn)實霸權(quán)和約束代碼的權(quán)力失范的共同選擇。進一步來講,算法轉(zhuǎn)型進程中的教育評價既需要約束人對算法的使用,也有必要對算法本身作出約束;前者指向人,表現(xiàn)為教育評價的算法倫理,后者指向算法,表現(xiàn)為教育評價的算法規(guī)制;兩者共同的出發(fā)點在于“承認自身的不足與犯錯的可能,形成可以自我修正機制,允許質(zhì)疑和改變”[23]260,兩者共同的落腳點在于捍衛(wèi)人之于教育評價的權(quán)力和責(zé)任。 一是教育評價的算法倫理。無論當(dāng)下教育評價中頻頻出現(xiàn)的公式濫用,還是未來教育評價可能面臨的代碼失控,都可以表明,教育評價確有必要構(gòu)建強調(diào)責(zé)任、向善和正義的算法倫理。(1)算法責(zé)任。人們首先必須清醒意識到的是,教育評價是否使用算法、如何使用算法是人的“責(zé)任”,而不是算法的規(guī)定。所以,人類永遠有必要以“主人”的身份檢驗算法的合理性、必要性和正當(dāng)性,而不是在人工智能浪潮中隨便選擇某個算法將其應(yīng)用于教育評價,然后忍受它們好多年,最后痛苦地領(lǐng)悟從一開始就應(yīng)該知曉的道理。(2)算法向善。事實上,算法既不關(guān)心教育評價究竟是用于淘汰弱者還是為他們

溫馨提示

  • 1. 本站所有資源如無特殊說明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請下載最新的WinRAR軟件解壓。
  • 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請聯(lián)系上傳者。文件的所有權(quán)益歸上傳用戶所有。
  • 3. 本站RAR壓縮包中若帶圖紙,網(wǎng)頁內(nèi)容里面會有圖紙預(yù)覽,若沒有圖紙預(yù)覽就沒有圖紙。
  • 4. 未經(jīng)權(quán)益所有人同意不得將文件中的內(nèi)容挪作商業(yè)或盈利用途。
  • 5. 人人文庫網(wǎng)僅提供信息存儲空間,僅對用戶上傳內(nèi)容的表現(xiàn)方式做保護處理,對用戶上傳分享的文檔內(nèi)容本身不做任何修改或編輯,并不能對任何下載內(nèi)容負責(zé)。
  • 6. 下載文件中如有侵權(quán)或不適當(dāng)內(nèi)容,請與我們聯(lián)系,我們立即糾正。
  • 7. 本站不保證下載資源的準確性、安全性和完整性, 同時也不承擔(dān)用戶因使用這些下載資源對自己和他人造成任何形式的傷害或損失。

評論

0/150

提交評論