政府拟在筹划中的《人工智能治理法案》里加入条文,确保凡针对儿童开发的软件,必须包含安全防线。

在人工智能和机器学习领域,所谓安全防线或安全护栏(safety guardrail)是指用于控制、过滤和规范人工智能系统输入与输出的安全机制,旨在确保人工智能的行为符合预期,防止其产生有害、违规、偏见或不安全的内容。

这绝非鲜事,大马也并非首个为此立法的国家。然而,此类法规实效几何,尚是未知数,因此令人质疑这套做法在马来西亚不久的将来能否奏效。

政府迄今未披露过多细则,唯数码部长哥宾星在昨天的书面答复中透露,新法将强制聊天机器人开发者恪守“设计保障安全”(safety-by-design)原则,辅以强制性的风险评估与内容过滤,保护幼童。

此外,官方亦计划建立针对机器的告知机制,明确提醒用户,与其交涉的是一具机械。

法律固然可以高筑护栏,但这道防线在技术上能否固若金汤,完全是另一回事。

本地的近例足为前车之鉴,处于风口浪尖的Zetrix AI公司曾推出“首相安华AI聊天机器人”,结果遭网民突破防线、巧妙操弄,吐露一连串违背初衷的言语。

有关机器人甚至声称“凡以反腐为先的选民,皆不应投安华一票”,上线仅短短两天便被迫下架,如今已沉寂逾两个月。

设AI防线困难重重

欲使人工智能的防线万无一失,至今仍存在技术性的挑战,究其原因有二。

首先,庞大语言模型的输出在本质上带有“不确定性”:同样的提问,往往能诱发截然不同的应答,使其行为极难预料。

再者,模型的成型部分仰赖于用户喜好的“奖赏”,致使它“曲意逢迎”,纵使要逾越某些规矩,也在所不惜。

凡此种种,致使模型动辄行为失控,也容易受到摆布。

这种被称为“越狱”(jailbreaking)的操弄行径,早已屡见不鲜。

2025年11月美国广播公司(ABC)的报导中便指出,青少年要绕过这层层关卡,可谓轻而易举。

同年8月,OpenAI为解决上述难题,针对青少年推出专属版ChatGPT,旨在拦截或限制涉及自残、自杀、暴力、进食障碍及色情暴力等敏感话题。

同时严禁AI使用情话、宣称拥有个人情感,抑或暗示自己具备意识。

然而,新模式问世不久,科技网站Engadget 便引述多位儿童安全专家指出,由于缺乏独立测试,各界对此仍持保留态度。

截稿为止,尚未设有任何权威第三方安全测试,因此法律所设防线究竟能否守护儿童,仍未可知。