把旧文章里的知识转成实操题,难点不在出题,而在判定标准。常见做法是让学员“优化这篇文章”,结果交上来的东西五花八门,无法判断是学会了还是碰巧改对了。可判定的输出应当先固定输入、再固定动作、最后固定一个能用是或否回答的结果,而不是让评判者凭感觉打分。
旧内容退出场景里,很多课程练习要求学员“把过时文章改到能重新发布”。这个任务听起来贴近真实工作,但判定时会发现两个人都改了标题、都删了段落,却没法说谁对。评分者只能看表达是否通顺、结构是否整齐,于是实操题退化成写作题。更麻烦的是,学员无法从反馈里知道下一步该练什么,因为反馈本身没有指向一个明确的对错。
第一种解释是题目本身太宽。旧内容退出涉及判断哪些部分保留、哪些部分删除、哪些部分改写,这三件事混在一个任务里,学员只能凭直觉取舍,评判者也只能凭直觉验收。
第二种解释是判定标准没有落到可观察的动作上。即使题目收窄到“判断这篇文章该保留还是退出”,如果没有规定看哪些位置、得出什么结论,仍然无法判定。两种解释的区别在于:前者需要拆题,后者需要补判定条件。实际中往往两者同时存在,但可以先验证是哪一种在起主要作用。
假设同一批学员做两次练习。第一次用宽题“优化这篇旧文章”,第二次用窄题“判断这篇旧文章的三个小节中,哪些可以保留、哪些必须退出,并各写一句理由”。如果两次的评分一致性都很低,说明问题主要在判定标准缺失;如果窄题的一致性明显提高,说明原来的问题主要是题目太宽。
这里的“一致性”指不同评判者给出相同结论的比例,不是搜索表现,也不是学员满意度。它只用于说明判定条件是否足够明确。若窄题下仍然分歧大,就要检查判定条件是否写成了可观察的动作,例如“能指出某段与当前主题无关”比“判断内容是否过时”更容易达成一致。
可判定的实操题通常包含三部分。输入是给定的旧文章或旧页面,动作是明确的操作,结果是能用是或否回答的结论。例如:给定一篇旧文章,要求标出其中与当前主题无关的段落,并说明保留或退出的理由;判定时只看是否标出了指定段落、理由是否指向内容本身而非排版。
动作要具体到能观察。与其写“评估内容质量”,不如写“逐段标注保留、改写或退出,并写出依据”。依据可以是段落是否还在回答标题承诺的问题,是否引用了已经失效的信息,是否与其他保留段落重复。这些依据都能被另一个人复核。
结果要能回答是或否。比如“是否找出了全部需要退出的段落”“是否对每个退出段落给出了内容层面的理由”。如果结果是“优化得更好”,就无法判定。把结果写成清单式的检查点,评判者只需逐项确认,学员也能据此知道下一步补什么。
假设有一篇旧文章,包含三个小节:一个仍然成立的方法说明、一个引用已变化外部条件的例子、一个与主题无关的推广段落。宽题是“整理这篇文章”。可判定题可以写成:标出应退出的小节,并说明退出理由;标出应保留的小节,并说明保留理由;对需要改写的小节写出改写方向。判定时看三点:退出小节是否包含推广段落,保留小节是否包含方法说明,改写方向是否指向外部条件变化而非文字润色。
这个例子里,动作和结果都是可观察的。学员交出的不是一篇改好的文章,而是一份判断记录。评判者不需要读完整篇改稿,就能判断学员是否掌握了退出与保留的区分。下一步练习也可以据此调整:如果学员把推广段落判为保留,就补练识别内容与主题相关性的动作;如果学员把方法说明判为退出,就补练区分过时与仍然成立的方法。
旧内容、旧系统或旧合作关系需要退出时,保留仍然有价值的部分,判定条件应指向可复核的依据,而不是“感觉还有用”。可用的依据包括:该部分是否仍在回答标题承诺的问题,是否依赖已经变化的外部条件,是否与其他保留部分重复,是否属于与主题无关的附加内容。这些依据都能被另一个人独立检查。
设置实操题时,可以先让学员写出判定依据,再让他们按依据逐段标注。这样输出的不只是结论,还有得出结论的过程。评判者既能看结论对不对,也能看依据是否成立。如果依据本身不成立,即使结论碰巧正确,也不能算掌握了方法,因为换一篇旧文章就可能失效。
最后要说明适用条件:这套做法适合需要判断保留与退出的旧内容场景,不适合以创意表达为主的写作练习。判定条件越具体,越容易复核,但也越可能限制学员的自由发挥;如果练习目标是训练判断力而非创意,这种限制是值得的。若练习目标是创意,则应改用其他判定方式,不强行套用退出与保留的框架。