Although billions of dollars have been spent on crime prevention and control programs during the past decade, scientifically strong impact evaluations of these programs are uncommon in the context of the overall number of programs that have received funding. "Improving Evaluation of Anticrime Programs" is designed as a working guide for agencies and organizations responsible for program evaluation, for researchers who must design scientifically credible evaluations of government and privately sponsored programs, and for policy officials who are investing more and more in the concept of evidence-based policy to guide their decisions in crucial areas of crime prevention and control.
这本书的标题虽然听起来直指核心,但实际内容却更像是一场对现实复杂性的深刻反思。我原本期待能看到一套行之有效的、可供操作的评估框架,针对那些旨在减少犯罪的公共政策和社区干预措施。然而,作者似乎更热衷于探讨“评估本身”的局限性,而非提供具体的“改进”方法。书中花了大量篇幅去解构既有研究的内在缺陷,比如样本选择的偏差、因果推断的难度,以及社会环境变量的不可控性。阅读过程中,我多次停下来,试图在那些密集的学术论证中找到一线曙光——一个可以直接套用到我们当地正在试点的新型警务模式的指标体系。遗憾的是,这本书似乎更像是一份哲学宣言,它成功地让我认识到,任何声称能“量化”社会安全提升的尝试都是多么的脆弱和自负。它迫使我重新审视那些我们习以为常的“成功案例”,它们的背后隐藏着多少被忽略的、甚至被刻意掩盖的变量。这本书的价值不在于教我如何更好地做评估,而在于让我明白了,也许最好的评估,就是承认其自身的局限性。这种深刻的自我批判,虽然令人沮丧,却也为未来的研究指明了一个更诚实的起点。
评分令人意外的是,这本书在探讨评估的伦理维度时,展现出了一种近乎激进的批判性视角,这与它开头部分的严谨统计学讨论形成了鲜明的反差。作者尖锐地指出,许多“成功”的反犯罪项目评估,实际上是在为那些带有社会偏见或种族歧视的干预措施披上科学的外衣,使之更易获得公共资金。它深入探讨了“谁来定义成功”以及“谁的犯罪被优先关注”的问题。这种对权力结构的解构,是全书中最引人入胜的部分。然而,这种强烈的伦理关怀似乎并没有被有效地整合到“如何改进评估”的具体建议中去。评价的高潮似乎停留在揭露问题的层面,而对于如何设计一个真正“公正”的评估工具,全书提供的指导却显得苍白无力。这就像是一位优秀的社会批评家,他能将现存体系的弊病剖析得淋漓尽致,却无法提供一个可操作的、结构性的替代方案。因此,这本书更像是一份强有力的批判性文献,而不是一份实用的指南手册,它成功地激发了我的道德愤慨,却未能装备我去构建一个更好的评估系统。
评分这本书的写作风格极其严谨,简直可以用“密不透风”来形容。我拿起它时,希望能够得到一些针对不同犯罪类型(比如财产犯罪和暴力犯罪)的、具有可比性的效果指标的深度分析。但这本书的重点似乎完全偏离了“成果”本身,而是聚焦于“测量工具的精度”。作者似乎沉迷于对测量误差的无休止的探讨,大量的篇幅被用来论证“犯罪率”这个核心数据的内在不稳定性,以及如何由非官方因素(比如社区对报案的意愿、警方的记录习惯)扭曲了最终的统计图景。坦率地说,对于一个希望将评估结果汇报给市政府决策层的实践者来说,这种纯粹的理论深掘显得有些“不接地气”。它更像是为高级统计学博士生准备的教材,而不是为政策制定者提供的操作指南。我尝试在其中寻找一些关于成本效益分析的实际案例,试图将犯罪减少的社会效益转化为具体的经济回报,但这些尝试最终都淹没在了对“信度和效度”的宏大讨论之中。读完后,我感觉自己对“好的数据”的概念有了更深刻的理解,但也更清楚地认识到,要获取真正“好的数据”,在现实世界中几乎是一项不可能完成的任务。
评分这本书的叙事节奏极其缓慢,充满了对历史文献的细致梳理,给人的感觉更像是一部关于“评估史”的编年史,而非一本面向未来的指导手册。它详尽地回顾了上世纪七八十年代几项标志性反犯罪计划评估的兴衰,剖析了每一项研究从提出假设到得出结论的全过程,其细致程度令人叹为观止。然而,这种历史的厚重感也带来了一个副作用:它让当前的讨论显得有些滞后。作者似乎对现代技术,比如大数据分析或机器学习在评估中的潜力,持有一种审慎到近乎怀疑的态度。我期望看到关于如何整合实时数据流来动态调整评估模型的讨论,或者至少是对新兴定量方法的辩护或批判。但书中几乎没有触及这些前沿领域,反而反复强调了那些需要耗费数年时间进行的前瞻性队列研究的“黄金标准”地位。这使得这本书读起来像是在为上一个世纪的学术规范树碑立传,对当下瞬息万变的公共安全实践参考价值有限。它更适合用作学术研讨会的引言,而不是政策实施的蓝图。
评分这本书的语言风格非常晦涩,充满了学科内部的行话和复杂的逻辑转折,即便是具备一定社会科学背景的读者,也需要频繁查阅术语表。我购买这本书的初衷是希望能找到一些关于定性研究方法如何有效地与定量评估结果相结合的实用建议。我期待看到关于深度访谈、民族志观察等方法如何帮助解释“为什么”某个项目有效或无效的案例分析。书中确实提到了定性数据的重要性,但往往是以一种辅助性的、附属性的角色出现,主要功能是为主要的统计发现提供一些“色彩描述”。关键的论证仍然牢牢地锚定在严格的、可检验的、数字化的模型上。对于那些相信社会问题必须通过人类体验来理解的读者来说,这本书提供的视角显得过于单薄和冰冷。它仿佛在暗示,任何无法被编码成数字的洞察都是次要的、可有可无的。因此,我没能从中找到关于如何构建一个真正包容的、多维度的评估体系的灵感,它固守着一种高度量化的范式,使得那些关于公平、社区赋权等微妙概念的评估变得模糊不清。
评分 评分 评分 评分 评分