RQDA 有哪些主要功能?

RQDA 是一个基于 R 的定性数据分析(Qualitative Data Analysis)软件包,采用 BSD 许可证,可运行于 Windows、Linux/FreeBSD 和 Mac OSX 平台。它适合需要对文本资料进行编码、分类和检索,并希望把定性编码结果与 R 的统计分析能力结合使用的研究者。需要注意:目前它只支持纯文本格式的数据,所有信息通过 RSQLite 存储在 SQLite 数据库中。

数据导入与文档管理

RQDA 在文档层面的功能包括:

  • 导入纯文本文件,也可以即时(on-the-fly)导入文档。
  • 导入 PDF 高亮内容,这一功能依赖 rjpod 包,适合用于文献的内容管理。
  • 支持非英语文档,其中简体中文在 Windows 以及 Debian Linux(locale 为 zh_CN.UTF-8)下经过充分测试。
  • 按关键词搜索文件,并在打开的文件中高亮显示关键词。
  • 为文件添加属性(attributes),便于内容分析。
  • 将文件归入文件类别(file categories)。
  • 重命名文件,以及临时删除文件。

编码与检索

编码是 RQDA 的核心工作方式:

  • 字符级编码(character-level coding):以字符为单位对文本打码,粒度比段落或句子级编码更细。
  • 编码后仍可编辑文件,不必担心编码与原文脱节。
  • 编码检索:可以检索已有编码,并方便地返回原始文件,以缓解文本切分(segmentation)带来的定位困难。
  • 条件检索:支持按条件筛选编码结果。
  • 重命名编码,以及临时删除编码。
  • 将编码组织为编码类别(code categories):这是理论建构的关键。作者有意避免使用树状分类结构。

备忘录与分类体系

RQDA 提供多层级的备忘录功能,覆盖文档、编码、编码操作、项目、文件等多个对象,便于随时记录分析思路。

在分类管理上,它可以:

  • 将编码组织为编码类别;
  • 将文件组织为文件类别;
  • 管理案例类别(case category)及案例的相关属性,这是连接定性与定量研究的重要功能;
  • 通过弹出菜单在互联网上搜索所选案例的相关信息;
  • 重命名文件、编码、编码类别和案例;
  • 撰写并组织田野工作日志(field work journals)。

与 R 的集成

RQDA 与 R 无缝集成,这意味着两件事:一是可以对编码结果进行统计分析;二是可以通过编写 R 函数来扩展数据操作与分析功能。在一定程度上,RQDA 与 R 共同构成了一个兼顾定量与定性数据分析的平台。

通过 R 函数,RQDA 可以:

  • 管理临时删除的内容(列出、撤销临时删除或永久清除);
  • 批量导入文件;
  • 在给定编码索引的情况下,计算两个编码之间的关系;
  • 给出编码及编码间关系的摘要。

数据存储与可移植性

RQDA 使用单一文件格式(*.rqda),本质上是一个 SQLite 数据库。数据以 UTF-8 存储,因此具有较好的可移植性,便于在不同平台之间迁移项目。

适用判断

如果你的研究以纯文本资料为主,需要在编码之外做统计或自定义分析,并且不介意通过 R 环境来扩展功能,RQDA 的功能组合基本可以覆盖从导入、编码、检索到分类、备忘和定量衔接的完整流程。如果你的资料以 PDF、图片或音视频等非纯文本格式为主,则需要先确认这些格式能否转换为纯文本,或借助 PDF 高亮导入功能间接处理。

rqda.r-forge.r-project.org