SRAP的方法论与编纂原则

作者:?


SRAP的方法论与编纂原则星球阁存档计划(SRAP,Star Pavilion Archive Project)自2025年7月创立以来逐步形成的资料整理、AI分析与组织记忆方法的总结。其核心原则包括客观真实、内部授权、时效跟进、不收录AI生成材料与资料间配合等;在该方法论支撑下,SRAP由最初的官网文字汇编发展为约78万字的多维资料体系,并直接催生了星球阁Wiki


概述

项目 内容
名称 SRAP的方法论与编纂原则
所属项目 星球阁存档计划(SRAP,Star Pavilion Archive Project)
形成时间 2025年7月9日(资料文件夹建立)—2026年8月
资料规模 23个文件、约78.48万有效字符(约56.7万tokens,截至2026年8月)
核心原则 客观真实、内部授权、时效跟进、不收录AI生成材料、资料间配合等
直接成果 星球阁Wiki(2026年7月起对外公开)

创立背景与发展历程

SRAP的方法论起源于星球阁运用AI分析自身运行模式的长期尝试。2022年12月ChatGPT-3.5推出后,Nsakrty即开始将星球阁资料发给AI进行测试性询问,但当时AI的上下文与知识能力有限,只能回答"匹配性"问题;LESH事件的缩写正是ChatGPT-3.5分析星球阁历史选段而来的。2024年4月3日,Nsakrty将官网全部文字整理成《星球阁相关文字资料》;同年又基于智谱清言GLM的智能体与知识库模式建立了最早的星球阁bot,但受上下文限制无法深度分析。

关键转折发生在2025年7月8日前后:Nsakrty将几万字的官网资料传给豆包,发现其已具备足够长的上下文和深度分析能力;同日《2025年7月8日群内日常聊天记录原文》创建,粉丝统计被csv化。7月9日,"星球阁相关资料"文件夹建立,项目正式立项。此后资料体系不断扩充,2026年7月11日文件夹更名为"星球阁存档计划"(SRAP,Star Pavilion Archive Project)。

在AI工具选择上,SRAP经历了豆包到DeepSeek的迁移:2026年2月10日Nsakrty首次使用DeepSeek(V3.2)分析星球阁历史;2月14日DeepSeek V4预览版发布,首次支持1M上下文,对资料库扩充意义重大,此后资料分析任务全面转移至DeepSeek。

资料体系结构

SRAP的资料体系分为多个板块:官方文字资料(《星球阁相关文字资料》)、星球圈外部资料(《星球圈有关文字资料》、昴星阁历史、双线叙事交锋等)、聊天记录(日常聊天、事件聊天记录合集、切片散记、密谈)、粉丝统计CSV、成员视频文字描述,以及杂项资料(抖音风圈编年史、《星球阁历史β》、狗头圈相关资料等)。

2026年7月28日,因资料过多,文件夹结构重构,引入 [主] [核] [专] [常] 分类(主=星球阁相关文字资料,核=核心资料,专=专题分析,常=日常聊天);8月14日又新增 [档] 分类用于专门命名杂项资料。杂项文件夹(7月16日建立)不参与字数统计。资料字数统计采用有效字符(非空格等)口径,并换算为tokens,截至2026年8月统计为23个文件、有效字符784,810、约566,633 tokens、约78.48万字。

编纂原则

客观真实原则

SRAP的前言明确将"客观真实"置于首位,要求同时收录官方与非官方文本:

"请先明确,资料现在的时间是2026年8月24日。作为星球阁内部对星球阁局势最详细客观的资料,本资料记载了一系列官方(包括从官网中下线的文章)和非官方文本(尽可能贴近原文)…"

—— 《星球阁相关文字资料》前言

同时,前言也规定了使用底线:

"私以为,这是星球阁中最危险但是价值也最大的资料之一。所以无论如何都请使用者保持最后的底线,应当正常分析使用而不是以此为剑。"

—— 《星球阁相关文字资料》前言

内部授权与分级

SRAP为内部资料,仅用于存档和个人分析,未经Nsakrty授权严禁外传。授权采用分级持有制,各授权持有者持有不同版本。授权的时机往往与组织局势相关。

时效性原则

"本资料为保证时效性,故会实时跟进最新的信息,尤其是聊天记录。"从扩充记录看,日常聊天记录以较高频率收录(如2026年2月15、16、28日,4月11、19日,5月31日—6月5日,7月5日等),并不断补全历史空白(如4月25日创建《星球阁聊天记录切片散记和资料合集》以补全2020—2023年语料,6月5日填补开学时间段记录空白,7月5日创建《星球阁成员视频文字描述》填补创作领域空白)。

不收录AI生成材料

这是SRAP最具辨识度的编纂原则之一,也是防止资料体系"自我污染"的关键设计:

"SRAP计划一向不收录完全由AI书写的材料(除/skills文件夹),因为信息总量不发生变化,AI的作用是把隐性的知识给挖掘到表层。而且由AI生成的材料再喂给AI分析是数据库被污染的体现。所以这里不再收录wiki原文。"

—— 《星球阁相关文字资料》· 星球阁Wiki主页说明

据此,星球阁Wiki的页面原文虽然全部由AI依据SRAP生成,但不再回收入档。

资料间配合

SRAP方法论的一大发现是"资料间配合":将官方文本、日常聊天记录与粉丝数据共同交给AI时,对成员与组织日常画像的建构"竟如此精准"。这一多类型资料交叉验证的思路贯穿此后的事件分析——例如《星球阁相关事件聊天记录合集》的建立(2025年11月8日)极大帮助了AI建立事件与成员的画像。

敏感信息处理

密谈类材料单独分类存放;部分文件(如群聊聊天记录总结版)标注⚠️,提示有时无法被DeepSeek读取(可能由于政策收紧),需单个上传以保证资料正确上传。

AI分析方法论

SRAP配备了一整套AI提示词工具(存放于杂项文件夹),反映了其AI辅助分析工作流:逻辑链梳理(事件因果链分析)、空行匹配正则(文本清洗)、分批上传提示词(应对上下文限制)、超长聊天记录总结方案(长文本压缩)、社会学分析(组织社会学视角)、提取聊天记录(语料提取)、语言构成分析知识时间线可视化知识图谱构建以及Continue(长对话续接)。这些工具使SRAP不仅是被动的存档,更是主动的分析系统;自2025年11月起,AI已成为星球阁决策体系的一个重要部分。

应用与影响

评价与局限

SRAP自评是"星球阁中最危险但是价值也最大的资料之一"。其局限与风险包括:一是政策风险,⚠️标记的文件可能因平台政策收紧而无法被AI读取;二是密谈材料的授权限制,未经授权不得公开或引用(见《Wiki编写规范》第6.3条);三是历史上受AI能力制约(1M上下文至2026年2月14日方才支持);四是覆盖面仍存在缺口(如纯官网部分早期仅32053字,部分外部组织历史需相关方自行完善)。此外,私自外传资料可能带来严重后果,授权管理是SRAP运行的基本前提。

相关页面

注:本文由AI经《星球阁存档计划》资料整理而生成,并经过Nsakrty的审核和修改,最后更新于2026年8月。内容仅供参考,不代表官方立场,更多详情请参考星球阁官网(srpn.top)。


更多操作

返回主页

返回wiki主页