当前 AI 分析方法
本页说明当前实现的输入、公式与发布前证据核验。未成功获取的外部数据不会被当作证据。
异常评测发布趋势分数是对已获取 Steam 评测应用5项公开规则后的平均值,不混入模型返回的数值。AI 输入最多40条代表评测,核心主张会与原文一致引文核对。
⚖️ 当前实现摘要
| 项目 | 当前处理 | 限制 |
|---|---|---|
| AI 输入 | 最多40条代表评测 | 并非已获取的全部语料 |
| 核心主张 | 核验评测 ID 与原文引文 | 不合格结果不会发布 |
| 外部比较 | Metacritic / OpenCritic | 仅在获取成功时使用 |
| 可选分析 | 仅在具备所需正文或元数据时接受 | 不以推测填补缺失数据 |
| 显示语言 | 日语、英语、韩语、中文 | 仍可能遗漏文化语境 |
📡 数据来源
主要输入是已成功获取的评测正文。外部评分仅在获取成功时用于比较。
Steam 游戏以成功获取的评测正文、推荐状态、游玩时长及有用票等作为主要证据。
非 Steam 游戏以成功获取的评测作为主要语料;无法取得足够语料时不会批准分析。
仅在获取成功且存在有效值时用于比较,不加入异常发布信号公式。
🔍 异常发布趋势分数计算方法
公开数值是五项规则在已获取评测中的平均值。AI正文分析另行生成等级、摘要和证据,不会覆盖该数值。
对已获取语料中的每条评测应用5项规则,再计算平均值。
去除重复及过短正文后,按正负评价平衡选取最多40条代表评测交给 Gemini。
这是0至100的启发式分数,不是比例、操纵概率或欺诈证据。
📐 六轴质量评估
根据代表评测估算六个0至100分维度。评测提及越少的维度不确定性越高,并非实测值。
视觉质量·美术风格·帧率稳定性
操作感·机制深度·可重玩性
叙事质量·世界观·角色塑造
价格对应内容量
游戏时长·重玩性·终局内容
BUG频率·崩溃·优化质量
🏆 综合等级系统
代表样本中的多个维度较高。购买前应结合引文证据与个人偏好判断。
多数维度较高,但已获取样本之外的意见可能未被反映。
样本中同时存在明确优点与需要确认的问题。
样本中的优点与缺点大致相当。
代表评测中存在多项重要问题,应查看对应引文。
🧬 特殊分析模块
evaluation_gap仅在日语和英语评测足够时估算已获取样本内的差异。
ai_generated_suspicion整理引文中的重复或模板化措辞,不判断是否由 AI 生成或作者身份,也不公开未经校准的比例与置信度。
spec_analysis仅在输入评测中出现具体 GPU、FPS 或故障描述时整理。
review_contradictions仅在可用原文引文确认推荐状态与正文矛盾时显示。
⚙️ AI模型与技术规格
⚠️ 限制与注意事项
① 仅为估值:异常发布信号、硬件相关估计和六轴分数来自已获取数据、规则或AI。该信号不是比例或操纵证明,所有数值均不保证准确。
② 评测采样:AI 输入最多40条代表评测。已获取语料更大时,未入选的意见可能不会反映在结果中。
③ AI模型局限:可能无法完全理解讽刺、玩笑和文化差异。
④ 时点与外部数据:分析基于获取及缓存时点。外部比较与可选模块仅在成功取得所需数据时显示。
❓ 常见问题
对已获取的 Steam 评测语料应用5项公开规则并取平均值。AI 最多分析40条代表评测,但模型返回的额外数值不会混入该分数。
总评、优点和缺点必须绑定输入评测 ID 与原文一致引文。不存在的 ID、引文不匹配或证据不足会在发布前被拒绝。
Graphics、Gameplay、Story、Value、Volume、Stability从代表评测中估算。提及不足的维度属于不确定估计。
不会。Metacritic / OpenCritic 比较仅在获取成功时执行,各可选模块也必须具备所需正文或元数据。
📋 方法论更新记录
这里记录影响公开说明与实现对应关系的变更。
| 日期 | 变更 | 影响 |
|---|---|---|
| 2026-07-20 | 从公开说明中删除未获取的信息源与缺乏依据的预测字段 | 准确性 |
| 2026-07-20 | 明确最多40条代表评测及原文引文核验 | 透明度 |
| 2026-07-20 | 将外部比较与可选模块限定为具备所需数据时启用 | 证据性 |