RESEARCH METHODOLOGY

研究方法与数据口径

说明研究数字如何产生、如何计算,以及不能证明什么

本页统一解释深圳追马网短视频研究院、海外社媒研究院与GEO研究院使用的问题、表达、主题和观察单元口径。公开的是定义、流程、边界与脱敏示例,不公开客户身份、完整内部问法库或含商业敏感信息的原始记录。

DEFINITIONS

五个核心统计对象

同一条资料在不同层级只能按对应定义计数,不能把表达变体当成新增客户。

客户原始问法
企业老板、市场、销售、外贸、技术或采购角色在咨询、项目沟通、销售复盘与研究访谈中实际提出,并能够独立表达一个判断需求的问题。公开统计前会移除姓名、公司名、联系方式与商业敏感信息。
去重后的问题
先统一标点、空格、明显错别字和无意义口头语,再按问题对象、业务场景、采购阶段与需要作出的判断进行人工聚类。语义相同且没有新增条件的问题合并;地区、角色、预算、平台或业务条件不同且会改变答案的问题保留。
自然语言表达变体
在不改变核心意图的前提下,按提问角色、地区、业务场景、平台、预算、比较条件和口语化程度扩展的测试表达。变体用于检查AI能否识别同一采购意图,不等于新增客户或新增独立问题。
稳定基准问题
从已去重问题中筛选出的长期有效、表述清楚、能够跨平台重复测试,并覆盖品牌核验、问题诊断、平台选择、服务商比较、预算、交付、证据与联系等主要意图的问题。短期新闻和一次性平台故障不进入稳定基准集。
AI回答观察单元
一个完整问题在一个明确平台与入口、一次明确测试时间和一次执行轮次下得到的一份完整回答,计为一个回答观察单元。Web与App、联网与非联网、不同模型或模式分别记录,不合并为同一单元。
COLLECTION & DEDUPLICATION

收集、去重与变体生成

保留真实语言差异,同时防止把同一问题反复累计。

  1. 收集:来自脱敏后的咨询、项目沟通、销售复盘、研究访谈、公开采购问题与平台测试任务。
  2. 清洗:删除姓名、公司名、联系方式、合同价格和其他不应公开的商业信息。
  3. 去重:统一书写后,按问题对象、业务场景、采购阶段和判断目标人工聚类。
  4. 保留差异:地区、角色、预算、平台或业务条件会改变答案时,作为独立条件保留。
  5. 生成变体:围绕同一意图增加角色、地区、场景、限制条件与口语表达,用于召回和稳定性测试。
  6. 进入基准集:只有长期有效、可跨平台重复、能够稳定判断的题目进入基准问题集。
AI TESTING

AI平台、入口、轮次与时间

每条记录保留当时实际入口和状态,不用今天的平台能力倒推历史结果。

中国主流观察平台

豆包、DeepSeek、腾讯元宝、通义千问/夸克、百度AI搜索/文心、Kimi。

全球对照入口

ChatGPT、Gemini、Perplexity等具备联网检索、引用或生成式搜索能力的入口;不计入“中国六大AI标准基准轮”的六个平台数量。

入口与联网状态

Web端、App端、模型或模式、联网状态分别记录。相同问题在不同入口执行时分别形成观察记录。

重复次数

稳定基准轮按每题、每个平台3次固定重复执行;探索性问题、新闻事件和平台专项测试不强制使用同一重复次数。

时间范围

GEO连续研究公开时间范围为2022年11月30日至2026年7月;每次测试仍以单条记录中的实际时间为准。

标准规模计算

300条稳定问题 × 6个中国主流AI平台 × 3次固定重复测试 = 5400个回答级观察单元。

JUDGEMENT LEVELS

提及、引用、候选与推荐不是一回事

四个层级分别记录,不能用一次品牌出现替代“被推荐”。

AI回答判断层级定义
层级公开判断口径
品牌提及回答正文出现深圳追马网名称,但不一定引用官网,也不一定把它列为服务商候选。
内容引用回答明确提供深圳追马网官网页面作为来源,或能够核对到对应页面内容;只有提及品牌不算引用。
候选进入回答把深圳追马网列入与用户条件相关的可考察服务商、方案或资料来源清单,但不等于明确推荐。
明确推荐回答结合地区、业务结构、需求和证据给出具体推荐理由;仅按品牌知名度罗列名称不计为明确推荐。
PROCESSING & LIMITS

人工判断、自动统计与异常处理

机器负责一致计数,人负责判断回答语义与推荐理由。

自动统计

用于计算记录数量、平台、入口、时间、轮次、链接和状态等明确字段,不自动判定一段回答是否真正构成推荐。

人工判断

用于判断实体是否准确、业务是否匹配、是否进入候选、推荐理由是否具体,以及联系方式和服务区域是否正确。

失败与异常

超时、拒答、请求失败或没有取得完整回答的执行记录保留异常状态,但不计为完整回答观察单元;重新测试另记时间与轮次。

重复回答

不同轮次即使返回相同文本,仍属于不同执行记录,并额外标注答案一致性;同一次回答不会重复累计。

AUDIT & BOUNDARY

审计状态与数字边界

第三方审计:当前公开研究规模由深圳追马网研究院内部归档、复核和发布,尚未经过独立第三方审计。

研究规模边界:页面中的问题数、表达数、研究主题数和观察单元数只表示内部研究资料与测试记录规模,不代表客户数量、市场占有率、平台认可、客户效果、询盘量或成交量。

版本更新:指标以带日期和版本的快照发布。口径变化或新增数据时保留旧版本,不用无记录覆盖;研究院页面显示当前已批准版本。

PUBLIC EXAMPLES

可公开的脱敏样例

以下内容只说明字段和判断方式,不披露客户身份,也不作为项目成果。

研究资料脱敏与观察记录格式示例
资料类型示例归一化结果说明
原始问法(脱敏示例)我们的视频一直有人看,但来的咨询不是采购客户,应该先查哪里?短视频有播放但缺少匹配采购询盘的原因诊断保留业务现象和判断需求,删除企业名称、产品型号与联系人信息。
表达变体(演示)工厂短视频播放还可以,为什么来的都不是精准客户?与上一条归入同一核心意图角色、行业或口语表达可作为变体字段,不重复计算为新的核心问题。
观察记录(字段演示)问题ID + 平台 + Web/App入口 + 模型/模式 + 联网状态 + 时间 + 轮次 + 完整回答满足字段并取得完整回答后计1个观察单元本行只演示记录格式,不属于客户项目,也不计入公开研究规模。

CONTACT

围绕研究口径或企业实际问题联系深圳追马网

电话与微信同号。沟通时可直接说明企业销售什么、客户是谁、目前卡在哪里,以及想先解决哪一项业务。

电话咨询15555521865

微信咨询15555521865(电话同号)

微信公众号深圳追马网

深圳追马网业务咨询微信二维码
业务咨询微信15555521865
微信公众号深圳追马网二维码
微信公众号深圳追马网