卡塔尔GEO与AEO机构

卡塔尔GEO公司
阿拉伯语引用按路径分开衡量 MSA、方言与Fanar

在阿拉伯语里被引用,不等于在阿拉伯语里有排名。我们衡量四条提问路径,而不是一个数字。

被引用于: ChatGPT
ChatGPT
Gemini
Google AI Overviews
Perplexity
Copilot
Fanar
ISO认证 品质有保障
3座城市 Jakarta • Bandung • Bali
自2023年做GEO 方法可查证
~0.5%
阿拉伯语内容在全网数据中的占比,而母语使用者超过4亿人
来源:卡塔尔计算研究所(QCRI),HBKU,在Fanar 2.0技术文档中作为工程约束写明
+40.9%
同行评审的生成式引擎优化研究中实测到的最大单项引用提升,来自具名专家署名
来源:Aggarwal等,ACM SIGKDD 2024
27B
Fanar 2.0的参数量,即卡塔尔自主阿拉伯语模型,首个版本为90亿
来源:哈马德·本·哈利法大学卡塔尔计算研究所,2025年12月发布
38
Google在2025年10月为AI Mode新增的语言数量,其中包含现代标准阿拉伯语
来源:Google MENA产品公告,2025年10月

关于卡塔尔的GEO与AEO

卡塔尔的买家现在会先让AI助手筛出一份供应商名单,之后才有人拿起电话。你的品牌是否出现在那个答案里,取决于与排名不同的另一件事;而在阿拉伯语里,取决的又是另一件。

阿拉伯语来源池偏薄,这件事有两面

卡塔尔计算研究所,也就是构建卡塔尔自主阿拉伯语模型的团队,在自己的技术文档里把问题说得很直白:阿拉伯语约占全网数据的0.5%,而母语使用者超过4亿人。任何处理阿拉伯语的检索系统都从这个池子里取材。第一个后果显而易见,阿拉伯语答案可用的材料更少。第二个后果才是值得动手的地方。一个高质量阿拉伯语材料极少的领域,同时也是争夺被引用来源这个位置的竞争者极少的领域。这不是对结果的承诺,而是在解释为什么同样的工作在阿拉伯语里要费更多力气,也留出更大空间。

卡塔尔自建了阿拉伯语模型,于是多出一个面

多数市场只需要考虑一组回答引擎。卡塔尔要考虑这一组,外加一个自主的。2019年在如今的通信与信息技术部之下发布、并与卡塔尔计算研究所共同制定的国家AI战略,把阿拉伯语处理明确列为国家优先事项;随后这个国家真的把自己的模型家族做了出来:Fanar,2024年12月以90亿参数发布,2025年12月达到270亿参数,在卡塔尔境内、依托卡塔尔的基础设施训练,开发仍在继续。它以封闭环境运行,目的正是让数据不外流;它在现代标准阿拉伯语之外也处理海湾方言,并包含为伊斯兰内容专门构建的组件。对一家卡塔尔机构而言,尤其是与国家相关或从事伊斯兰金融的机构,这是一个在别的市场里根本不存在、也没有任何全球机构方法论提到过的检索面。

媒体报道

  • MSN
  • Forbes
  • Business Insider
  • AP News
  • Detik.com
  • CNBC
  • Kompas.com
  • Liputan6
  • Clutch
  • GoodFirms

同一个问题,用两种语言提出

同一个买家,同一个意图,两种语言。引擎并不是把答案翻译一遍。它伸手去取的是另一组来源,一个品牌可以出现在其中一个版本里,而在另一个版本里完全缺席。

ChatGPT 用英语提出的问题
多哈商业楼宇的领先设施管理服务商有哪些?
来源明显偏向英语材料:
英语企业网站与英语服务页面
英语的区域商业报道
英语站点内容
区域英语媒体
英语名录
Gemini 同一问题用阿拉伯语提出
同一个问题,用现代标准阿拉伯语,按卡塔尔招标文件会采用的表述方式提出
来源池更窄,浮出水面的是另一批名字:
拥有真正阿拉伯语页面的机构
在阿拉伯语报道中被点名的品牌
阿拉伯语站点内容
阿拉伯语媒体
阿拉伯语材料不足时回退到英语
4条路径,不是1个数字
阿拉伯语提问由阿拉伯语来源作答、阿拉伯语提问由英语来源作答、英语提问由英语来源作答、英语提问由阿拉伯语来源作答,这是四个各自独立的结果。把它们汇报成一个阿拉伯语可见度百分比,会盖住损失究竟发生在哪里。

此处示意的是为本页交叉核对过的同行评审研究与服务商研究中记录的语言本地化规律。这不是某个具体查询的截屏,图中出现的服务商名称是类别,而不是真实机构。

研究究竟测了什么,又没有测什么

有两项发现决定了我们在卡塔尔的做法。一项关于检索在哪里损失准确率,另一项关于哪些内容选择能可测量地提高被引用的机会。两者都经过同行评审,也都比这个市场上流传的营销说法要窄得多。

提问语言与文档语言不一致时的实测损失
BGE-M3旅游语料
13%
BGE-M3法律语料
33%
Multilingual-E5旅游语料
33%
Multilingual-E5法律语料
42%
Amiraz等,The Cross-Lingual Cost: Retrieval Biases in RAG over Arabic-English Corpora,ACL ArabicNLP 2025。BGE-M3的数字是检索准确率损失,Multilingual-E5的数字是Hit@20损失。两种不同的度量,分开呈现而非取平均。损失跟随语言不匹配而来,而不是跟随阿拉伯语本身。
+40.9%

实测到的最大引用提升来自具名专家署名

2024年在ACM SIGKDD发表的同行评审生成式引擎优化研究,把内容改动与引用结果放在一起做了检验。引用一位具名专家带来的单项提升最大。配有具名来源的数据,以及行内引注,两者都带来了相当可观的提升。关键词堆砌则降低了引用率。这就是本页所依据的证据基础,它指向的是编辑层面的可信度,而不是技术上的花招。

尚未测量

卡塔尔尚不存在独立的阿拉伯语引用基准

在为本页查阅过的所有来源中,没有任何独立研究测量过回答引擎针对卡塔尔的阿拉伯语提问引用阿拉伯语来源的频率,也没有研究测量过卡塔尔市场内阿拉伯语与英语的答案质量差异。这种缺失不会让工作停下来。它改变的是一份诚实报告应有的样子,也意味着摆到你面前的任何阿拉伯语可见度数字,包括我们给出的,都必须连同查询集合、日期与计算方法一并交出。

检索方面的数字来自通用领域基准,不是在卡塔尔境内做的测量。我们引用它们是为了说明其揭示的机制,不会把它们改写成卡塔尔市场数据。

我们在卡塔尔的GEO与AEO服务

六条工作线,指向同一个结果:当卡塔尔买家用他们真正会用的语言提问时,成为回答引擎点名的那个来源。

双语提示词面板设计

一份固定的、书面的买家问题面板,包含三种变体:用你所在品类真正采用的语体写成的现代标准阿拉伯语、买家日常口语使用的海湾方言,以及面向市场中大量非阿拉伯语人群的英语。

面板在采集任何基线之前先与你确认,并且不会在两次报告之间被悄悄改动。一个可见度数字只有在其背后的问题保持不变时才可跨时间比较;我们宁愿在一开始就把面板争论清楚,也不想日后去解释一个被挪动过的球门。

四路径引用测试

每一条提示词都沿四条路径测试:有阿拉伯语来源可用的阿拉伯语提问、只存在英语来源的阿拉伯语提问、有英语来源的英语提问,以及答案其实存在于阿拉伯语中的英语提问。

2025年ACL ArabicNLP的同行评审研究测得,当提问语言与文档语言不一致时损失在13%到42%之间,具体取决于嵌入模型与领域。把这四条路径压成一个百分比,恰好盖住了关于双语站点最可付诸行动的那项发现。

阿拉伯语实体与结构化数据基建

一个实体,两种语言,一张图谱。稳定的标识符;阿拉伯语替代名称采用你的市场真正在用的叫法,而不是音译;inLanguage使用规范的语言标签声明;并用sameAs链接到回答引擎用于核实的公开知识库。

要说实话:结构化数据本身与语言无关,它帮助机器理解自己在读什么;Google也公开表示过,结构化数据不保证任何特定结果。我们把它当作基本卫生来落实,而不是当作一个我们假装能操控的杠杆。

阿拉伯语与英语的可引用内容单元

每个板块都按被单独抽出后仍能自洽来构建:问题写在标题里,答案放在开头句子,一个单元只承载一个论点,每个数字都挂着具名来源。

在那项同行评审研究中,具名专家署名带来的引用提升最大,因此专业人士的引语被当作结构件而非装饰。表格是包含真实文字的HTML表格,因为锁在图片或扫描件里的阿拉伯语内容,任何系统都无法可靠读取。

阿拉伯语媒体的自然报道

在阿拉伯语媒体与名录中的落位与提及,因为一个只出现在自家站点上的品牌,只给回答引擎提供了一个可衡量的来源,没有任何旁证。

这是最慢、最依赖人工的一条工作线,也正是阿拉伯语来源池偏薄反而对你有利的地方:争夺同一个引用位置的高质量阿拉伯语材料,比英语环境下少得多。

了解PDPPL要求的监测与报告

引用追踪跑在我们自己撰写的提示词和我们观察到的品牌提及之上,这些都不是个人数据。这样监测层就与2016年第13号法下处理个人数据所附带的义务保持距离。

当报告确实需要引入个人数据时,例如来自线索表单或用户自报的归因,处理方协议与明确界定的目的要先行到位。依照该法关于跨境数据流动的条款,跨境处理原则上是允许的,因此海外团队是可行的;而在卡塔尔金融中心注册的客户,适用的是该中心另行运行的制度。
排在第一位和被引用是两种不同的结果,而且各自还分两种语言

卡塔尔的自主阿拉伯语技术栈,以及它在你计划中的位置

卡塔尔属于极少数由国家出资自建阿拉伯语模型、而不是等全球模型变好的市场之一。这改变了一家机构必须考虑的面,而且这种改变会因你的买家是谁而不同。

它是什么对谁最重要
全球回答引擎 ChatGPT、Gemini、Google AI Overviews与AI Mode、Perplexity、Copilot、Claude。Google在2025年5月把AI Overviews带入该地区并支持阿拉伯语,随后在2025年10月的38种语言扩展中为AI Mode加入现代标准阿拉伯语。 所有商业买家。大部分发现行为发生在这里,双语提示词面板也主要在这里发挥作用。请注意,AI Mode公布支持的阿拉伯语是现代标准阿拉伯语,不是海湾方言。
Fanar,自主模型家族 由哈马德·本·哈利法大学卡塔尔计算研究所与通信和信息技术部共同构建。2024年12月以90亿参数发布,2025年12月达到270亿参数,在卡塔尔境内依托卡塔尔的基础设施训练,开发仍在继续。除现代标准阿拉伯语外,也处理海湾、黎凡特与埃及方言,可通过界面与API使用。 与国家相关的机构、受监管行业,以及任何买家或内部团队正因为它以封闭环境运行、数据不外流而选用这一国家级工具的组织。对伊斯兰金融与清真商业同样相关,因为该平台包含专为伊斯兰内容构建的组件。
国家政策层 卡塔尔2019年发布、并与卡塔尔计算研究所共同制定的国家AI战略,把阿拉伯语处理明确列为国家优先事项。卡塔尔中央银行已针对持牌金融机构发布AI指引。 任何在准备投标文件或董事会材料的人。在卡塔尔,与已公布的国家优先事项保持一致本身就是一种采购信号,这在多数由私营部门主导的市场里并不成立。

模型版本会变。我们把这套自主技术栈当作一个仍在演进的家族来跟踪,而不是一个定型的产品;对任何在没有日期、没有方法的情况下就给你报出某个具体模型版本引用率的机构,我们只会视为在猜。

我们报告什么,以及我们拒绝报告什么

这个市场里到处是背后没有方法的可见度百分比。要把一个测量结果和一个销售数字区分开,最快的办法是看服务商愿意为哪些东西给出定义。

我们报告的内容

被引答案率。在面板提示词中,回答引擎点出你的品牌并标注来源的比例,按引擎、按语言路径分别报告。

来源语言拆分。每一次由阿拉伯语提示词赢得的引用,被引文档究竟是阿拉伯语还是英语。这个数字会告诉你下一步该在哪里发布内容。

实体准确度。引擎在两种语言里是否正确描述你的业务,包括名称、服务与地点。一个说得很自信却是错的描述,比完全没出现更糟。

表述倾向。你被点名时是中性、正面,还是带着一句保留。谨慎的提及与真正的推荐,是两种不同的商业结果。

可复现数据。提示词、日期、引擎、语言与原始答案文本,全部导出,让你自己的团队不需要我们也能重跑一遍。

我们拒绝报告的内容

单一的阿拉伯语可见度百分比。它把四条不同的语言路径平均成一个数字,毁掉了唯一真正有用的诊断信息。

把提及算作引用。引擎可以点出品牌名而不标注来源。两者之中只有一种会把流量送回你的站点,把它们合并只会让报告虚高。

拿排名数据当引用证据。一个页面可以排第一却从未被引用,排位更靠后的页面反而可能被反复引用。用其中一项去证明另一项,是跳过了一个步骤。

保证被引用。没有人能控制模型输出什么。这里的任何保证,都是在替一件机构并不拥有的事情下定论。

只报表现好的提示词。失败的提示词才是工作文档。省略它们的报告是宣传册。

为什么选择我们作为你在卡塔尔的GEO机构?

自2023年起可查证的GEO实践,以及一套会交到你手上的方法

海湾地区现在卖GEO的机构,多数是把它加到已有的搜索服务上。在一个没有独立阿拉伯语基准可供援引的品类里,唯一诚实的差异点,是一套客户可以检查、可以重跑、也可以反驳的方法。

2008
创立年份
2023
GEO开拓起始年
3
办公室:Jakarta、Bandung、Bali
3
通过ISO标准认证

我们把四条语言路径分开

有阿拉伯语来源的阿拉伯语提问、只有英语来源的阿拉伯语提问,以及对应的两种英语情形。分开报告,因为同行评审研究显示损失就落在不匹配上,而一个阿拉伯语单一百分比恰好会把它盖住。

锚定同行评审,而不是服务商的倍数

我们的方法建立在2024年ACM SIGKDD的生成式引擎优化研究,以及2025年ACL ArabicNLP的跨语言研究之上。关于这个市场,有几项被广泛引用的服务商统计数据在研究过程中被逐一核查过,并被有意排除在本页之外。

监测在设计上就避开个人数据

引用追踪跑在我们自己撰写的提示词和我们观察到的提及之上,这让监测层与2016年第13号法的义务保持距离。当个人数据确实进入报告时,处理方协议先于仪表盘。

我们把自主技术栈算进来

卡塔尔出资自建了阿拉伯语模型家族,并在2019年把阿拉伯语处理列为国家优先事项。对与国家相关以及受监管的买家而言,这是一个真实存在的检索面,而全球机构的方法论里对此一字未提。

相关服务

在卡塔尔,GEO与SEOv2体系的其余部分并肩推进时效果最好,因为技术与内容的地基是共用的,即便结果并不相同。

想看你的品牌在阿拉伯语与英语里被并排测试一次吗?

我们会为你的品类搭一个小型双语提示词面板,在你的买家实际使用的引擎上跑一遍,然后把原始答案连同提示词、日期与语言一并交给你,其中也包括你没有出现的那些提示词。联系我们的团队即可开始。

 申请双语引用审计




关于卡塔尔GEO与AEO的常见问题

GEO、AEO与SEO有什么区别,三样都需要吗?

SEO关注的是链接列表中的排名位置。AEO关注的是拿下那一条被抽取出来的答案。GEO关注的是在综合生成的答案里被点名并被标注来源。三者共用技术与内容地基,这也是它们通常被放在一起界定范围的原因,但结果并不相同。看清区别最锐利的方式是:一个页面可以排第一却从未被引用,排位更靠后的页面反而可能被反复引用。这就是排名位置不能用作引用表现证据的原因。

所谓GEO机构,是不是就是在服务清单里加了AI的SEO机构?

在这个市场里,往往确实是,而且有一个相当可靠的检验方法。看它的方案是否在AI引用的说法旁边同时承诺精选摘要和零位排名。那些都是排名概念,它们的出现说明这是一项被重新包装的SEO服务,而不是引用实践。接着索取提示词集合、按引擎划分的结果、日期,以及任何百分比背后的计算方法。真正在做引用工作的服务商,一经索取全部拿得出来;换了新标签的SEO服务商通常拿不出来。

用阿拉伯语提问时,AI引擎会引用阿拉伯语来源吗?

有时会,而诚实的答案比一句是或不是更有用。研究显示引用来源池会向提问所用的语言偏移,这意味着当买家用阿拉伯语提问时,只有英语的内容在很大程度上不具备入选资格。另外,2025年发表于ACL ArabicNLP的同行评审研究测得,当提问语言与支撑文档语言不一致时损失在13%到42%之间,取决于嵌入模型与领域。造成损失的是这种不匹配,而不是阿拉伯语本身。落到实践上就是:答案必须以人们提问时所用的语言存在,这也是我们测四条语言路径、而不是报一个阿拉伯语数字的原因。

阿拉伯语的引用成果能被证明吗,我们该索取什么?

索取四样东西,少一样都不要接受。完整的提示词面板,阿拉伯语与英语双份,包括共有多少条以及由谁挑选。测试过的引擎与日期区间,并且运行不止一次,因为回答引擎在不同次运行之间会变。导出的原始答案文本,让你的团队可以独立重跑。以及你的品牌没有出现的那些提示词。愿意把失败情况给你看的服务商是在做测量,只给你看战绩的是在做销售。我们把这四样作为标准交付,也建议你向进入短名单的其他任何一家提出同样要求。

对卡塔尔受众来说,哪些引擎最重要?

全球那一组承担了大部分工作:ChatGPT、Gemini与Google AI Overviews,再加上Perplexity、Copilot与Claude。Google在2025年5月把AI Overviews带入该地区并支持阿拉伯语,随后在2025年10月的38种语言扩展中为AI Mode加入现代标准阿拉伯语。除此之外,卡塔尔还有一个自主的面。如果你的买家与国家相关、处在受监管行业,或从事伊斯兰金融与清真商业,那么把Fanar纳入是值得的,因为该平台以封闭环境运行,并包含为伊斯兰内容构建的组件。引擎组合应当按客户逐一确定,而不是靠假设。

Fanar是什么,它在商业上重要吗?

Fanar是卡塔尔的自主阿拉伯语模型家族,由哈马德·本·哈利法大学卡塔尔计算研究所与通信和信息技术部共同构建。它于2024年12月以90亿参数发布,2025年12月达到270亿参数,在卡塔尔境内依托卡塔尔的基础设施训练,开发仍在继续。除现代标准阿拉伯语外也支持海湾、黎凡特与埃及方言,可通过界面与API访问。它在商业上是否重要,完全取决于你的买家是谁。对一家与国家相关的机构,或一家因为数据留在境内而选用国家级工具的受监管机构,它非常重要。对一个纯私营的消费品牌,它是次要的面。

阿拉伯语内容该用现代标准阿拉伯语还是海湾方言?

两种都要,按意图分配。现代标准阿拉伯语承载机构、法律、采购与B2B语言,也是卡塔尔机构书面表达所用的语体。海湾方言属于买家日常开口说话的地方:常见问题、面向消费者的页面、本地意图。在回答引擎这一侧有两件事值得知道。Google为AI Mode公布的阿拉伯语支持,具体指的是现代标准阿拉伯语。而已公开的主要阿拉伯语方言基准根本没有包含卡塔尔方言,因此方言处理是真的缺乏测量,而不是已经解决。我们把方言当作需要在你的品类里去测试的事情,而不是可以假设的事情。

在卡塔尔隐私法之下,你们怎么处理我们的数据?

设计目标是让监测层完全不触碰个人数据。引用追踪使用我们自己撰写的提示词与我们观察到的品牌提及,这些都不是个人数据。当报告确实需要个人数据时,例如来自线索表单或用户自报的归因,2016年第13号法即适用,带有明确目的的处理方协议要先行到位。该法由国家网络安全局通过其国家网络治理与保障事务部门监管,执法主体为国家数据隐私办公室,针对运营者的执法决定已经出现过。在卡塔尔金融中心注册的客户,适用该中心另行运行的制度。

为了让你们开展工作,我们的数据必须留在卡塔尔境内吗?

不必。该法明确承认跨境数据流动,并以一般原则规定控制者不得限制个人数据向境外传输,只在处理行为将违反该法、或可能对数据本身及个人隐私造成严重损害时才介入。针对这类工作,不存在一刀切的数据本地化要求,因此海外交付团队是可行的。留下来的是责任而不是禁止:处理方协议、以书面界定的目的,以及按所需额外许可处理的特殊类别数据。

外国机构可以为卡塔尔机构做这类工作吗?

私营部门客户可以,而且很常见。政府与国家相关的合同情况不同。公开招标依照2015年第24号法及其修正案进行,除招标文件另有说明,投标通常以阿拉伯语提交;本地设立要求可能适用于签约之前,而不是投标阶段。没有规则单独针对营销或搜索服务,因此起决定作用的是招标文件,而不是一个笼统的假设。如果目标是公共部门的项目,这件事应当在合作开始时就解决掉。

你们会报告哪些KPI,多久一次?

按引擎、按语言路径划分的被引答案率,阿拉伯语提示词所赢得引用的来源语言拆分,两种语言下的实体准确度,你的品牌被点名时的表述倾向,以及完整的可复现数据。每月一次,双语呈现,每次都对照同一套提示词面板,使数字可以比较。我们不会报告的是:一个混合出来的阿拉伯语可见度百分比、把提及算作引用、把排名数据当作引用证据,或者省略了毫无结果那些提示词的挑选式视图。

你们能保证我们在ChatGPT或Google AI Overviews里被引用吗?

不能,对任何给出相反说法的机构都应保持怀疑。那些公司之外没有人能控制模型输出什么,而同一条提示词在不同次运行之间输出也会变。能够承诺的是工作与证据:提示词面板、基线、内容与实体层面的改动、重测排期,以及一份把两个方向的变化都呈现出来的报告。2024年ACM SIGKDD的同行评审研究发现,具名专家署名、带具名来源的数据以及行内引注,都可测量地提高了引用率。这是一个我们可以去推动的概率,不是任何人可以承诺的结果。

在双语市场里,建立引用需要多久?

比单语市场更久,原因是具体的,不是含糊的。需要建立的内容与实体地基是两套而不是一套;阿拉伯语一侧的技术修复往往必须先落地,内容工作才可能产出可测量的东西;而阿拉伯语的自然报道本质上就慢、就依赖人工。抵消这些的因素是真实存在的:按卡塔尔计算研究所的数据,阿拉伯语约占全网数据的0.5%,争夺同一个引用位置的高质量阿拉伯语材料因此少得多。我们先设定基线,然后报告相对基线的变化,而不是给出一个我们无法控制的时间表。

GEO与我们已有的SEO工作怎么配合?

两者共用地基,在结果上分道。可抓取性、站点结构、页面速度、干净的标记与真实的内容质量,对两者都有用。GEO额外带来的是一种不同的工作单元:被抽出后仍能自洽的段落、一个单元只承载一个论点、每个数字都有具名来源、标题写成问句、实体在两种语言里保持一致,以及来自你并不拥有的来源的旁证。如果我们面向卡塔尔的SEO服务已经在跑,GEO是叠加在它上面而不是取代它,提示词面板则成为两者共用的测量工具。
We use cookies

We use cookies to enhance your browsing experience, analyze traffic, and personalize content. See our Privacy Policy for details.

Cookie Settings
PT Arfadia Digital Indonesia

We use cookies to ensure the website runs optimally and to help us understand how you use our services. You can choose which categories to allow. Read our Privacy Policy.

Necessary Cookies Always Active

Required for basic website functionality. Cannot be disabled.

Analytics Cookies

Help us understand how visitors interact with the website. Data used anonymously.

Marketing Cookies

Used to display relevant ads and measure campaign effectiveness.

Functional Cookies

Enables live chat, social media integrations, and language preferences.

Preferences saved