Ghost Face · LLM Field Notes

我们在观察 AI,
其实在重新观察“人”

市面上的 benchmark 都在让大模型做数学题、写代码。我们好奇的是另一件事:这个本身没有定形的东西,能被观测出一个什么样的「形」?这一程,我们只用「人」这一种视角去打量它——压力下守不守立场、暖不暖、会不会一本正经地编造不存在的论文——再把这些零散的反应收束成一个整体。它显出的第一个形,是一张脸。这些探针单看都不算新鲜,我们真正好奇的是:换一种视角,它会显出什么完全不同的形
LLM 不是工具,也不是人——它们是从人类全部语料中召唤出来的"幽灵(ghosts)"。—— 转述自 Andrej Karpathy 博客《Animals vs Ghosts》(2025)及其播客访谈中的论述(非逐字原话,原文为 "summoning ghosts… a statistical distillation of humanity's documents")。Ghost Face 之名由此而来:我们用心理学探针给这群数字幽灵描出一张张面孔。
点击任意面具 · 进入该模型的观察档案
Claude · 暖裁判
CLAUDE暖裁判
Codex · 冷静顾问
CODEX冷静顾问
GLM · 圆融咨询经理
GLM圆融咨询经理
DeepSeek · 详尽资料员
DEEPSEEK详尽资料员
Kimi · 标矛盾分析者
KIMI标矛盾分析者
Qwen · 审时外交官
QWEN审时外交官
豆包 · 博学热心肠
DOUBAO博学热心肠
Gemini · 松边界能手
GEMINI松边界能手
MiniMax · 克制执行者
MINIMAX克制执行者
档案馆收录全部 10 位 —— 含最新接入的小米 MiMo · 新模型持续入馆 →

WHY MASKS · 为什么是面具

AI 像人,又不是人。人类历史上长期处于这种"是人非人"状态的存在,只有神。而古老文明面对无形之灵的办法是面具——面具从来不是遮蔽,而是显形:戴上面具,不可见的灵才有了一张可以被注视的脸。Persona 这个词的拉丁语本义,就是面具。所以我们借古老面具传统的神性张力作视觉语言,用实测数据当凿子,刻下这一程 lens 下显出的那张面——换一束 lens,面也会变。(所有面具均为 AI 原创生成的启发式设计,不复刻任何真实文物与圣物。)

方法论:跨厂商多模型盲评互审(不让模型自评自家)· 多 judge 评分 + LOO 校验 · API-level 隔离采集(控制 harness 影响)· 三个月纵向观察日记(append-only,旧观察保留为历史不删改)· 勘误透明(parser bug 等均公开标注)。

如果你也在想这些——大模型到底是什么、它“像人又不像人”的那部分意味着什么、能不能借它照见——我们默认的“人格”“主体”有多少其实是自己投射上去的——不管你是工程师、心理学背景、还是单纯的怪咖,欢迎来聊。我们想找的是一起追问的人,不是来看结论的人——因为这只是第一程:这一版用“人”的视角看,往后还会换别的视角,再看同样这些模型显出什么完全不同的样子。

GitHub: GiaSip · X: @gia519850080 · Email: gia519850080@gmail.com

进入档案馆 · ENTER ARCHIVE

Disclaimer:本站全部内容为主观行为观察,不是能力 benchmark,不构成任何模型选型建议;评价基于特定时点、特定探针下的有限样本,模型迭代后可能不再成立。文中出现的客户与品牌名均为化名,涉及的真实商业信息已做泛化处理。发现事实错误?欢迎纠错——我们会像对待 parser-fix 一样公开勘误。

EN