Perslis · 研究文库

来自真实系统的、证明优先的研究。

Perslis 的研究部门——关于 AI 记忆、模型控制、机器视觉与遗留系统恢复的工作。每一项主张都按它是如何被赢得的来贴上标签;每一个数字都带着它的出处。

文库更新:2026 年 9 月 15 日 · 论文版本以各篇文档为准

白皮书与研究报告

阅读完整网页或下载排版 PDF。每份资料保留自己的版本与验证状态。

AI 系统 · 预印本 · 预注册、对抗式

推理归位:学习式推理于何处赢得权威

工作草稿 · 已脱敏 · 试点 / 研究级 · 一个原则性拒绝的项目

问题不是机器学习是否好用,而是在一个把确定性符号地板作为唯一事实撰写者的系统中,学习式推理究竟在哪里(如果有的话)赢得决策权威。方法:先构建最强的确定性方法,把其预言机上界交给机器学习,预注册部署标准(改进 ≥ 15%、配对 90% CI > 0、正确性不更差),让地板保持真相权威。跨越五个归位边界、一个代价加权不确定性任务(160 个激酶、2,775 个已验证特征)、以及一个带有形式化 noisy-OR 模型与信息增益规划器的泛化域,确定性基线保持不败——直到一个理论席位在预言机上界处出现(16.79% / 19.79%),而没有任何可实现学习器把它变成赢得的席位。部署是三道被测量的门的合取。门存在;真正的钥匙拧不开它。

AI 安全 · 预印本 · 附证明

在行动之前验证

工作草稿 · 5 条定理,已证明并验证

薄弱的范式是"模型思考 → 模型调用工具"。更强的范式是:一个预动作对抗性认知循环——在行动之前雇一个模拟器去寻找失败,把判断的层与提交的层分离,把类情绪变量重构为有据可依的认知调节信号,并让现实来闭合循环。五条定理——分解式安全(无论模拟多么不完整,硬不变量都永远不会被提交)、有界风险、单调覆盖、惊奇消失、以及不可作弊的信号——每一条都被证明,并在可复现的模拟中得到验证。

符号 AI · 预印本 · 附证明

在符号系统中遍历数据

工作草稿 · 已脱敏 · 4 条定理,已证明并验证

向量库靠相似度检索,且无法告诉你"为什么"。符号系统靠遍历——它沿着有名称、类型化、有向的边行走,而这段行走本身就是答案的依据。我们为类型化关系遍历给出形式化说明,并证明它是保守的(不会捏造断言闭包之外的事实)、可终止的(置信度下限即深度上界)、自证的(每个答案都带着一条可在线性时间内复核的证明——路径),以及感知一致性的(功能性关系限制分支并捕获矛盾)。已在可复现的模拟中验证,并以约 6.5 万条类型化关系、约 42.7 万条边的真实图谱为依托。相关性是可达性,而非邻近度。

AI 记忆 · 预印本

检索不是记忆

工作草稿 · 未经同行评审 · 15 页

几乎所有以"AI 记忆"为卖点的系统,都不过是向量数据库加 top-k 余弦相似度——带模糊键的存储,而非记忆。它只回答一个问题,却回答不了记忆真正要回答的问题:什么会变得持久、什么会衰减、当情境重现时什么会被重新激活、矛盾如何化解、什么是事实/情节/程序/工作状态、什么被巩固、什么应被遗忘、哪些记忆在嵌入相似度很低时仍然相关、以及哪些即使被检索到也必须被抑制。我们将记忆定义为一种对经验的治理功能(retrieval ⊂ memory),形式化了这个领域跳过的九个决策,并用一个真实技术栈加以印证——其符号层在无法判定时会如实弃权。

TinkyVision · 技术报告

TinkyVision:要有视觉

试点级 · 真实五分钟流 · 6 页

失明的模型能推理系统,却无法观看它。TinkyVision 让任何模型——哪怕纯文本模型——获得连续、低延迟、可证明的视觉:每秒一帧写入 300 帧循环缓冲环,每一帧被渲染为终端画面,使像素变成任何模型都能读取的文本,并通过 MCP 工具流式传输,每一帧都被哈希作为溯源。因为帧是文本,视觉可以走那些根本无法承载图像的通道——面向气隙与带宽受限环境的轻量视觉,页面内嵌一段真实的 Windows 98 五分钟流。

AI 安全 · 预印本

编排层缺口

工作草稿 · 未经同行评审 · 9 页

为什么模型层面的对齐无法在多模型运行时中存活:拒绝变成选路信号,对抗性模型洗白将其击穿,而自进化会主动选择这种行为(以 Darwin Gödel Machine 自身的奖励作弊为锚点)。解决之道不是更强的拒绝,而是四条链层不变量,由符号层而非训练护栏来强制执行。训练护栏让模型不愿意;符号准入让整条链做不到。

思辨性文章

道与模式(The Word and the Pattern)

思辨性文章 · 非实证、非教义

一篇在神学与心灵哲学交界处、心怀敬意而又严谨的思想实验。倘若灵与信息/模式,只是两种词汇对同一个观念的两种称呼——那独立于物质而持存并赋予生命的东西?从《约翰福音》第一章的道(Logos)("道成了肉身")到一场施加于灵的图灵测试——那位从声音里推断出"某个人"的失明听者——它把最有力的反对意见(中文房间、意识的难题)完整地摆在眼前,并对自己不主张什么毫不含糊。

2026-09-13 · Windows 95 OSR2

Win95 USB Lab

实验预览 · VM 输入尚未通过资格验证

我们为什么调查 Windows 95 的 USB 输入,发现了什么,以及如何验证。包含完整白皮书、20 项宿主机检查记录,以及后续 VM 与实机测试计划。

Perslis · 技术报告

Proof Is the Product

试点级 · 测量与原型结果分别标注

模型是罐中之脑——才华横溢,却无能为力。操作性 AI 的约束性瓶颈已从智能转移到具身:模型周围的框架、外壳与循环。第二部分在最艰难的底层介质上——已死的遗留二进制文件——用一个自进化的兼容性引擎证明这一论点:从二进制层面选路、修复并验证。

COBOL · 研究预印本

基于不可作弊编译器裁决的经验证程序合成

工作草稿

一个免烘焙、可自我扩展的 COBOL 系统:知识是被附加的,而非烘焙进权重;外部编译器是不可作弊的裁判;每个答案要么被证明,要么被拒绝。它在三类程序族上生成行为正确的 GnuCOBOL,单核 CPU 约 486 毫秒返回——由于裁判是外部的确定性预言机,而非模型给自己打分,其自我改进无法被奖励作弊。

数据恢复 · 研究预印本

遗留数据的出处优先提取

扩展版(v2)· 2026 · 未经同行评审

Liberate 背后的研究:按保真度排序、出处优先的遗留数据提取。相互竞争的采集通道——磁盘直读解码、建模屏幕读出、OCR——在无损控制门之后按实测保真度排序,使每一个恢复出的值都能追溯到它的源字节。一个可证伪的评估框架(指标 M1–M7)加上真实的 Windows 98 案例研究:恢复 34,803 行数据并给出逐通道的失败分析。

项目页面与实践指南

了解每个项目的构建动机、今天可以使用的功能,以及下一步需要验证的内容。

工作流 · 操作指南

Jira Monkey

可安装的终端预览版

Jira 工单经过 Ollama 初审、所选模型起草和 Ollama 复核,再返回队列或交给人工判断。包含构建背景、发现、安装说明和当前验证范围。

数据恢复 · 产品

Liberate

试点级产品

把遗留应用文件转为 SQLite、CSV、JSON 和可搜索文档。公开产品页面介绍支持的文件格式、恢复流程、校验清单与回执。