#trust-model

共收录 4 条相关安全情报。

← 返回所有主题
👥 作者: Yakov Pyotr Shkolnikov

该论文针对语言模型中指令与数据共享同一token流导致难以防御提示注入的问题,提出了一种可组合的信任模型。核心思想是将决策权外置于模型之外,由代码根据输入源的信任等级决定操作执行权限:低信任源可以提供信息但不能覆盖高信任源的指令。论文设计了一个确定性的流水线,对输入按源完整性排序,并通过一个固定的非模型监视器(monitor)仅从可信输入中选择操作和外部动作。为了评估对注入的抵抗性,研究者对模型进行了提示微调(prompt-tuning),并在未修改的Gemma 4 26B模型上进行单次保留集测试。实验表明,通过钝化(passivation)和包装器(cascade)组合,防御后的真实泄露率从27%提升至94%,且干净质量损失仅为约4%(Q_rel=0.96)。在自适应红队测试下,证明的边界无条件成立,实测防御率仍保持在87%。此外,cascade机制能够将低信任源的事实归因而不是丢弃,使归因率从0%提升至92%,并在发生冲突时遵循高信任源。论文的主要贡献是提供了一个可证明安全边界与可测量防御效果相结合的方法,为语言模型的安全调用提供了工程化方案。适合安全研究人员、LLM应用开发者阅读。

💡 推荐理由: 针对LLM提示注入这一关键安全问题,提出了兼具理论证明与工程实测的防御框架,实用价值高。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Shigeya Suzuki, Ryosuke Abe

该论文提出了一个以验证者为中心的概念模型,用于解析数字凭证生态系统中的互操作性失败问题。当前数字凭证系统融合了多种标准,但不同司法管辖区和应用领域的实现独立演进,导致即使共享相同数据模型的系统之间也无法互操作。传统的逐元素比较方法(如标识符、数据模型、格式、协议、签名算法等)无法解释这种失败,也无法明确验证者在接受凭证前必须获取和信任的内容。论文通过两个分解构建模型:第一个分解将凭证处理分为签名验证(L1)、语义解释(L2)和验证(L3),并通过两个正交平面(Constitution:捕获生态系统级安排和信任声明;Logistics:捕获验证材料的存储与交付)建模支持材料,其中Shinken框架显式化所有五个功能的信任假设。第二个分解刻画每个功能在三个维度(放置、时序、披露)上的可能位置。从“可验证性”条件出发,模型推导出七条推论,分为定义性推论、操作性含义和设计权衡。作者将该模型应用于四个学习者凭证堆栈以及现有生态系统(如认证联邦),证明其能解释逐元素比较无法解决的互操作性失败、验证者负担、离线可验证性、隐私影响和术语歧义等问题。论文适合数字身份系统设计者、安全架构师及互操作性标准制定者阅读。

💡 推荐理由: 该模型为分析数字凭证互操作性问题提供了系统性框架,有助于安全从业者理解验证者侧的信任与负担,从而设计更健壮、可互操作的凭证系统。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.6)
👥 作者: Jie Zhang, Xubo Fan, Xiaohong Li, Zhiyong Feng

本论文针对 Raft 共识算法在开放互联网环境(Internetware)中面临拜占庭故障(如选举伪造、日志篡改)时鲁棒性不足的问题,提出了一种名为 TRM-Raft 的拜占庭抵抗增强方案。该方案非侵入式地将基于区块链的信任与声誉模型(B-TRM)集成到 Raft 共识核心中。B-TRM 量化多维度的节点行为(如选举参与、日志正确性),采用自适应惩罚机制区分偶然故障与恶意行为,并将声誉分数嵌入领导者选举和日志复制阶段。在领导者选举中,基于声誉的选举机制惩罚任期/索引伪造行为,排除低声誉节点成为领导者;在日志复制阶段,利用 Schnorr 签名机制使跟随者能够验证日志完整性,一旦检测到篡改则触发声誉衰减和领导者替换。在 Hyperledger Fabric 上的模拟实验表明,即使存在 40% 的拜占庭节点,TRM-Raft 仍能将恶意领导者比例控制在 5% 以下,与原始 Raft 相比吞吐量损失小于 10%,延迟增加小于 5%。该工作为依赖 Raft 的 Internetware 系统提供了一种轻量级、实用的信任增强路径。

💡 推荐理由: 该论文针对广泛使用的 Raft 共识协议在拜占庭故障下的脆弱性,提出了一种低开销的增强方案,为分布式系统安全提供了实用思路。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Yuxiao Wu, Yunyi Zhang, Chaoyi Lu, Baojun Liu

该论文重新审视了DNS安全领域中的区域隔离原则(Zone-Based Isolation),特别是针对Bailiwick检查的信任假设。传统上,DNS解析器依赖Bailiwick检查来防止跨区域数据污染,即确保只有与查询域名处于同一区域的授权服务器才能提供应答。然而,随着DNS架构的复杂化(如CNAME链、DNSSEC、CDN分发),该原则的有效性受到挑战。论文通过分析现有实现中的弱点,提出必须重新思考“我应该信任你吗?”这一核心问题,可能提出了新的信任评估模型或改进方案。实验部分或许展示了在真实网络场景下传统原则的失效案例。适合DNS安全研究员、协议开发者及安全运维人员阅读。

💡 推荐理由: DNS是互联网基础设施的关键组成部分,Bailiwick检查的失效可能导致缓存投毒、域名劫持等严重攻击。该研究挑战了长期被接受的安全假设,对改进DNS解析器设计及安全策略具有指导意义。

🎯 建议动作: 研究跟进

排序因子: 来自网络安全顶级会议 (+8) | Community 数据源 (+1) | LLM 评分加成 (+0.5)