#auditability

共收录 5 条相关安全情报。

← 返回所有主题
推荐 8.5
Conf: 50%
👥 作者: Enzo Fenoglio, Philip Treleaven

该论文针对跨组织联邦学习(cross-silo FL)中跨边界会话操作准入的审计难题,提出了一种可审计的会话准入网关(Session Admission Gateway)。当前常见的准入方式依赖中心化策略服务、平台配置或临时检查,这些方式随着时间推移容易产生偏差,且难以从边界可见的证据中进行审计。作者设计的网关在组织边界强制执行预批准的会话能力,并生成可验证的决策记录。具体而言,在会话建立阶段,参与组织批准角色和约束条件,并签发签名的会话能力令牌(session capability token),该令牌枚举了针对给定 session_id 允许的会话操作。运行时,每个请求携带令牌和基于请求的持有证明(proof-of-possession),网关通过请求绑定检测令牌重放和身份冒充。准入简化为网关上的无状态逐请求密码学验证和能力匹配,而会话建立和编排超出范围,由各组织自行处理。作者以 MNIST 作为替代负载,在跨组织 FL 工作流上进行了端到端验证,概念验证代码开源、容器化、支持基础设施即代码,并包含可复现的测试和证据日志。

💡 推荐理由: 该研究为跨组织联邦学习中的细粒度、可审计访问控制提供了密码学方案,解决了实际部署中策略漂移和审计证据不足的核心痛点。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Saviz Changizi, Nasibeh Mohammadzadeh, Mohammad Shojafar, Rahim Tafazolli

该论文研究将电信/IoT欺诈控制重新定义为区块链链接的可审计决策管理问题。传统欺诈控制研究通常止步于检测器级别的分类,而实际部署需要请求级别的策略决策、生命周期可追溯性和可审计性。论文提出一个框架,将每个合成部署记录映射为受管理请求,通过确定性硬欺诈门控阻塞显式越界情况,然后使用集中式机器学习(M1)、联邦元学习(M2)或LLM家族风险源(M3)对非硬欺诈请求进行评分,并通过共享五状态策略、两区优化机制和本地以太坊兼容审计层解析行动。实验使用独立的合成训练数据和10万条部署重放语料库,结果显示:在验证集上,M1在合法请求假阳性率(FPR)0.0890(操作上限0.10)和软欺诈召回率0.8341下表现最佳;但在标记部署重放中,合法FPR差距扩大:M1升至0.1646,M3-QLoRA升至0.1801,而M3-QLoRA将M3-Base的合法FPR从0.3915降至0.1801,软欺诈召回率达0.8240。区块链遥测表明,生命周期gas、成本、延迟和吞吐量差异由提交的链下决策配置文件驱动,而非欺诈逻辑变化。主要贡献是展示了QLoRA微调LLM分支比零样本提示更可用,但主要接近而非超越低成本的集中式集成。适合研究可审计欺诈决策管理和区块链集成安全的研究人员阅读。

💡 推荐理由: 该研究首次将区块链可审计性与LLM决策管理结合应用于电信/IoT欺诈控制,提供了请求级别策略解析和全生命周期可追溯性的实用框架,对需要合规审计的欺诈检测系统设计具有参考价值。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Ravi Kiran Kadaboina

该论文提出了Pramana,一个用于自治代理网络中的声明验证的协议层解决方案。在受监管领域中,自主代理对每个关键输出必须产生一个可审计的验证工件,记录声明内容、来源、执行者、时间和方式。当前的生产验证分为两个未标准化的方向:概率性判决模式(如自一致性投票、评审LLM集成)产生判断而非工件;而工件产生模式(如RAG、工具增强轨迹、生成器-验证器循环)产生特定于供应商的记录,外部审计员无法在不进行定制集成的情况下重构。Pramana定义了缺失的线路格式:每个关键代理输出被封装在一个类型化的ClaimAttestation中,包含四种变体(测量、推理、类比、引用),每种都配有针对记录源的verify()操作。对于测量声明和引用声明,verify()是确定性的;对于推理声明和类比声明,确定性则取决于预言机(在LLM支持下可审计重放)。这种四类分类源于古典印度认识论(pramana,有效知识的来源)。生命周期在TLA+中指定,并通过TLC在三个对称缩减模型上进行了全面验证:总共38,563个不同的可达状态,零个不变性违反。Python参考实现通过了84个测试。一个A2A和MCP的线扩展清单层叠了三个部署级不变性:可达性、SLA边界和离线可重新验证。一个探索性试点(n=100,2,275次评审调用)探讨了LLM作为代码生成中的评判者。最显著的观察是跨越语料库的40个百分点的原始FPR差异,与参考解决方案质量显著一致。该试点本身并不验证Pramana;结构论证和形式验证做到了这一点。

💡 推荐理由: 该工作为自治代理的可审计性提供了形式化协议层设计,填补了声明验证标准化的空白,对监管合规和信任建立具有重要价值。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Kemal Bicakci

这篇论文针对公共机构在资助评审中引入大语言模型(LLM)作为决策辅助工具时面临的治理难题:模型和评分标准不能暴露给申请人以防他们针对优化,但评审过程必须可审计、可质疑且可问责。作者提出了一种基于可信执行环境(TEE)的架构,通过远程证明技术协调上述矛盾。该架构允许外部验证者检查使用的模型、评分规则、提示模板和输入表示,同时不向申请人或基础设施操作者暴露模型权重、专有评分逻辑或中间推理过程。核心成果是“经证明的评审包(attested evaluation bundle)”:一个包含签名和时间戳的记录,关联原始提交哈希、规范化输入哈希、模型与评分规则度量以及评审输出。论文还考虑了场景特定的提示注入风险:申请人控制的文档可能包含隐藏指令影响LLM评估。为此,论文设计了规范化和净化层,用于标准化文档表示并在推理前记录可疑变换。作者将设计置于机密AI推理、可证明AI审计、零知识机器学习、算法问责制和AI辅助同行评议的背景下进行定位。论文的声明刻意狭窄:远程证明不能证明评审是公平或科学正确的,但可以使评审过程的部分环节变得外部可验证。

💡 推荐理由: 该论文直面AI辅助决策中的透明度与保密性矛盾,提出实用架构,对政府、基金机构部署可审计的LLM系统具有重要参考价值。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)

提出Sovereign Agentic Loops (SAL)架构,通过控制平面解耦LLM推理与执行,验证模型意图后再执行,防止不安全API调用。

💡 推荐理由: 当前LLM代理直接执行随机模型输出存在安全风险,SAL提供结构化的策略执行和审计机制,可显著降低误操作和恶意利用风险。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)