Research Papers 论文研究

2d ago 2天前

Where Does Harness-Optimization Value Live? Localized Gains and the Budget-Splitting Trap in Self-Evolving LLM Agents Harness优化价值存在于何处?自演化LLM智能体中的局部收益与预算分配陷阱

HARNESSEVO decomposes agent harnesses into four evolvable slots (role, task-strategy, tool/format-rules, reflection/control) instead of optimizing as ... 提出HARNESSEVO框架,将LLM Agent的harness分解为角色、任务策略、工具/格式规则、反思/控制四个独立槽位进行演化 在ALFWorld(7B backbone)上发现优化价值几乎完全集中在reflection/control槽位(leave-one-in增益+0.119),其他三...

Hot 热度
65
Quality 质量
74
Impact 影响力
70
LLM 大模型 Agent Agent Research 科学研究 Alignment 对齐 Evaluation 评测
2d ago 2天前

Bounded Personas Match Retrieval on Classification but Not Regression for a Frozen Agent 有界人格在冻结智能体上的检索:分类匹配但回归不匹配

PersonaLink is a training-free method that distills a user's interaction history into a bounded three-field natural-language persona and recursively r... 提出PersonaLink,一种无需训练的递归蒸馏方法,将用户历史压缩为有界的三字段人格表示 在LaMP-2分类任务(200用户,15类新闻分类)上,PersonaLink准确率达0.745-0.755,与BM25检索(0.760-0.765)统计无显著差异 发现任务类型不对称性:蒸馏人格在分类任务...

Hot 热度
58
Quality 质量
72
Impact 影响力
65
Agent Agent LLM 大模型 RAG 检索增强生成 Research 科学研究 Evaluation 评测
2d ago 2天前

Counterexamples as Feedback for Agent Self-Correction 作为代理自我纠正反馈的反例

A-CEGIS is a lightweight framework that uses counterexamples as feedback to evaluate multi-turn self-correction in natural-language-to-regex synthesis... 提出A-CEGIS框架,利用反例作为反馈评估Agent多轮自我修正能力,聚焦自然语言到正则表达式的合成任务 在30个NL-RX-Turk任务上,诊断性反例反馈在4轮内解决90%任务,远超零样本生成(17%)、通用自修正(27%)和仅错误反馈(23%) 采用确定性oracle检查正则表达式,通过紧凑的...

Hot 热度
58
Quality 质量
72
Impact 影响力
68
Research 科学研究 Agent Agent Code Generation 代码生成 Evaluation 评测
2d ago 2天前

Probe Generalization as Subspace Selection for OOD Deception Detection 作为子空间选择的探针泛化用于OOD欺骗检测

Linear probes for detecting deception in LLM activations can generalize across domains by projecting inputs onto a curated subset of principal compone... 线性探针可检测语言模型激活中的欺骗行为,但跨分布泛化能力受限 将输入投影到训练激活分布的少量主成分(PCs)上,可实现跨域迁移,性能接近直接在测试分布训练的探针 使用LLM裁判对PC进行评分以筛选可迁移子集,在Insider Trading Report上缩小78%性能差距,在Sandbagging...

Hot 热度
62
Quality 质量
75
Impact 影响力
68
LLM 大模型 Security 安全 Research 科学研究 Evaluation 评测 Alignment 对齐
2d ago 2天前

R²Adapter: A Routing and Rewriting Adapter for Efficient Hybrid RAG R²Adapter:用于高效混合RAG的路由与重写适配器

R²Adapter is a lightweight, model-agnostic plug-in adapter that dynamically routes queries between vanilla RAG and graph-based RAG, reducing unnecessa... 提出R²Adapter,一个轻量级即插即用的路由与重写适配器,用于高效混合RAG系统 动态分配查询至vanilla RAG或基于图的RAG,仅对真正需要图推理的查询启用高成本检索 引入查询重写机制,对不确定的图路由查询进行改写以暴露多跳推理需求,无需额外监督 在三个多跳QA基准测试上,将基于图的RA...

Hot 热度
62
Quality 质量
72
Impact 影响力
62
RAG 检索增强生成 LLM 大模型 Research 科学研究 Inference 推理 Embedding Model 嵌入模型
2d ago 2天前

BharatGather: A Culturally-Informed Benchmark Dataset for Misinformation and Fake News Detection in Indian Public Events BharatGather:面向印度公共事件 misinformation 和假新闻检测的文化知情基准数据集

BharatGather is a culturally-informed benchmark dataset of 14,646 records designed for binary misinformation classification in the context of Indian m... 提出BharatGather数据集,专为印度大型公共活动(宗教节庆、政治集会、文化聚会)中的虚假信息检测设计。 数据集共14,646条记录,采用混合构建管道:事实核查平台爬取、多媒体转录提取及LLM合成增强。 填补了现有通用基准在印度社会文化语境与事件动态特征方面的空白。 为高风险公共环境下的文化感...

Hot 热度
58
Quality 质量
68
Impact 影响力
60
Dataset 数据集 Benchmark 基准测试 Research 科学研究 Evaluation 评测 LLM 大模型
2d ago 2天前

PiPMRE: A Pipeline Based on Language Model for Medical Relation Extraction PiPMRE:一种基于语言模型的医疗关系提取流水线

PiPMRE introduces a novel pipeline framework for Medical Relation Extraction (MRE) that reformulates the task from a linguistic perspective rather tha... 提出PiPMRE框架,基于语言模型解决医学关系提取(MRE)问题,突破传统序列标注方法的局限 采用"生成+过滤"两阶段架构:关系生成器产出多个三元组,关系过滤器评分筛选最终结果 无需复杂标注方案,通过简单模板重构输入文本,确保实体和关系按上下文顺序生成 在两个公开数据集上超越SOTA,平均提升5.6...

Hot 热度
58
Quality 质量
72
Impact 影响力
63
LLM 大模型 Healthcare AI 医疗AI Research 科学研究 Fine-tuning 微调 Dataset 数据集
2d ago 2天前

Margins, Not Windows: Training-Free Per-Step Lossy Speculative Decoding 边际而非窗口:训练免费的逐步骤有损推测解码

AdaptiveSpec introduces a training-free per-step speculative decoding method that dynamically adapts both token verification and draft tree structure ... 提出AdaptiveSpec,一种无需训练的每步自适应投机解码方法,同时动态调整验证规则和draft树形状 引入per-step margin规则:当目标模型对draft token的概率与top-1概率比值超过阈值时,接受不匹配的token,无需依赖draft长度或drafter架构 设计per-...

Hot 热度
65
Quality 质量
75
Impact 影响力
70
LLM 大模型 Inference 推理 Research 科学研究 Training 训练
2d ago 2天前

Distilled Rapid Embedding Transfer (DRET): Parameter-Efficient Biomedical Domain Adaptation via Priority-Based Embedding Transfer 蒸馏快速嵌入迁移(DRET):基于优先级的嵌入迁移实现参数高效生物医学领域自适应

DRET is a knowledge-transfer paradigm that injects biomedical domain knowledge from large specialized models (BioBERT, ClinicalBERT) into lightweight ... 提出DRET(蒸馏快速嵌入转移)方法,将大型生物医学领域模型的知识注入小型通用模型,无需重新训练原始专业语料 DRET采用迭代演进策略:从统一分词器合并(1.x)、混合嵌入平均(2.0)、优先级嵌入转移(3.x)到结合嵌入层冻结和差异学习率的完整方案(4.x) 在EBM-NLP语料库的PICO分类任...

Hot 热度
62
Quality 质量
72
Impact 影响力
60
Embedding Model 嵌入模型 Fine-tuning 微调 Research 科学研究 Healthcare AI 医疗AI Training 训练
2d ago 2天前

Contamination Inflates Scores but Rarely Reorders Large Language Model Leaderboards 数据污染会虚高分数但很少重新排序大型语言模型排行榜

Benchmark contamination (test data leaking into training) inflates absolute LLM scores but rarely changes model rankings on leaderboards The authors i... 论文区分了基准测试污染的两个独立问题:是否 inflate 绝对分数 vs 是否 reordering 模型排名,指出当前讨论常将二者混淆 提出基于锚定项目不变性的测量方法,通过对比原始题目与语义等价改写题目的差异功能来隔离记忆与能力 在47个公开模型和74个已知污染剂量的微调模型上验证,校正效应为...

Hot 热度
62
Quality 质量
72
Impact 影响力
65
LLM 大模型 Benchmark 基准测试 Evaluation 评测 Dataset 数据集 Research 科学研究
2d ago 2天前

Dual-Form ASR: Semantics-Aware Inverse Text Normalization for Chinese Speech Recognition 双形式ASR:语义感知中文语音识别逆文本规范化

Dual-Form ASR (DF-ASR) is a novel framework that unifies spoken-form ASR and semantics-aware written-form inverse text normalization (ITN) into a sing... 提出Dual-Form ASR(DF-ASR)框架,通过配对口语形式和书面形式监督实现语义感知的反向文本规范化(ITN) 解决传统级联ASR-ITN系统中规范化与声学上下文建模脱节的问题,尤其针对语义依赖型数值表达 引入LLM驱动的生成-判断工作流程构建双形式监督数据,并设计ITN-MWER序列级目...

Hot 热度
55
Quality 质量
72
Impact 影响力
62
Speech 语音 Research 科学研究 LLM 大模型 Fine-tuning 微调
2d ago 2天前

RL-ADA: A World-Feedback Framework for Adversarially Robust Enterprise Dialogue Agents RL-ADA:面向对抗性鲁棒企业对话代理的世界反馈框架

RL-ADA eliminates the human annotation bottleneck in enterprise dialogue agents by replacing labels with "world feedback"—consequence-based reward sig... RL-ADA框架通过"世界反馈"机制替代人工标注,解决企业对话代理训练中的数据瓶颈问题 采用3B参数客服代理与7B参数对抗客户代理的对抗性协同进化架构,在固定自动化裁判引导下实现双向优化 银行客服概念验证显示工具路由错误完全消除,严格端到端PASS率在五个协同进化周期内翻倍 发现"Contextua...

Hot 热度
62
Quality 质量
76
Impact 影响力
68
Agent Agent Conversational AI 对话系统 RL RL Security 安全 Research 科学研究