3d ago 3天前
Continuous Adversarial MeanFlow Transfer 连续对抗平均流迁移
MeanFlow-Transfer (MF-T) unifies domain adaptation and sampling acceleration by mapping heterogeneous pretrained model outputs (DiT/ε, SiT/v, JiT/x, i... 提出MeanFlow-Transfer (MF-T)框架,将异构预训练扩散/流模型(DiT/ε, SiT/v, JiT/x, iMF/u)统一映射到共享速度表示,实现适配与加速的联合优化
引入Continuous Adversarial MeanFlow (CAMF)后训练阶段,将对抗精炼从瞬时速度...
Image Generation 图像生成 Training 训练 Inference 推理 Research 科学研究
3d ago 3天前
A Two-Stage Time-Aware Transformer for Short-Horizon AECOPD Risk Prediction 用于短期AECOPD风险预测的两阶段时间感知Transformer
A two-stage transformer framework processes raw pressure and flow waveforms from home ventilators to predict both the risk and timing of acute COPD ex... 提出两阶段时间感知Transformer框架,直接处理家用呼吸机最近7天的原始压力与流量波形。
第一阶段分类模型用于识别重症AECOPD急性加重高风险患者,F1得分达0.91。
第二阶段回归模型预测距离急性加重事件发生的具体天数,RMSE为1.00天,R²为0.76。
突破传统方法依赖离散临床变量或...
Healthcare AI 医疗AI Research 科学研究 Transformer Transformer
3d ago 3天前
Towards On-Board Implementation of ML-Based Helicopter Weight Estimator 面向机载实现的基于机器学习的直升机重量估算器
A supervised ML model using an LSTM recurrent neural network was developed to estimate helicopter weight during takeoff from real-world Airbus fleet d... 提出基于空客全球在役机队大数据的直升机起飞重量机器学习估算模型,采用LSTM循环神经网络实现
建立符合EASA机器学习应用概念文件和Eurocae ED-324标准的机器学习保证流程
在传统航电计算机上验证实现,证明ML模型可部署于机载关键功能(如机载告警系统)
Research 科学研究 Deployment 部署 Training 训练 Dataset 数据集 Evaluation 评测
3d ago 3天前
Triangular Fuzzy Rescaling Distance 三角模糊重缩放距离
Proposes Triangular Fuzzy Rescaling Distance (d_TR), a novel metric that integrates Linear Rescaling directly into TFN distance calculations, eliminat... 提出三角模糊重缩放距离(d_TR),将线性重缩放直接集成到距离计算中,解决异构模糊数据尺度不一致问题
形式化证明d_TR满足度量公理(非负性、同一性、对称性、三角不等式),且具有有界性、尺度不变性和原点不变性
支持权重向量对维度进行优先级排序,适用于合成指标构建、基于距离的机器学习算法及多准则决策辅...
Research 科学研究 Evaluation 评测
3d ago 3天前
Holtercare-Bench: A Multimodal Benchmark for Evaluating Long-Term Dynamic ECG Analysis Holtercare-Bench:用于评估长期动态心电图分析的 multimodal 基准
Holtercare-Bench is a novel multimodal benchmark designed to evaluate long-term dynamic ECG analysis in medical MLLMs
Holtercare-23K dataset introduce... 提出Holtercare-23K数据集,包含22,980个QA对和788个临床Holter记录,实现信号-视频-文本三模态对齐
构建Holtercare-Bench基准,覆盖时间定位、临床诊断和全局摘要三类评估任务
零样本评估显示当前主流MLLM在处理超长病理ECG序列时存在显著性能差距
微调代表性...
Multimodal 多模态 Benchmark 基准测试 Dataset 数据集 Healthcare AI 医疗AI Evaluation 评测
3d ago 3天前
Quantum Kernel Estimation for the Discovery of Early Lung Cancer Detection 量子核估计用于早期肺癌检测的发现
Quantum-classical hybrid machine learning was evaluated for early lung cancer detection using cfDNA fragmentomics and DNA methylation data
Features we... 提出量子-经典混合机器学习框架,用于基于cfDNA的早期肺癌检测
使用角度和密集角度特征映射将DNA片段组学和甲基化特征编码到量子希尔伯特空间
在片段组学数据上,部分20特征配置的量子核模型AUC优于经典SVM基线
增加特征数量(20→40)并未一致提升性能,反而增加结果变异性
量子核方法在甲基化数...
Healthcare AI 医疗AI Research 科学研究
3d ago 3天前
Improved Confidence Estimates for Black-Box Large Language Models 改进黑盒大语言模型的置信度估计
Existing zero-shot uncertainty quantification (UQ) methods for LLMs can be significantly improved by leveraging evaluation datasets that practitioners... 提出了一种针对黑盒LLM的不确定性量化新方法,通过利用部署前评估数据集,一致性地超越现有零样本置信度分数
核心方案是构建简单分类器,以现有置信度分数和相似查询的正确性作为特征,预测LLM响应的正确性
该方法计算开销极小,为实际部署场景提供了低成本、易集成的不确定性增强方案
LLM 大模型 Evaluation 评测 Research 科学研究 Deployment 部署
3d ago 3天前
A Virtual Member of a Community of Practice for the Society of Petroleum Engineers: From Prototype to Deployment 石油工程师学会实践社区的虚拟成员:从原型到部署
ATHENA is a virtual assistant designed to support knowledge capture, retrieval, and dissemination for a Community of Practice in the Oil and Gas secto... ATHENA虚拟助手专为石油天然气行业实践社区设计,支持知识捕获、检索与传播
75名SPE专业人员的评估显示,ATHENA相比RAG基线系统显著提升任务生产力和绩效平等性
技术改进聚焦多文档检索、答案验证支持和主动知识传播三大方向
增强版ATHENA已在SPE研究门户完成集成并正式部署使用
Agent Agent RAG 检索增强生成 Deployment 部署 Research 科学研究 LLM 大模型
3d ago 3天前
Transformer Models for Text Summarization: A Comparative Study of BART, BERT, and RoBERTa Transformer模型在文本摘要中的应用:BART、BERT与RoBERTa的比较研究
The paper presents a comparative review of BERT, RoBERTa, and BART for automatic text summarization, examining their architectural differences and pre... 本文对 BERT、RoBERTa 和 BART 在自动文本摘要中的应用进行了比较综述,分析了它们的架构差异和预训练策略。
由于采用掩码语言建模目标,BERT 和 RoBERTa 主要适用于抽取式摘要;而 BART 的去噪自编码器架构使其天然适合生成式摘要。
该研究按输入类型(单文档与多文档)和输出类...
Research 科学研究 LLM 大模型 Fine-tuning 微调 Benchmark 基准测试 Evaluation 评测
3d ago 3天前
Automatic bioinformatic software named entity recognition from literature 从文献中自动识别生物信息学软件命名实体
SNAIL is a hybrid named entity recognition framework that automatically identifies bioinformatics software and database (SW/DB) names from biomedical ... 提出SNAIL框架,用于从生物医学文献中自动识别生物信息学软件与数据库名称
采用词法+语义混合建模策略,结合SciBERT上下文嵌入与显式token掩码增强实体表征
通过引用提示提取与大模型辅助蒸馏的混合管道自动构建大规模训练语料
在两个独立基准数据集和真实文献上显著优于bioNerDS2及Chat...
Research 科学研究 LLM 大模型 Dataset 数据集 Embedding Model 嵌入模型
3d ago 3天前
Asymmetric Attention Heads: Structured Head-Wise Context Allocation for Transformer Attention 非对称注意力头:Transformer注意力的结构化头级上下文分配
Asymmetric Attention Heads (AAH) introduces a head-wise context-allocation framework that treats context length as an explicit per-head or per-group v... 提出AAH(Asymmetric Attention Heads)框架,将上下文长度作为每头/每组的显式分配变量,打破标准MHA全局均匀分配模式
通过特征派生统计对注意力头进行层次化分组,为不同组分配因果局部窗口,同时保持标准扁平MHA输出接口
在4096-token seed-0实验中,多种AAH...
Research 科学研究 LLM 大模型 Training 训练 Inference 推理
3d ago 3天前
Hallucination as a Feature, not a Defect: Evaluating a multi-agent architecture to transform speculative language-model outputs into testable scientific hypotheses 幻觉作为特性而非缺陷:评估多智能体架构将语言模型的推测性输出转化为可检验的科学假设
Proposes a Rust-based multi-agent orchestration that reframes LLM hallucinations as a creative resource for scientific hypothesis generation rather th... 提出将LLM"幻觉"转化为可测试科学假设的多智能体架构,挑战当前抑制幻觉的主流对齐范式
系统通过高熵生成智能体与基于网络的评估智能体之间的"认识论摩擦"循环实现推测性生成
消融实验表明直接提示表现最弱,但完整系统并非普遍优于简单自我反思,各架构在不同约束条件下各有优势
推测性生成的价值不源于幻觉本身...
LLM 大模型 Agent Agent Research 科学研究 Evaluation 评测 Alignment 对齐