SchGen: PCB Schematic Generation with Semantic-Grounded Code Representations
提出SchGen模型,基于语义编码的PCB原理图生成,从自然语言请求到可编辑电路图,实现82%的有效电路率。
Qinpei Luo, Ruichun Ma, Xinyu Zhang 等
提出SchGen模型,基于语义编码的PCB原理图生成,从自然语言请求到可编辑电路图,实现82%的有效电路率。
Qinpei Luo, Ruichun Ma, Xinyu Zhang 等
提出VisAnomReasoner,通过微调大规模视觉-语言模型实现时间序列异常检测,Precision提升21.23%,F1提升23.87%。
Xiaona Zhou, Muntasir Wahed, Tianjiao Yu 等
通过语义通信和语义检查点的多智能体系统提升方法选择的适应性。
Geremy Loachamín-Suntaxi, Robert Lazar, Dimitrios G. Giovanis 等
通过多项式表示量化和优化简单性,提升图像和文本分类的泛化性能。
Tianren Zhang, Xiangxin Li, Minghao Xiao 等
LFQ方法通过在最终块最小化交叉熵提升低位量化LLM生成质量。
Jung Hyun Lee, June Yong Yang, Jungwook Choi 等
UI-KOBE通过应用特定的图知识指导轻量级GUI代理,提升任务成功率至77.6%。
Yuxiang Chai, Han Xiao, Xinyu Fu 等
DistractionIF揭示大型模型在干扰指令下的逆向缩放现象,GRPO提高鲁棒性15.5%。
Zeli Su, Zhankai Xu, Tianlei Chen 等
BenchTrace评估LLM自我反思和控制演化能力,基于1821个标注失败片段。
Jiahao Huang, Fei Cheng, Junfeng Jiang 等
提出CCO,通过集成多重监督信号,利用Conformal Decision Theory实现在线校准,确保AI系统行为符合预设安全目标。
William Overman, Mohsen Bayati
CubePart: 开放词汇、可控部件的3D生成器,支持语义结构生成。
Yiheng Zhu, Kangle Deng, Jean-Philippe Fauconnier 等
CORE算法通过对比反思在推理任务中实现快速改进,使用更少的样本和模型运行。
Linas Nasvytis, Simon Jerome Han, Ben Prystawski 等
LiveBrowseComp以335道近90天事实题揭示:搜索代理常在验证记忆,而非发现证据。
HuiMing Fan, Xiao Wang, Zheng Chu 等
Woodpecker Distillation利用弱模型诊断强模型推理中的局部错误,提升数学推理性能。
Dayu Wang, Jiaye Yang, Weikang Li 等
本研究通过难度分层分析RLVR,发现中等难度样本最能促进LLMs推理能力提升。
Yue Cheng, Jiajun Zhang, Xiaohui Gao 等
AIBuildAI-2利用层级知识系统实现自动建模,达70.7%奖牌率。
Ruiyi Zhang, Peijia Qin, Qi Cao 等
MUSE-Autoskill通过技能生命周期管理提升任务成功率,技能复用率达68.4%。
Huawei Lin, Peng Li, Jie Song 等
BRANE方法通过LLM提取查询特征,实现MuSiQue等数据集89%成本节省的动态检索配置优化。
Melissa Z. Pan, Negar Arabzadeh, Mathew Jacob 等
Anchor利用约束优化实现任务生成,解决工商业流程中的artifact drift问题。
Maksim Ivanov, Abhijay Rana
提出AgingBench,基于四种机制评估长寿智能体的可靠性与修复策略。
Jianing Zhu, Yeonju Ro, John Robertson 等
FEP-Diff通过自由能原理在部分可观测条件下实现认知合理的轨迹预测。
Yanping Wu, Ji Zhang, Hao Chen 等