最新发布
ZhuLong:从静态盲猜到真机沙盒执行,EDA脚本Pass@1提升至78.5%
针对这一工程痛点,长鑫存储(CXMT)与中国科学技术大学的研究团队提出了 ZhuLong(烛龙)。该系统取名自中国神话中“开目为昼”的神兽,旨在照亮原本晦涩不透明的商业 EDA API 生态。
AGI FRONTIER
深度解读 AI 论文,追踪 Agent、推理、多模态与具身智能的最新进展。
最新发布
针对这一工程痛点,长鑫存储(CXMT)与中国科学技术大学的研究团队提出了 ZhuLong(烛龙)。该系统取名自中国神话中“开目为昼”的神兽,旨在照亮原本晦涩不透明的商业 EDA API 生态。
PAPER INSIGHTS
为了打破这一僵局,研究者提出了 VeriTrace 框架,核心是赋予专职排错智能体(Inspector)完全自主的“时序探索能力”(Agentic Temporal Exploration)——它可以像资深验证工程师一...
近期由多位研究者提出的 UrbanAgent ,试图用统一的工具增强 Agent 框架攻克这一瓶颈。它不仅能够调度跨系统的异构城市服务,还引入了“行动前主动澄清、依赖驱动执行、多源证据对齐校验”的完整自适应闭环。
来自腾讯、厦门大学以及中俄数字经济研究中心的研究团队提出了名为 BinaryPC 的全新注意力方案。该方案放弃了“数据无关的随机投影”与“黑盒梯度训练”这两条旧路线,巧妙借助矩阵的二值主成分(Binary Princi...
来自北京航空航天大学的研究团队在最新论文中给出了破局思路,他们提出了名为 ToolLIFT 的通用工具规划框架。该研究的核心洞见在于:对于相似性质的复杂任务,即使底层调用的具体工具千差万别,它们在更高维度的“功能级工作...
为此,来自诺基亚(Nokia)与莱斯大学(Rice University)的研究团队提出了名为 SPECTRA 的全新免微调、即插即用 KV Cache 编解码方案。
Web:残酷的实验结果显示: 没有一种策略能够稳定地优于“无脑固定在最便宜模式”或“固定在综合表现最好的单一模式” 。哪怕在极少数配置下某项策略在数值上微弱跑赢固定基线,经过多重假设检验校正以及噪声带宽比对后,也均落入...
针对这种两难境地,来自北京航空航天大学、华为与香港科技大学的研究团队提出了 Robust-WAM 。这是一种面向基于视频生成的通用后训练(Post-training)方法,其核心思想并非推倒重建潜空间,而是在保留原有 ...
为了打破这一僵局,本文提出了一种全新的解决思路: 前瞻性多模态记忆预编译 (Prospective Multimodal Memory Compilation,简称 PMMC )。其核心理念是将原本在提问时才匆忙进行的...
香港科技大学(HKUST)的研究团队在最新论文中提出了 MCTS-Report 。该方法完全颠覆了预设的线性流水线,将表格生成多模态报告的过程重新形式化为结构化搜索空间中的树构建问题。
针对长视频理解中这种“固定设计难以应对多样化信息分布”的核心痛点,来自阿里巴巴、北京航空航天大学、字节跳动和浙江大学的研究团队提出了一套名为 MetaVideoAgent 的自动化演化框架。
针对这一洞察,作者提出了无需训练的“锚定消息核心集剪枝”方法(Grounded Message Coreset Pruning,简称 GMC )。该方法不再纠结于单个 Token 的孤立打分,而是将视觉压缩重构为解码器...
针对这两大结构性痼疾,本文提出了 MemSIF (Memory with Structured Interactions and Facts)框架。该方法抛弃了传统的单轨交互处理方式,将原始对话重塑为保留局部话题连续性...
LLMRouter:为了填补真实落地场景与评测之间的鸿沟,团队构建了包含 4,767 个测试样本的多场景基准 xRouteBench ,并设计了完全自动化的跨模型执行与打分流水线。
来自云知声、自然资源部、深信服、深圳理工大学和天津大学等机构的研究团队提出了 LiLa-WAM (Lightweight Latent Reasoning World-Action Model)。它打破了传统世界模型必...
JoyAI-Video-Edit 提出的 长时程自回归蒸馏(Long-Horizon Autoregressive Distillation, LHAD) ,巧妙地解决了长程稳定性与显存占用的矛盾。LHAD 采用了分段...
来自中国科学院、复旦大学、南京大学、香港中文大学与香港科技大学的研究团队在论文中提出了名为 HERALD 的离线反事实审计框架,在策略正式训练前对奖励函数进行精确的程序化单元测试。
HelloWorld:更为巧妙的是,这一能力并没有依赖昂贵的人工采集与精细标注,而是通过纯粹的 自蒸馏(Self-Distillation) 管线驱动:先用预训练视频生成模型自生成交互动作,再利用点云重渲染构建相机条件...
针对这一系列痛点,来自北京智源人工智能研究院、清华大学、中国人民大学、香港理工大学等机构的研究团队提出了 GraphThink 框架。该研究的核心洞察在于:不能把长程规划完全寄托于大模型的自由文本生成,而是应当在任务逻...
来自北京航空航天大学、高通公司与中关村实验室的研究团队针对这一痛点,提出了 Gated-BEPO (置信门控贝尔曼策略优化)。该方法在不依赖庞大且难以训练的额外 Critic 网络的前提下,巧妙利用同批次采样的多条交互...
针对这一痛点,最新研究提出了一种名为 EviSD (Evidence-Conditioned Self-Distillation,证据条件自蒸馏)的创新框架。该框架的精妙之处在于:它既不引入昂贵的外部判别模型(Crit...
EcoAgent-Bench 并非人工捏造成本玩具题,而是严格基于 GAIA、HotpotQA 和 MuSiQue 等真实数据集改造而来,总计构建了 304 个固化评测任务。每一个任务都不仅包含用户的原始指令,还内置了...