arXiv最新AI论文速览速学

🔍

搜索范围：

全部标题和内容仅标签

🏷️ 所有标签

24小时内新更新论文 24h更新 50 72小时内新更新论文 72h更新 167 最新: MovieTeller: Tool-augmented Movie Synopsis with ID Consistent Progressive Abstraction 02-27

arXiv ID: 2602.05648

arXiv 提交日期: 2026-02-05

natural language processing llm model evaluation tokenization morphology transformer models multilingual paradigm learning

动词形态范式建模：土耳其语和希伯来语分词案例研究 / Modelling the Morphology of Verbal Paradigms: A Case Study in the Tokenization of Turkish and Hebrew

1️⃣ 一句话总结

这篇论文研究发现，Transformer模型处理土耳其语和希伯来语复杂动词形态的能力，高度依赖于分词策略是否与语言本身的形态结构（如土耳其语的黏着性、希伯来语的非连接性）相匹配。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.06079

arXiv 提交日期: 2026-02-04

systems model training machine learning distributed optimization parallel training load balancing asynchronous computation large language models

Canzona：一个统一、异步且负载均衡的分布式矩阵优化器框架 / Canzona: A Unified, Asynchronous, and Load-Balanced Framework for Distributed Matrix-based Optimizers

1️⃣ 一句话总结

这篇论文提出了一个名为Canzona的新框架，它通过巧妙地将优化器的逻辑计算与参数的实际物理分布解耦，并采用异步和负载均衡技术，成功解决了在大规模分布式训练中高效矩阵优化器与现有并行架构不兼容的难题，从而显著提升了训练速度。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04355

arXiv 提交日期: 2026-02-04

llm multi-modal model evaluation vision-language models working memory n-back task spatial reasoning multimodal evaluation

视觉能替代文本在工作记忆中发挥作用吗？来自视觉语言模型空间n-back任务的证据 / Can Vision Replace Text in Working Memory? Evidence from Spatial n-Back in Vision-Language Models

1️⃣ 一句话总结

这篇论文通过一个空间记忆测试发现，视觉语言模型在处理文本信息时的工作记忆表现比处理视觉图像时更准确可靠，揭示了模型在多模态工作记忆中存在计算差异。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04931

arXiv 提交日期: 2026-02-04

llm theory model evaluation representational geometry mechanistic interpretability prediction formation transformer dynamics causal abstraction

大语言模型中预测中心几何结构的深度涌现 / Depth-Wise Emergence of Prediction-Centric Geometry in Large Language Models

1️⃣ 一句话总结

这篇论文发现，大语言模型在处理信息时，其内部表征的几何结构会随着网络层数加深而发生转变，从处理上下文信息逐步演变为形成预测，其中角度关系决定了预测的相似性，而向量长度则编码了与预测无关的上下文细节。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04577

arXiv 提交日期: 2026-02-04

llm model evaluation natural language processing uncertainty quantification semantic distillation hallucination detection model calibration knowledge distillation

用于语言模型不确定性量化的语义自蒸馏 / Semantic Self-Distillation for Language Model Uncertainty

1️⃣ 一句话总结

这篇论文提出了一种名为‘语义自蒸馏’的方法，通过训练一个轻量级的学生模型来快速预测大语言模型输出答案的语义分布，从而高效地估计模型的不确定性，用于检测模型可能产生的幻觉或不可靠回答。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04986

arXiv 提交日期: 2026-02-04

theory ai model evaluation philosophy of ai intelligence theory nonlinear models adversarial testing general intelligence

人工智能作为陌生智能：反对智能的线性模型 / Artificial Intelligence as Strange Intelligence: Against Linear Models of Intelligence

1️⃣ 一句话总结

这篇论文认为人工智能的智能是一种‘陌生智能’，它不像人类智能那样均衡发展，而是在某些领域表现出超能力，在其他领域却表现拙劣，因此不能用单一的线性标准（如智商测试）来评估其综合智能水平。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.05037

arXiv 提交日期: 2026-02-04

computer vision model training systems multi-object tracking graph representation learning differentiable learning loss function motion continuity

UniTrack：用于多目标跟踪的可微分图表示学习 / UniTrack: Differentiable Graph Representation Learning for Multi-Object Tracking

1️⃣ 一句话总结

这篇论文提出了一种名为UniTrack的即插即用图论损失函数，它通过可微分学习直接优化跟踪目标，能无缝提升现有多种多目标跟踪系统的性能，显著减少目标身份切换并提高跟踪准确性。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04809

arXiv 提交日期: 2026-02-04

reinforcement learning systems agents cyber defence reward shaping policy evaluation sparse rewards autonomous agents

超越奖励：强化学习在网络安全防御中的应用 / Beyond Rewards in Reinforcement Learning for Cyber Defence

1️⃣ 一句话总结

这篇论文通过系统研究发现，在训练网络安全AI防御系统时，使用简单明确的目标奖励（稀疏奖励）比复杂精细设计的综合奖励（密集奖励）更能训练出可靠、高效且风险更低的防御策略。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04244

arXiv 提交日期: 2026-02-04

machine learning model training systems graph foundation model graph representation learning contrastive learning graph neural networks generalization bound

训练一个基础模型将图表示为向量 / Training A Foundation Model to Represent Graphs as Vectors

1️⃣ 一句话总结

这篇论文提出了一种新的图基础模型，它能够将任何图结构有效地压缩成一个向量表示，这个向量不仅保留了图的结构和语义信息，还能很好地泛化到新领域，从而在少样本图分类和图聚类任务上超越了现有方法。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv ID: 2602.04170

arXiv 提交日期: 2026-02-04

computer vision model training systems state space models scan order rotation robustness vision transformers efficient architecture

部分环形扫描：重新审视视觉状态空间模型中的扫描顺序 / Partial Ring Scan: Revisiting Scan Order in Vision State Space Models

1️⃣ 一句话总结

本文提出了一种名为PRISMamba的新方法，通过将图像分割成同心圆环并采用顺序无关的聚合方式来处理视觉数据，不仅提升了模型在图像识别任务上的准确率和速度，还显著增强了模型对图像旋转等几何变换的鲁棒性。

👋 没兴趣 ☆ 感兴趣

📌 待读 PDF

arXiv最新AI论文速览速学

菜单

arXiv ID: 2602.05648

1️⃣ 一句话总结

arXiv ID: 2602.06079

1️⃣ 一句话总结

arXiv ID: 2602.04355

1️⃣ 一句话总结

arXiv ID: 2602.04931

1️⃣ 一句话总结

arXiv ID: 2602.04577

1️⃣ 一句话总结

arXiv ID: 2602.04986

1️⃣ 一句话总结

arXiv ID: 2602.05037

1️⃣ 一句话总结

arXiv ID: 2602.04809

1️⃣ 一句话总结

arXiv ID: 2602.04244

1️⃣ 一句话总结

arXiv ID: 2602.04170

1️⃣ 一句话总结

📄 提交新论文

提交新论文

密码管理

设置密码

修改密码

移除密码

菜单

热门趋势

arXiv ID: 2602.05648 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.06079 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04355 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04931 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04577 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04986 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.05037 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04809 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04244 👀 Abstract

1️⃣ 一句话总结

arXiv ID: 2602.04170 👀 Abstract

1️⃣ 一句话总结

获取最新论文摘要

📄 提交新论文

需要登录

提交新论文

需要登录

arXiv ID: 2602.05648

arXiv ID: 2602.06079

arXiv ID: 2602.04355

arXiv ID: 2602.04931

arXiv ID: 2602.04577

arXiv ID: 2602.04986

arXiv ID: 2602.05037

arXiv ID: 2602.04809

arXiv ID: 2602.04244

arXiv ID: 2602.04170