全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    超越TurboQuant!KV Cache压到真2-bit,长上下文推理又快又稳

    作者:PaperWeekly发布日期:2026-06-02 21:31:11

    超越 TurboQuant, 内存有救了!最新论文 OSCAR:Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quanti

    阅读全文
  • 文章封面

    Agent团队开始自我进化,MetaAgent-X把协作训进基座模型

    作者:PaperWeekly发布日期:2026-05-30 09:59:51

    把 Designer 与 Executor 放进同一个训练闭环,让基座模型真正学会何时协作、如何协作。本文介绍的研究是 MetaAgent-X,作者团队来自 Oregon State Universi

    阅读全文
  • 文章封面

    直播预告 | UCLA田园教授:大语言模型智能体框架中的安全挑战

    作者:PaperWeekly发布日期:2026-05-30 09:59:51

    PaperWeekly × 星弧 STARC 科研觉醒AI前沿讲座 直播主题 大语言模型智能体框架中的安全:让从模型级控制到生态系统治理 直播嘉宾 田园加州大学洛杉矶分校(UCLA)副教授 直播时间

    阅读全文
  • 文章封面

    国内首次!千万级深思考SFT开源,MiniCPM5-1B核心数据公开

    作者:PaperWeekly发布日期:2026-05-29 12:20:31

    5 月 25 日至 29 日,面壁智能与 OpenBMB 联合举办「端侧大模型开源周」,每天解锁一个端侧大模型的杀手锏。端侧大模型的顶峰,不只在冰山一角,而在整座冰山。今天是开源周的第五弹:Ultra

    阅读全文
  • 文章封面

    Agent一定要训练吗?4层Harness让性能平均提升88.5%

    作者:PaperWeekly发布日期:2026-05-29 12:20:31

    只用 Qwen3-4B-Instruct 的训练轨迹演化 Harness,最终还能迁移到另外 17 个模型上。最近我们在思考一个问题:提升 LLM Agent 的能力,一定要重新训练模型吗?现在很多

    阅读全文
  • 文章封面

    会生成世界,不等于理解世界:20个世界模型大考来了

    作者:PaperWeekly发布日期:2026-05-28 14:10:22

    如果让模型连续前进、转向、跳跃、改变天气再切换视角,它还能记住自己身处哪个世界吗?视频模型正在从生成一段视频,走向模拟一个可交互的世界。雪山、城市、古堡、篮球场,角色奔跑,镜头穿梭,前沿视频模型已经能

    阅读全文
  • 文章封面

    ICLR 2026 | 从POD到互信息:PDE求解迎来神经正交分解新框架

    作者:PaperWeekly发布日期:2026-05-28 14:10:22

    偏微分方程(Partial Differential Equations,PDEs)是描述流体、扩散、反应、传热等物理过程的基础语言。然而,在真实科学计算和工程仿真中,高保真数值求解往往需要巨大的计算

    阅读全文
  • 文章封面

    发不了Nature?没关系,你投的Rubbish被它翻牌了

    作者:PaperWeekly发布日期:2026-05-27 14:33:23

    影响因子为 0 的 Rubbish, 被 Nature 推到了聚光灯下。一张失败的生物实验图,最近把中国科研人的精神状态送上了 Nature。主角不是新技术,也不是重磅论文,而是一本影响因子为 0 的

    阅读全文
  • 文章封面

    Cell Press直播来了:顶刊大牛齐聚,解密自主导航前沿技术

    作者:PaperWeekly发布日期:2026-05-27 14:33:23

    自主导航技术的应用涵盖自驾汽车、无人机、航天、甚至于药物递送等多个交叉领域。这些应用均需要硬件与软件技术的同时发展去实现,例如传感技术、数据传输和自适应人工智能等。自主导航系统必须针对个别场景带来的挑

    阅读全文
  • 文章封面

    无问芯穹RLinf加持DreamZero世界动作模型,实现4倍训练提速

    作者:PaperWeekly发布日期:2026-05-26 12:07:11

    过去要等一个月的世界模型训练,如今有机会压进一周完成。在通往 AGI 的道路上,世界模型(World Model)被视为让 AI 真正理解并预测物理世界的关键拼图。英伟达近期重磅发布的世界动作模型(W

    阅读全文
  • 文章封面

    ACL 2026 | 7000种语言怎么教?清华阿里找准语义瓶颈,通关多语言安全

    作者:PaperWeekly发布日期:2026-05-26 12:07:11

    英语固若金汤,小语种一攻就破?清华与阿里提出基于“语义瓶颈层”的对齐范式,实现安全能力的跨语言泛化。研究背景与摘要近年来,大语言模型在多语言场景中的安全表现呈现出明显的“偏科”现象,英语等高频语言固若

    阅读全文
  • 文章封面

    为什么语音大模型一开口,还是像客服?

    作者:PaperWeekly发布日期:2026-05-25 12:20:44

    问题可能不在语言能力本身,而在那些更难被建模的东西:语气、情绪、停顿、潜台词,以及人与人交流时微妙的“社交感”。而最近,一篇来自南京大学与小米的论文,开始系统地评测这些副语言能力。论文标题:Speec

    阅读全文
  • 文章封面

    ICML 2026 | 大模型为何越改越稳?中科大揭开终身归一化黑箱

    作者:PaperWeekly发布日期:2026-05-25 12:20:44

    当序列编辑走向百万次量级,如何避免参数崩塌?中科大团队详细解析终身归一化机制,并提出 StableEdit 实现长程正向累积。近年来模型编辑为更新大语言模型中过时、错误的知识提供了更精准与低成本的途径

    阅读全文
  • 文章封面

    10M参数也能跑ARC与数独,Bengio团队押注「多轨迹推理」

    作者:PaperWeekly发布日期:2026-05-22 13:34:56

    10M 参数跑到数独 97%,GRAM 把递归推理改成多轨迹采样。10M 参数,在大模型时代显得有些微不足道。但 Yoshua Bengio 团队与 KAIST、Mila、NYU 研究人员提出的 GR

    阅读全文
  • 文章封面

    智能体也要有App Store?上交大 × OPPO构建海量智能体生态

    作者:PaperWeekly发布日期:2026-05-22 13:34:56

    当 AI 从单个助手进化为成千上万个智能体协作的生态,未来的智能体服务会是什么样的?论文标题:ColorEcosystem: Powering Personalized, Standardized,

    阅读全文
  • 文章封面

    CVPR 2026丹佛见!蚂蚁这场“AGI攀登者之夜”可以先码住

    作者:PaperWeekly发布日期:2026-05-21 18:18:37

    🌟点击「阅读原文」,一键报名!

    阅读全文
  • 文章封面

    OPD为何如此高效?中科大揭开参数动力学密码,后训练提速3倍

    作者:PaperWeekly发布日期:2026-05-21 18:18:37

    只跑到约 10% 训练进度,OPD 已能恢复约 80% 的最终推理性能,EffOPD 顺势把后训练提速到约 3 倍。虽然 LLMs 的推理能力依靠强化学习(RL)得到了大幅提升,但 RL 训练过程往往

    阅读全文
  • 文章封面

    第十一届信也科技杯全球AI算法大赛重磅开赛,超30万奖金池等你来!

    作者:PaperWeekly发布日期:2026-05-20 13:06:41

    阅读全文
  • 文章封面

    ICLR 2026 | 800条数据治愈“过度思考”,大模型CoT减半还更准

    作者:PaperWeekly发布日期:2026-05-20 13:06:41

    你有没有遇到过,问大模型一个简单数学题,它却洋洋洒洒写了 5000 多字才出答案?这种“过度思考”不仅烧钱费时,还容易把对的改成错的。现在,中科大研究团队提出了 LCPO(Length Control

    阅读全文
  • 文章封面

    首篇Agent Harness综述:模型之外,Agent拼什么?

    作者:PaperWeekly发布日期:2026-05-19 15:09:43

    当模型能力不再是唯一变量,Agent 的胜负开始落到执行环境、工具接口、上下文、验证与治理这一整套 Harness 上。很多 Agent 系统进入真实任务后暴露出的不稳定,已经很难只用模型能力不足来解

    阅读全文
  • 文章封面

    美团CVPR 2026中稿精选:视觉生成遇上慢思考,解码多模态推理新范式

    作者:PaperWeekly发布日期:2026-05-19 15:09:43

    点亮👆“☆”星标,不错过推送内容~CVPR(IEEE/CVF Conference on Computer Vision and Pattern Recognition)是计算机视觉和模式识别领域中顶

    阅读全文
  • 文章封面

    从 P(y|x) 到 P(y):将RL引入预训练空间,激发大模型内生推理

    作者:PaperWeekly发布日期:2026-05-18 12:36:08

    大模型的强化学习必须依赖具体问题吗?中科院自动化所最新证实:去掉输入条件,直接对推理轨迹本身做边缘分布优化,配合负样本强化,仅 20 步即可大幅激发内生推理。现有大模型的推理强化学习,大多是在给定问题

    阅读全文
  • 文章封面

    CCAI 2026南京见:Advanced Computing创刊仪式,主编现场面对面

    作者:PaperWeekly发布日期:2026-05-18 12:36:08

    第六届计算机通信与人工智能国际会议(CCAI 2026)将于5月22日-24日在南京举办,会议聚焦“计算机通信、人工智能及其交叉学科”,汇聚多位院士与国际知名学者,设14 大特色专题论坛,共话前沿科研

    阅读全文
  • 文章封面

    北京内推 | 中国电信AI公司招聘AIGC鉴伪方向算法实习生

    作者:PaperWeekly发布日期:2026-05-18 12:36:08

    合适的工作难找?最新的招聘信息也不知道?AI 求职为大家精选人工智能领域最新鲜的招聘信息,助你先人一步投递,快人一步入职!中国电信AI公司中电信人工智能科技(北京)有限公司是中国电信开展人工智能业务的

    阅读全文
  • 文章封面

    RL才会泛化?上海AI Lab系统研究:SFT也能学会跨域推理

    作者:PaperWeekly发布日期:2026-05-15 21:28:42

    上海 AI Lab 等团队用系统实验发现,SFT 并非天然不泛化,关键在于有没有训透。引言随着大语言模型后训练(Post-training)技术的飞速演进,强化学习(RL)在提升模型复杂推理能力方面的

    阅读全文
  • 文章封面

    CVPR 2026 | 小米×武大3B模型学会共情,暴打一众强化学习基线

    作者:PaperWeekly发布日期:2026-05-15 21:28:42

    本文介绍的研究来自 CVPR 2026,作者团队来自小米大模型 Plus 团队与武汉大学计算机学院。武汉大学团队在视觉理解、多模态推理和情绪计算方面积累深厚,小米大模型 Plus 团队则在大模型训练、

    阅读全文
  • 文章封面

    直播预告 | UIUC刘瑶瑶教授:从2D像素生成到可控3D/4D世界

    作者:PaperWeekly发布日期:2026-05-15 21:28:42

    PaperWeekly × 星弧 STARC 科研觉醒AI前沿讲座 直播主题 显式 3D/4D 控制:让预训练生成模型走向几何一致的世界生成 直播嘉宾 刘瑶瑶伊利诺伊大学香槟分校助理教授 直播时间

    阅读全文
  • 文章封面

    不改架构、不加算力:Nous Research巧用Token叠加,预训练提速2.5倍

    作者:PaperWeekly发布日期:2026-05-14 17:35:06

    不改模型架构和推理方式,只在预训练前半程调整 token 表示和预测目标,就让 10B-A1B MoE 跑出同等 loss 下最高 2.5 倍提速。标准 LLM 预训练里,每个训练 step 通常只处

    阅读全文
  • 文章封面

    CVPR 2026 | 旋转语义魔方:SafeRoPE保障新一代文生图安全

    作者:PaperWeekly发布日期:2026-05-14 17:35:06

    在新一代文生图模型中,语义如何“排列”,往往比语义“是什么”更重要。在过去的文生图安全研究中,主流方法大多围绕三个方向展开:通过微调模型参数(fine-tuning)、干预注意力分布(attentio

    阅读全文
  • 文章封面

    AISY | 浙江大学李樵风课题组:近红外辅助3DGS,辅助暗光场景三维重建与增强

    作者:PaperWeekly发布日期:2026-05-14 17:35:06

    文章概述:近日,浙江大学机械工程学院李樵风课题组联合西安光机所在Advanced Intelligent Systems上发表了题为NIRGB-GS: Near-Infrared Assisted L

    阅读全文
上一页下一页