模仿or探索?LUFFY:我全都要!巧妙融合外部指导,RL推理不再死板
本文提出 LUFFY 强化学习方法,一种结合离线专家示范与在线强化学习的推理训练范式,打破了“模仿学习只学不练、强化学习只练不学”的传统壁垒。论文标题:Learning to Reason under
阅读全文本文提出 LUFFY 强化学习方法,一种结合离线专家示范与在线强化学习的推理训练范式,打破了“模仿学习只学不练、强化学习只练不学”的传统壁垒。论文标题:Learning to Reason under
阅读全文你是否想开发一个真正能看懂图像、理解语境、给出准确回答的 AI?你是否对多模态生成、检索增强大模型(RAG)感兴趣?如果你的答案是“YES”,那你一定不能错过 Meta CRAG-MM Challen
阅读全文合适的工作难找?最新的招聘信息也不知道?AI 求职为大家精选人工智能领域最新鲜的招聘信息,助你先人一步投递,快人一步入职!香港中文大学香港中文大学多媒体实验室(MMLab)成立于2001年7月,是香港
阅读全文一觉醒来,全球开源的王座更替了,不是 R2。好消息是,中国用户依然是最大的受益者。今天凌晨,阿里开源了新一代自研模型 Qwen 3(千问 3),性能全面超越 DeepSeek-R1、OpenAI o1
阅读全文新智元报道 编辑:编辑部 YNZH【新智元导读】近来,纳米AI重磅上线MCP万能工具箱,全面支持MCP协议,开启AI Agent生产力新时代。作为国内首家开放生态MCP平台,它以超低门槛,让4亿
阅读全文新智元报道 编辑:KingHZ Aeneas【新智元导读】一夜间,GPT-4o忽然变成了「赛博舔狗」,这幅面孔让网友们大为震惊。奥特曼承认这次搞砸了,就在刚刚,OpenAI模型负责人表示已经连夜
阅读全文新智元报道 编辑:桃子【新智元导读】日前,诺奖得主、AI教父Geoffrey Hinton联合10名前OpenAI员工及其他业内人士联合发表公开信反对OpenAI的重组计划,理由非常直接:Ope
阅读全文最近发现了一个实惠又便捷的云平台,算力充足而且还有好多优惠,用了几天觉得很好用就来推荐给大家。尤其是学生党,建议注册薅一波羊毛,160块的算力券不用白不用!扫描二维码就能注册,建议快冲。云平台叫Gpu
阅读全文嘿,大家好!这里是一个专注于前沿 AI 和智能体的频道~昨天晚上的交流群日报,寻思找了一些KOL推广,怎么着不得发个产品的(进一步联想到manus之前宣布的Qwen国内合作)。结果今天早上,还就真是只
阅读全文4月29日消息,据报道,美国限制英伟达(NVIDIA)H20芯片对华出口之际,英伟达为维护其在中国市场的CUDA生态地位,正在低调地启动“B计划”,即考虑在中国设立合资企业,并可能为未来将中国业务单独
阅读全文凌晨 5:05 分,Qwen 发推宣布,Qwen3 来了!推文非常长,亮点也很多。推文包含的核心内容如下:Qwen3包括 2 个混合专家(MoE)模型和 6 个密集模型,参数规模从 6 亿到 2350
阅读全文来源:Theo vonZ Highlights这就是为什么数据被称作"新石油"或"新黄金"——它极其珍贵,因为算法的一切认知都来源于输入的数据。无论是知识储备、学习能力还是回答方式,AI的所有行为都完
阅读全文图片来源:Unsplash此次更新是OpenAI 将 ChatGPT 打造为“全能应用”战略的一部分,旨在提升用户参与度,上周通过 ChatGPT 进行的网络搜索已超 10 亿次。OpenAI 现在允
阅读全文图片来源:Lightrun基于AI 的编码技术因其能让开发者工作更快速、更轻松的承诺而迅速走红。但 AI 编码也带来了另一个后果:代码行数激增,进而导致因漏洞引发崩溃或其他事故的可能性大幅上升。4月2
阅读全文图片来源:Cheehoo制作动画是一个耗时耗力的过程,需要经历分镜、渲染、合成和灯光等多道工序才能完成一个场景。如果导演想尝试不同的场景表现方式,动画团队必须回头调整各个环节,才能最终定稿。由好莱坞高
阅读全文刚刚,Qwen3 开源了。强的离谱,DeepSeek 这次真的要坐不住了。先贴一张图。从这些主流的学术测试结果来看,Qwen3 全面超越了DeepSeek R1。注意我用的词——“全面”。这不只是在一
阅读全文前言近日,阿里云 Qwen 团队正式发布了新一代大语言模型 Qwen3,其性能全面超越 DeepSeek R1,成为全球最强的开源模型。AI 安全工坊第一时间对 Qwen3 进行了深入分析。本文将从技
阅读全文作者|Yoky邮箱|yokyliu@pingwest.com“这台机器人要99万?那边展台的不是只卖9.9万吗?”面对市场上价格天差地别的人形机器人,许多消费者和企业困惑不已。都是人形机器人,除了外观
阅读全文作者|summer邮箱|huangxiaoyi@pingwest.com在所有人都在猜测DeepSeek V4或者R2和Qwen3谁先到来时,Qwen3发布了。4月29日凌晨,阿里巴巴开源了新一代通义
阅读全文文章转载于新智元我们离人类智能水平的AI还远吗?如果你问OpenAI、Anthropic、Google等顶尖AI公司的CEO,他们肯定是信心满满,认为就在眼前。但现实是,越来越多的人认为,AI的思维方
阅读全文🌟字节跳动:算力资源已跻身世界第一梯队🎉商务部:支持地方发展汽车改装📱iPhone 20 周年纪念版或继续中国生产👶马斯克被曝可能已有 100 多个孩子✉️小鹏推出「智能辅助驾驶安心服务」🌍曾估值近亿
阅读全文今天,阿里宣布推出 Qwen3,这是 Qwen 系列大型语言模型的最新成员。我们的旗舰模型 Qwen3-235B-A22B 在代码、数学、通用能力等基准测试中,与 DeepSeek-R1、o1、o3
阅读全文点击👇🏻可关注,文章来自🙋♂️ 想加入社群的朋友,可看文末方法,进群交流。“ 在 2025 年的今天,智能体这一词汇已被广泛使用,却也因含义的多样性而逐渐失去精准的交流价值。因为每个人都自信地用它来
阅读全文今天凌晨,Qwen3发布图片来源:我画的介于 DeepSeek 和 OpenAI 暂无动静,Qwen 算是把头条保住了,恭喜~本文量大管饱、一次满足:发布内容、实际体验、训练细节,和 Qwen 发展
阅读全文虽然目前关于它的信息还未全部公开,但从已经泄露的资料来看,DeepSeek R2 不仅是技术上的全面升级,更是中国 AI 走向“去西方依赖”的重要一步。🔧1.2万亿参数背后的“极致性价比”DeepSe
阅读全文调优均线策略,A股年化收益超10%!前言你是否还在为选什么均线周期而纠结?你是否想让自己的量化策略更智能?本期实战带你用Python自动调优均线参数,实时获取A股数据,亲测11日均线年化收益超10%!
阅读全文整理 | 褚杏娟 4 月 29 日凌晨,在一众预告和期待中,阿里巴巴终于发布并开源了新一代通义千问模型 Qwen3。Qwen3 采用混合专家(MoE)架构,总参数量 235B,激活仅需 22B。其中参
阅读全文作者 | Tim Anderson 译者 | 平川 策划 | Tina 本文最初发布于 DEV CLAS。Docker 推出了自己的 MCP(模型上下文协议)目录和用于管理 MCP 工具的 MCP T
阅读全文