谷歌Gemini 3.1 Pro屠榜封神,清华姚顺宇出手!Claude和GPT被逼入死角
新智元报道 编辑:好困 桃子【新智元导读】谷歌DeepMind深夜扔出核弹,下一代Gemini 3.1 Pro正式登场。在公认的最难ARC-AGI-2测试中,它拿下最高分直接看呆硅谷,推理狂飙2
阅读全文新智元报道 编辑:好困 桃子【新智元导读】谷歌DeepMind深夜扔出核弹,下一代Gemini 3.1 Pro正式登场。在公认的最难ARC-AGI-2测试中,它拿下最高分直接看呆硅谷,推理狂飙2
阅读全文新智元报道 编辑:元宇【新智元导读】当OpenAI亲手放弃「仰望星空」,一家誓言用AGI造福全人类的AI圣殿,正在经历一场理想主义的倒退。OpenAI正在「杀死」OpenAI?5000亿估值、处
阅读全文新智元报道 编辑:LRST【新智元导读】医疗AI终于走出了「只会聊天」的舒适区。今天,斯坦福与普林斯顿联手NVIDIA发布MedOS。这不是一个单纯的手术机器人,而是全球首个通用医疗具身世界模型
阅读全文新智元报道 编辑:KingHZ Aeneas【新智元导读】双十一需要瞬间扩容3-5倍人力,春节却是全员真空,百融云创的硅基员工却在两种极端场景中无缝切换:从峰值「强力补充」到假期「全量值守」,真
阅读全文新智元报道 编辑:艾伦【新智元导读】谷歌在 7.5 亿月活的 Gemini 中上线了 AI 音乐生成功能,输入一句话或一张照片,几秒就能得到一首带人声和歌词的完整歌曲。背后是 DeepMind
阅读全文新智元报道 编辑:桃子【新智元导读】李飞飞World Labs揣着巨头们给的10亿美金,用「空间智能」降维打击,直接开始用文字手搓3D虚拟宇宙了。一次拿下10亿美金,惊爆硅谷!就在刚刚,李飞飞「
阅读全文新智元报道 编辑:编辑部【新智元导读】这届春晚太顶了!史上首次百只「机器熊猫」群控舞蹈萌翻全场,还有双足机器人现场捞面、斟酒、送餐炸场。魔法原子这匹中国黑马,不止卖萌,更宣告「真干活」通用机器人
阅读全文新智元报道 编辑:元宇【新智元导读】彻底告别AI「塑料文」,重回「人话模式」!Towards AI联合创始人Louis的这套「反AI味」终极指南,用一套可复制的提示词模板和工作流,帮你把文章的「
阅读全文新智元报道 编辑:LRST【新智元导读】ICLR 2026:MMSU评测揭示语音大模型存在严重理解缺陷,最佳模型仅60.7%得分,远低于人类89.7%。它通过语言学框架,系统评估语音中的语调、停
阅读全文新智元报道 编辑:Aeneas【新智元导读】刚刚过去的马年春晚上,中国机器人把全球老外震住了!后空翻、醉拳一气呵成,歪果仁逐帧扒秒围观:中国人形机器人,真进化到武僧级别了?外媒更是惊呼:这是一场
阅读全文新智元报道 编辑:元宇【新智元导读】 只因关掉了AI提交的PR,他竟被AI写长文人身攻击,Anthropic的预警已经成真。近日,AI写「小作文」攻击人类工程师的事件,仍在持续发酵!一位开源社区
阅读全文新智元报道 编辑:LRST【新智元导读】清华团队提出EigenData系统,通过可执行数据闭环优化多轮Agent训练,在真实场景中使开源模型表现达到与闭源系统相当水平。关键在于训练数据的稳定性和
阅读全文新智元报道 编辑:编辑部【新智元导读】就在刚刚,机器人又在春晚舞台炸场了!这个逼真的仿生人形机器人,简直让人分不清台上谁是演员,谁是机器。「国民孙子」小布米的上场,更是让演播厅瞬间沸腾。这个小品
阅读全文新智元报道 编辑:peter东【新智元导读】多年来,AGI(通用人工智能)如同科幻迷雾中的海市蜃楼——顶尖研究者们对其定义各执一词,甚至以「看到才知道」的模糊共识回避争论。然而,一场静默的革命正
阅读全文新智元报道 编辑:LRST【新智元导读】清华大学李升波教授团队提出RACS算法,通过引入「探险者」策略主动探索违规边界,破解安全强化学习的「安全性悖论」。该方法在不增加采样成本的前提下,显著提升
阅读全文新智元报道 编辑:编辑部【新智元导读】万亿级思考模型在开源!Ring-2.5-1T重磅出世,夺下IMO金牌。全新Ling 2.5架构,让它具备了深度思考、长程执行强大能力,真正进化为「通用智能体
阅读全文新智元报道 编辑:元宇【新智元导读】在OpenAI一项内部实验中,一个最初仅3人的团队、5个月、从零到一造出「百万行代码产品」,没有一行代码是人类程序员完成的,而不手工写代码,也是该项目的一条铁
阅读全文新智元报道 编辑:peter东【新智元导读】即便是像土木,建筑这样的传统行业,也受到AI的冲击。从帮助记录工程日志的智能体,到记录了老工人经验的安全智能体。AI正在建筑行业,让有经验的工人们获得
阅读全文新智元报道 编辑:艾伦【新智元导读】极佳视界具身大模型 GigaBrain-0.5M*,以世界模型预测未来状态驱动机器人决策,并实现了持续自我进化,超越 π*0.6 实现 SOTA!该模型在叠衣
阅读全文新智元报道 编辑:桃子【新智元导读】确认了!DeepSeek昨晚官宣网页版、APP更新,支持100k token上下文。如今,全网都在蹲DeepSeek V4了。传言中的DeepSeek V4,
阅读全文新智元报道 编辑:LRST【新智元导读】不再依赖像「安检站」一样每步必停的外部插件,首创「内源感知+分层筛选」机制,将Agent防御延时从200%+降至8.3%,安全与效率均达到SOTA级表现!
阅读全文新智元报道 编辑:桃子 好困【新智元导读】硅谷具身智能玩家都在为「没数据练手」集体焦虑。没想到,这家中国黑马成为了荒原的孤勇者,在最真实的作业流程中,开辟出100万小时的原始矿脉。当Figure
阅读全文新智元报道 编辑:KingHZ【新智元导读】从零到140亿年化营收,只用了不到三年!Anthropic G轮狂揽300亿美金,估值直冲3800亿,成为AI史上最疯狂的资本狂欢,企业级AI正式加冕
阅读全文新智元报道 编辑:LRST【新智元导读】清华大学团队推出的Dolphin模型突破了「高性能必高能耗」的瓶颈:仅用6M参数(较主流模型减半),通过离散化视觉编码和物理启发的热扩散注意力机制,实现单
阅读全文新智元报道 编辑:好困 定慧【新智元导读】Vibe Coding时代宣告终结!2026年伊始,智谱GLM-5震撼空降,以「智能体工程」重塑游戏规则。用Claude七分之一的地板价,国产模型正面硬
阅读全文新智元报道 编辑:元宇【新智元导读】一位牛津哲学博士,正在Anthropic教全球顶尖AI模型如何「做人」。这场跨物种的「育儿实验」,比科幻更炸裂。她留着朋克短发,每天如慈母育儿一般,与AI谈论
阅读全文新智元报道 编辑:LRST【新智元导读】UIUC开源的智能模型路由框架LLMRouter可以自动为大模型应用选择最优模型,提供16+路由策略,覆盖单轮选择、多轮协作、个性化偏好和Agent式流程
阅读全文新智元报道 编辑:桃子 定慧【新智元导读】OpenClaw火出圈了,但许多人还没用上?这不,国内大厂直接出手了,OpenClaw极速简易版方案上线,四步一键部署,小白也能冲。OpenClaw(C
阅读全文新智元报道 编辑:桃子 好困【新智元导读】终于,AI不用装得像个人了。谷歌Chrome重磅上线WebMCP。从此,Agent不用疯狂截屏,直连内核完成任务,AI与网页交互的底层逻辑正在重构。今天
阅读全文新智元报道 编辑:LRST【新智元导读】清华、哈工大等团队将几何物理知识注入大模型参数,打破AI固有的频谱偏见,精准还原微米级月壤颗粒边缘,以超越国际主流模型的卓越性能,有力支撑月球原位资源利用
阅读全文