Loading...

KDD'26美团学术论文精选及KDD Cup'26 DataAgents赛道冠军思路解读
本文精选了美团技术团队被KDD2026收录的8篇论文进行分享,这些论文覆盖了推荐大模型、生成与奖励建模框架、智能体搜索、Transformer框架、元泛化框架等技术领域。

Agent评测漫谈 —— 由浅入深讲解Agent评测
本篇博客是一篇科普文章,由浅入深的介绍Agent评测。其中前两章系统介绍了评测是什么,以及如何建立评测体系;其中第二章是美团图灵Agent评测团队深入美团各业务团队BP总结出的实践经验,是我们在两年实践过程中逐步打磨出来的认知。

美团正式发布 CatPaw:全场景 AI Agent,从个人提效到企业智能化
搭载美团LongCat2.0的全场景AIAgent平台 CatPaw 正式上线,我们将模型能力从“跑得动”推向“用得好”。CatPaw提供开箱即用的AI智能工作台与企业级Agent开发托管能力。

下一代搜索智能体评测基准!美团开源LoHoSearch,用知识图谱校准AI能力认知
过去一年,我们见证了SearchAgent能力的显著演进。在BrowseComp等评测上,顶尖模型准确率从最初的30%区间迅速攀升至90%以上。然而,当基准迅速饱和,其区分模型能力的价值也随之递减。

让AI离开温室,走向动态世界:MineExplorer揭示顶级多模态大模型被忽视的能力断层
美团LongCat团队构建了MineExplorer——首个在开放世界中做到分钟级长程任务的评测基准,系统性地评测多模态大模型在需要长程规划、并包含隐藏前置条件的任务中的真实能力。

正式开源!美团 LongCat-2.0 同步开放国产卡推理代码
美团LongCat-2.0总参数1.6T,平均激活约48B,为真实的AgenticCoding任务而生,架构上创新性引入LongCat稀疏注意力和N-gramEmbedding,提升长上下文处理效率与Token级表示能力的同时,结合动态激活进一步强化了代码理解、生成以及执行的表现。

直播回放·含 ACL'26 杰出论文 | 美团 AI 顶会论文 32 篇精讲
如果你正在关注AI前沿,这篇内容值得收藏。2026年,美团技术团队数十篇论文被ACL、SIGIR、ICML、KDD等顶会收录。我们精选32篇,进行了5大专场直播。

美团 LongCat-2.0 正式发布:在国产算力集群上完成全流程训练与推理的万亿参数模型
作为业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型(总参数1.6T,平均激活约48B,动态范围33B~56B),LongCat-2.0从零开始预训练,原生支持1M超长上下文,其架构设计自始至终围绕一个核心目标:让模型在真实的AgenticCoding任务中,更高效、更稳定地完成代码理解、生成与执行。

ICML 2026 | 美团技术团队学术论文精选
ICML是机器学习领域最具影响力的国际顶级学术会议之一。大会旨在探讨机器学习未来发展所面临的关键挑战与核心问题,并通过征集和评估具有重要理论价值和实际影响的前沿研究成果,推动领域发展并引领未来研究方向。

LongCat 开源 VitaBench 2.0:长期动态智能体基准新标杆
VitaBench2.0是首个真实生活场景下面向长期动态用户建模的智能体评测基准,它系统性地评测大语言模型在长期、真实、动态的用户互动中个性化与主动性的能力。

欢迎留下您的脚印