「M2.1」共找到 3374 篇相关文章
让大模型指哪打哪的Multi-Agent路由新范式
随着MCP生态兴起,一个Assistant背后可能挂数百工具/子Agent,传统检索方式有成本高、埋没工具等问题。作者提出Tool-to-Agent Retrieval新范式,实验显示指标全面提升,证明工具细节能补足语义。
Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限
Prime Intellect公开大规模AI自主科研实验,18大顶尖模型断网8天挑战nanoGPT优化器速通,Fable 5追平人类82%的水平,AI开始独立完成科研闭环,但目前尚无模型有全新方法。
一键部署,100+安全工具,一句话就能打靶!
网络系统复杂,传统渗透测试繁琐低效。开源项目CyberStrikeAI基于Golang开发,集成100+安全工具,通过自然语言对话让安全测试变简单,在GitHub获2.6K+ Star,优势显著。
12小时登顶OpenAI MLE-bench!上海AI Lab开源算法进化框架MLEvolve
上海AI实验室开源算法进化框架MLEvolve,12小时登顶OpenAI MLE - bench榜单第一。它是自进化机器学习系统,在75道Kaggle竞赛题上奖牌率达61.33%,为AI自主算法设计提供新方案。
姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”
姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。
爆火Clawdbot被Claude公司强制要求改名
AI智能体Clawdbot爆火后,被Claude公司强制更名。开发者Peter虽认为名字合法,但最终妥协,新名为Moltbot。Moltbot功能强大,此前爆火带火Mac Mini销量,此次更名引发粉丝不满。
年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川
年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。
独家丨MiniMax 高级研究总监钟怡然已于半年前离职
AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。
中国科学SCPMA | 南科大王建春团队:基于改进隐式轴向分解Transformer的三维槽道湍流快速预测
南科大王建春团队改进IFactFormer模型,采用“并行”轴向分解注意力机制,提升在复杂流动问题中的表征能力和稳定性。实验显示,改进模型拟合与长期预测能力强,多数指标精度优于传统方法。
神秘访客、智驾改革、增长放缓,这一年极氪调整了什么|甲子光年
极氪自2024年9月进入频繁调整期,经历组织架构和人事变动,如与领克合并、林杰接管营销等。但调整未显著提升销量,其独立性受冲击,资源被共享,现正重塑豪华品牌定位。