「混合长度理论」共找到 461 篇相关文章
美团智能体SOTA模型LongCat-Flash-Thinking-2601开源
美团龙猫团队开源智能体推理模型LongCat - Flash - Thinking - 2601,总参数5600亿。该模型在多方面有卓越表现,团队通过构建数据、模拟环境、采用强化学习策略及设计高效架构等,使其比肩闭源模型。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。
从物竞天择到智能进化,首篇自进化智能体综述的ASI之路
普林斯顿大学等机构研究者发布首个自进化智能体综述,为领域建统一理论框架和路线图。综述给出形式化定义,围绕What、When、How、Where构建分析设计框架,还探讨评估范式并指明未来方向。
一篇自进化Agents技术最新综述:迈向人工超级智能
LLMs有局限性,研究者关注自进化Agents系统,其范式转变为人工超级智能铺路。文章回顾自进化智能体研究进展,围绕‘什么要进化’‘何时进化’‘如何进化’展开,提供理论和实践指导。
12年首次大改!真有人喜欢苹果的“液态玻璃”吗?至少Flutter 开发者的噩梦开始了
在 WWDC 2025 上,苹果宣布在多操作系统引入‘液态玻璃’新视觉风格,是 12 年来最大 UI 革新。这或成苹果移动端外观重大转变,但也掩盖其 AI 落后现状,还让开发者面临功耗、适配等挑战。
红杉中国xbench全球首发,AI智能体真实战力揭榜!
红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估体系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。
50年僵局打破!MIT最新证明:对于算法少量内存胜过大量时间
MIT理论计算机科学家Ryan Williams最新研究建立数学程序,将任意算法转化为占用空间更少的形式,证明少量计算内存比大量计算时间更有价值,打破计算机科学家近50年认知。
切开Claude大脑,Anthropic称发现了一个类似人类意识的内部空间
Anthropic在Claude模型中发现J空间,其与人类大脑全局工作空间理论相似,承载特殊内容且可干预、参与多步推理等,但模型和人脑有差异,研究也有局限性。
OceanBase湖库一体,重新定义AI数据库
AI时代数据库面临变革,使用者从人类应用扩展到Agent,管理的数据和承载的工作负载也发生变化。OceanBase坚持一体化设计,发布湖库一体的AI数据库,解决AI生产系统的数据基础设施问题。
清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源
5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。