「大模型智能体」共找到 10587 篇相关文章
快手提出强化学习创新框架RLEP,突破大模型推理瓶颈
OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。
Karpathy最新发文:醒醒!别把AI当人看,它没欲望也不怕死
Andrej Karpathy在推文中反驳将大模型视作「更聪明人类」的观点,指出大模型是「非生物」智能,其进化压力、学习机制、运行方式与人类不同。清楚这是全新智能,对理解大模型很重要。
Manus数十亿美元卖身Meta,智谱夺得全球大模型第一股
2025年末中国AI领域有两大喜事,通用AI Agent公司Manus被Meta数十亿美元收购,其发展迅速成果显著;智谱启动招股,即将成为全球大模型第一股,虽研发投入高,但营收增长快,获资本青睐。
神秘模型「大象」:仅100B拿下SOTA,Token效率超高!
神秘模型「大象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B大小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。
内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源
据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。
AI时代已来,魔幻的大模型投毒事件,我们怎么应对?
央视315晚会曝光针对大模型的蓄意信息围猎,虚构手环经力擎系统包装成科技尖货。黑产靠此吸金,利用技术污染证据链。多方已行动,厂商需提升安全能力,消费者要保持警惕。
腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent
智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。
速度提升,能力却暴跌?扩散模型做智能体的残酷真相
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
香港中科院发布聆音大模型,400万张图喂出个“AI超声神医”
中国科学院香港创新研究院发布超声大模型“聆音”,用超400万张图像的超声数据集,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。
都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了
当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。