「学习能力」共找到 4282 篇相关文章
AI大模型开发核心技术栈:从框架到部署的全景解析
本文为开发者提供2025年AI大模型开发核心技术栈图谱,解析四大核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。
阿里:RL强化LLM推理,是技巧还是陷阱?
近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。
是剧本杀来了?还是儿童剧本杀教育机会来了!
儿童剧本杀教育的兴起,不仅为孩子们提供了一种新颖的娱乐方式,也带来了教育的新机遇。它通过沉浸式体验,让孩子们在玩耍中学习历史,培养兴趣,同时满足了市场对创新教育内容的需求。
补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾
OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备多信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。
大模型在具身推理上「翻车」了?4496 道题全面揭示短板
美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。
GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!
GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。
深度拆解 Gemini 3.8 Live:一句插话,为什么会牵动整个 Agent 系统
本文深度拆解Google发布的Gemini 3.8 Live,分析其将语音、推理、工具调用整合进持续运行链路的架构创新,探讨Voice Agent进入Runtime阶段的核心技术挑战与未来AI Agent发展趋势。
百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用
7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。
Sora2甚至可以预测ChatGPT的输出
Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。
真实科研水平集体不及格!全新基准SFE给主流多模态LLM来了波暴击
上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估体系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。