课程构建」共找到 2003 篇相关文章

算法论文8

1.5B推理模型新SOTA,RL训练新解法打破「简单题过拟合、难题学不动」的魔咒

QuestA通过在训练中注入解题提示,实现两项成果:在1.5B模型上实现Pass@1的SOTA性能,还提升了Pass@k性能。它解决了RL训练中简单与困难任务的权衡问题,为开发强推理模型打开大门。

机器之心
算法论文8

苹果掀桌!扔掉AlphaFold核心模块,开启蛋白折叠「生成式AI」时代

蛋白质折叠是计算生物学核心难题,SimpleFold作为首个仅基于通用Transformer模块的蛋白折叠模型,摒弃AlphaFold2系列传统架构,能将蛋白序列生成三维原子结构,在多基准测试表现强劲,还可生成结构集合。

新智元
新闻资讯8

华为算力“公共事业”:“超节点+全栈开源”如何撬动AI未来?

文章围绕华为算力“公共事业”展开,介绍其“超节点 + 全栈开源”模式。华为通过推出系列算力芯片、构建“超节点 + 集群”方案、全面开源开放软硬件等举措,满足全球产业算力需求,推动AI产业变革。

InfoQ
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元
算法论文8

X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态大模型,在20+个图像分割数据集上均达SoTA

中山大学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态大模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在超20个数据集达最优,为图像分割研究开辟新方向。

机器之心
推荐文章8

大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲

Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。

机器之心
开源动态8

首个开源多模态Deep Research智能体,超越多个闭源方案

首个开源多模态Deep Research Agent登场,整合多种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。

量子位
产品应用7

GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%

最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。

量子位
开源动态8

全球首次,「AI记忆」开源落地!MIRIX同步上线APP

加利福尼亚大学圣迭戈分校博士生王禹和纽约大学教授陈溪联合推出并开源全球首个多模态、多智能体AI记忆系统MIRIX,还上线桌面端APP。MIRIX性能远超传统方法,首次将记忆分六模块,用多智能体系统控制。

新智元
算法论文8

手机AGI助手还有多远?移动智能体复合长程任务测试基准与调度系统发布

上海交大与澜舟科技研究发现现有移动端GUI智能体处理复合长程任务能力不足,提出UI - Nexus测试基准和Agent - NEXUS调度系统,经实验能提升任务完成率,也为AI原生操作系统建立雏形。

机器之心