「核心任务」共找到 3503 篇相关文章
1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升
快手与清华团队用1.5B参数小模型在推理基准上超越同量级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。
超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭
近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。
包云岗:不止步于原位替代ARM,开源是RISC-V破局的关键
在全球半导体产业格局重构背景下,RISC-V从边缘走向核心。第五届RISC-V中国峰会举办,包云岗分享其产业应用观察。虽前景好,但RISC-V面临诸多问题,他认为开源是破局关键,还介绍了降成本案例和香山项目。
视觉+语言+动作!超强具身“训练宝典” EmbRACE-3K
视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。
英伟达&MIT等推出Long-RL,长视频训练速度翻倍
英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。
刚刚,OpenAI正式发布o3-pro!奥特曼激动更新博客:温和的奇点
今日凌晨,OpenAI发布o3-pro,Pro订阅用户可通过ChatGPT和API使用。其在多项任务表现出色,但在ARC-AGI数据集上与o3相近且成本高。网友测试评价不一,此外OpenAI CEO奥特曼还发表博客展望AI未来。
2025-04-努力不是做好事情最重要的因素
作者分享个人生活、工作等多方面情况,提及播客发布,认为努力非工作做好的关键因素,深入探讨Agent在业务应用中的问题,还谈及视频更新、投资经历等,最后表示要审视目标、精简事务。
CVPR 2025 Oral | DiffFNO:傅里叶神经算子助力扩散,开启任意尺度超分辨率新篇章
本文由圣路易斯华盛顿大学与北京大学联合完成,提出DiffFNO以神经算子赋能扩散架构,支持高质、高效、任意连续倍率超分,介绍其核心思路、组件及优势,在多数据集上领先SOTA方法,为超分提供新思路,适用于多领域。
在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻
作者通过三张圆明园鼠首照片开展实测,验证了全新3D AI Harness工作流:通用Agent调度任务、专业3D模型生成、专业软件后处理,仅1.47元即可生成可编辑可交付的3D资产,探讨了3D AI行业的新发展路径。
3万字长文带你WorkBuddy 从入门到精通
这是 WorkBuddy 的「从入门到精通」指南。介绍了它在 Windows 和 Mac 上的安装、登录、更新方法,功能涵盖新建任务、助理页面、项目页面等。还讲了技能、连接器、专家中心的使用,以及自动化、资料库、灵感等功能,还有实践案例、使用技巧和常见问题解答。