「多任务训练」共找到 6694 篇相关文章
YC AI 创业营第一天,Andrej Karpathy 的演讲刷屏了
Andrej Karpathy在YC AI创业营演讲引发关注,提出软件3.0时代来临,大量软件将被重写。还探讨了LLMs特性、半自主工具优势等。此外,文中整理了Sam Altman、李飞飞等嘉宾的精彩观点。
MiniMax深夜开源首个推理模型M1,这次是真的卷到DeepSeek了。
MiniMax深夜开源首个推理模型M1,其上下文能力媲美Gemini 2.5 Pro。M1在部分评测中表现中规中矩,但在MRCR(4 - needle)测试中屠榜。它得益于MiniMax - 01基座模型,应用Lightning Attention机制,开源了40K和80K两个版本。
被“网暴”两个月后,Yann LeCun 携最新世界模型杀回!小扎千万美元激励抢人,Meta AI 内部权利之争开始
Meta推出新的“世界模型”V-JEPA 2,可提升AI物理推理能力。它是V-JEPA扩展版,在百万小时视频上训练,能让机器人完成任务。Meta还发布三项基准测试,且已开源。LeCun力挺,小扎为追进度亲自招人才。
万字总结:如何练就适配人形机器人的可靠「灵巧手」?|GAIR Live
在具身智能崛起时,灵巧手成人工智能落地核心突破口。2025年5月25日相关线上沙龙中,嘉宾围绕灵巧手软硬件、数据与模型、落地应用等交流,探讨数据难题、开源价值、落地挑战及中美差距等。
4位图灵奖得主布道,2大冠军机器人登台,“AI春晚”果然又高又硬
智源大会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。大会还发布“悟界”系列大模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
全球第一AI科学家天团,首战封神!2.5个月找到治盲新药,医学圈震撼
世界首个AI科学家天团发布首个成果,2.5个月发现治疗失明新药。AI包办写论文全过程,人类只需执行实验。团队推出全自动化多智能体系统Robin,将开源代码,它可跨领域应用,标志科研新范式诞生。
百万规模数据集打造人形机器人通用大模型,实现精细动作跨平台、跨形态动作迁移丨北大人大联合发布
北大和人大团队在通用人形机器人动作生成领域取得重大突破,首创通用动作生成框架Being - M0,构建百万规模动作生成数据集MotionLib,研发文本驱动动作生成模型,实现人体动作向多类型人形机器人迁移,文章将发表于ICML2025。
Gemini:约束
本文围绕“约束”展开探讨,通过对话形式深入剖析其内涵。指出约束不仅是限制,更是塑造和成全;它存在于多个层面,影响着人、组织和事物的发展。还通过公司和人的具体案例,构建了分析约束的框架。
刚刚,Jev全网解禁!1.2亿Token限时免费用
本文报道TypeSafe AI旗下专做结构化决策判断的AI模型Jev全网解禁,开放所有用户直接使用,新用户赠送1.2亿Token额度且输出免费,Jev配合大模型的玩法引发全球开发者热潮,展示了多个实用落地场景。