「模型训练」共找到 8258 篇相关文章
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。
刚刚,小云雀的短剧Agent上线了,背后是字节自己的Seedance 2.0。
字节的小云雀短剧Agent上线,以Seedance 2.0为底层模型。它能根据剧本或设定自动生成高质量短剧,提升了AI短剧创作效率,且不挑风格。文中还介绍了使用流程及剧本创作方法。
全民都在养虾,终于,有人开始给它做“手”了
过去半年,Agent 赛道竞争激烈,大家都在比拼模型等。Violoop 是一块硬件,能在工位打通「看见、判断、动手」闭环,是主动感知型 Agent,它填补了 Agent 生态执行层空白,有独特技术细节,资本看好。
以「图」破局,HyperOffload定义超节点存储管理新范式
随着生成式AI进入万亿参数时代,大语言模型面临“显存墙”挑战。上海交大与华为MindSpore团队发布技术报告《HyperOffload》,其核心技术集成于MindSpore 2.8,能提升超节点异构资源协同效率,已在多项目落地。
ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架
近年来,基于多模态大语言模型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。
32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世
现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。
Claude全球宕机,机房爆炸!美财政部全面停用,恐遭英伟达断供
Claude深夜宕机近10小时,波及平台与多款模型。原因或为亚马逊AWS数据中心被‘不明物体’击中。美财政部停用Claude,硅谷CEO联名反击。ChatGPT日卸载量飙涨,Claude日下载量超它,Anthropic融资或受影响。
上海一群青年,造了个学术版OpenClaw
上海科学智能研究院联合复旦大学发布超级科研合伙人“大圣”,它是面向科学探索的高能动性智能体。能在生命、地球、人文等多领域发挥作用,其研发涉及多模态模型、群体记忆架构等核心技术,还介绍了相关赛事。
这个情人节,AI深吻Math!国产RL系统多维突破300年亲吻数难题
2月14日情人节,上智院等联合研发的PackingStar强化学习系统,在多维度刷新亲吻数与广义亲吻数纪录,实现数学结构领域多维度、系统性突破。它将复杂几何问题转化为可训练游戏,成果获权威认可。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。