「可灵3.0」共找到 6144 篇相关文章
字节Seed新作:模型合并如何改变大模型预训练范式
字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。
Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好
Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。
具身机器人能搞定超市盘点吗?全球七万门店正在给出答案
本文报道汉朔科技联合X-Era Lab(拓元智慧),依托汉朔全球近7万家门店的电子价签数字化底座,结合拓元自研原生世界动作模型VWA,探索具身智能在零售门店盘点、巡检、补货场景的商业化落地,验证具身智能能否从演示Demo转化为稳定运行的生产级系统。
OpenAI公布首颗自研推理芯片成绩,下一代已进入制造阶段
8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。
大模型之外,向量存储如何支撑 Agent 的检索链路
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
ResNet作者任少卿机器人创业!公司注册就独角兽了
知名AI科学家任少卿创立物理AI基础模型和具身智能独立公司,估值达独角兽级别。他虽创业仍在职蔚来,蔚来战略投资并合作。任少卿是业内早押注世界模型实战派,其创业或可视为蔚来机器人试水。
Palantir活成了所有FDE羡慕的模样:被骂十年外包,股价一天暴涨29%
8月3日美股盘后,Palantir交出2026年二季报,业绩亮眼致次日股价涨29.45%。此前它被看空,因其交付方式被指像外包。但从财务看它利润率高,且业务增速快,不过高估值和国际业务仍存挑战。
Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似
Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。
正式开源!motion-anything:免费版 Figma Motion + 无水印动效视频工坊来了
Open Design团队开源motion-anything,这是一款开源动效引擎,让动效活在真实网页上,可随时编辑。自带庞大动效生态,支持多种触发和动法,有视频工坊且无水印导出,还解决了动效领域四大痛点。
X-Era蝉联双榜单冠军,引领世界模型未来方向
X-Era的EonWorld在WorldScore和WorldArena两个榜单上连续霸榜。它来自X-Era的VWA原生世界动作模型体系,本职是帮机器人预判世界变化。这为“可用于行动的世界模型”竖起能力线,也揭示行业正进入新阶段。