「可灵 API」共找到 4388 篇相关文章

算法论文8

复旦上线音视频模型新裁判:一万组数据对齐人类审美

现有音视频生成领域的奖励模型多依赖局部指标打分,不符合人类整体审美感受,易让模型“刷高分”却未真正提升生成质量。复旦大学团队推出VA-Judger,基于一万组人类偏好数据训练,可从整体维度判断生成质量,对齐人类审美。

量子位
新闻资讯8

具身机器人能搞定超市盘点吗?全球七万门店正在给出答案

本文报道汉朔科技联合X-Era Lab(拓元智慧),依托汉朔全球近7万家门店的电子价签数字化底座,结合拓元自研原生世界动作模型VWA,探索具身智能在零售门店盘点、巡检、补货场景的商业化落地,验证具身智能能否从演示Demo转化为稳定运行的生产级系统。

量子位
推荐文章7

大模型之外,向量存储如何支撑 Agent 的检索链路

文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。

阿里云开发者
新闻资讯7

ResNet作者任少卿机器人创业!公司注册就独角兽了

知名AI科学家任少卿创立物理AI基础模型和具身智能独立公司,估值达独角兽级别。他虽创业仍在职蔚来,蔚来战略投资并合作。任少卿是业内早押注世界模型实战派,其创业或可视为蔚来机器人试水。

量子位
算法论文7

Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似

Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。

AI寒武纪
开源动态8

正式开源!motion-anything:免费版 Figma Motion + 无水印动效视频工坊来了

Open Design团队开源motion-anything,这是一款开源动效引擎,让动效活在真实网页上,可随时编辑。自带庞大动效生态,支持多种触发和动法,有视频工坊且无水印导出,还解决了动效领域四大痛点。

开源星探
新闻资讯7

1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

Fable 5重新上线,Arena.ai的Gostev用其生成63个3D世界,多数一次成型,连Karpathy都直呼没想到。1600行代码就能撑起水下曼哈顿,还能将世界名画变成可穿行的3D世界,但游戏是其弱项。

新智元
产品应用8

X-Era蝉联双榜单冠军,引领世界模型未来方向

X-Era的EonWorld在WorldScore和WorldArena两个榜单上连续霸榜。它来自X-Era的VWA原生世界动作模型体系,本职是帮机器人预判世界变化。这为“可用于行动的世界模型”竖起能力线,也揭示行业正进入新阶段。

AI科技评论
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
开源动态7

Vibe Coding“血洗”开源,社区吵翻了:封杀菜鸡 AI 开发者?不如给维护者打钱!

多位研究人员在预印本论文中指出,氛围编码或摧毁开源生态,使官网访问量下滑、社区论坛使用量骤减。研究称要维持开源规模需改革维护者报酬方式,同时分析了其对开发效率、开源软件可持续性的影响,社区对此看法不一。

InfoQ