多场景预测」共找到 5576 篇相关文章

产品应用7

李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素级深度预测

Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为领域带来前景。

新智元
开源动态8

少 61% Token、10倍成功率,这个终端 AI 编程代理火了!

现在数AI编程工具问题,而在Github上火爆的`oh-my-pi`是运行在终端的AI编程代理,有哈希锚定编辑等实用功能,支持模型,经基准测试效果好,还能解决实际开发痛点。

开源先锋
算法论文8

Arc研究所造出能“举一反三”的虚拟细胞模型,破解跨细胞预测难题

生物学和药物研发中,因细胞组合庞大,难以全实验验证,且同药在不同细胞效果不同。Arc Institute 团队推出虚拟细胞模型 STATE 及评测套件 Cell - Eval,STATE 预测效果优,但也存在短板。

DeepTech深科技
开源动态8

一张图片+ 一条音频,照片开口说话唱歌,角色、情绪控制都拿捏了。

腾讯混元联合腾讯音乐推出 HunyuanVideo - Avatar 模型,上传照片配音频就能生成动态视频。支持风格角色、情绪控制和角色对话,单角色模式已开源,技术有创新,在数据集表现优。

AI进修生
产品应用8

谷歌Alpha家族再登Nature封面!刷新基因组预测SOTA,精准定位远端致病突变

谷歌Alpha家族新成员AlphaGenome登Nature封面,将AI预测拓展到人类基因组图谱。它能综合预测11种基因调控过程,精准定位远端致病突变,性能超现有程序,已面向非商业研究开放API。

量子位
算法论文7

你永远叫不醒装睡的大模型!轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估大模型在轮对话中的表现。结果显示,大模型在轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元
产品应用7

构建能源领域的AI专家:一个智能体框架的实践与思考

本文介绍阿里团队在能源领域构建智能体框架的实践。因单智能体处理复杂任务有“注意力发散”问题,团队研发综合能源智能体平台,阐述框架搭建、各组件功能及设计考量,还分享思考与可优化点。

阿里云开发者
算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
算法论文8

混合数学编程逻辑数据,一次性提升AI领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在领域推理机制。构建领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有项关键发现,为构建AI推理模型提供参考。

量子位