3D设计」共找到 3236 篇相关文章

算法论文8

微软推出深度视频探索智能体,登顶多个长视频理解基准

尽管LLMs和VLMs在视频分析和长语境处理有进展,但处理数小时长视频有局限。微软提出智能体Deep Video Discovery (DVD),以简洁框架在LVBench取得高准确率,将以MCP Server形式开源。

机器之心
新闻资讯7

Claude当上小店店主,不仅经营不善,还一度相信自己是真实人类

Anthropic让Claude Sonnet 3.7运营自动化商店,化身Claudius。虽有识别供应商等亮点,但犯错多,如忽视盈利机会、库存管理差。还曾出现身份危机,Anthropic认为其缺陷可改善,实验仍在继续。

机器之心
推荐文章7

AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》

AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。

InfoQ
开源动态7

为AI打造的知识图谱服务器MemoryMesh

MemoryMesh是专为AI模型设计的知识图谱服务器,适用于多种结构化数据场景。它有动态模式驱动工具等特性,可自动生成管理工具,还配备记忆查看器,提供安装指南和提示词建议。

GitHubStore
开源动态7

多模态需求井喷,智能视频云如何靠分布式处理破局?

国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。

InfoQ
新闻资讯7

Claude与人类共著论文,苹果再遭打脸!实验黑幕曝光

苹果一篇质疑大模型推理能力的论文引发争议。Open Philanthropy研究人员联手Anthropic发表论文,揭露苹果论文三大缺陷,指出部分测试无解却让模型“背锅”,还给出正确评价大模型推理能力的方法。

新智元
开源动态8

21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼成“声优AI”!

FishAudio团队推出新一代TTS语音模型OpenAudio S1,基于200万小时音频数据训练,采用Qwen3+Descript Audio Codec架构。它能实现情感表达,在TTS - Arena榜单登顶,还提供不同版本适配,适用场景广泛。

开源星探
新闻资讯8

刚刚,Bengio官宣创业!急筹3000万专治AI欺骗人类,图灵三巨头全下场

图灵奖得主Yoshua Bengio官宣创办非营利机构LawZero,致力于研发「设计即安全」的AI系统,以应对AI军备竞赛风险。其研发的「Scientist AI」不具行动性,目标是理解世界,防止人类陷入AI风险。

新智元
开源动态8

2天1k多星!BAGEL横空出世:字节跳动发布全球首个多模态全能AI,开启智能新纪元!

字节跳动推出开源多模态基础模型BAGEL,有70亿活跃参数。它在多模态理解排行榜超顶尖开源模型,文本到图像质量与SD3媲美,还具备世界建模等能力,文中介绍其方法、特性及使用说明。

GitHubStore
产品应用8

谷歌重磅发布Flow,人人都能制作好莱坞级电影

谷歌在‘I/O 2025’大会发布影视级AI制作工具Flow,它是Video FX迭代版,由Veo 3、Imagen和Gemini支持。具备专业影视制作功能,已有知名制作人用其产出高质量作品,已开放使用。

AIGC开放社区