全景图」共找到 310 篇相关文章

开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
算法论文8

突破40年Dijkstra算法瓶颈,清华教授等颠覆教科书!斩获STOC最佳论文

清华大学教授段然提出最短路径新方法,击败经典Dijkstra算法,突破40年排序瓶颈。该算法不依赖排序,运行更快,摘得STOC最佳论文,团队正优化追求更快速度。

新智元
开源动态8

Claude团队打开大模型「脑回路」,开源LLM思维可视化工具来了

Claude团队推出“电路追踪”工具,可生成归因呈现LLM处理信息路径,支持在主流开源权重模型上快速生成。研究人员能借此解码LLM“决策逻辑”,官方还给出多语言电路等示例。

量子位
产品应用8

做了十年设计,这次真觉得自己多余了|GPT-Image-2 上手实测

作者对刚发布的GPT - Image - 2进行上手实测,发现它无需复杂提示词,随手几个字就能出好效果。在互联网运营片、知识类卡片、游戏设计、论文解释、网页设计等多领域表现出色,或冲击设计行业。

歸藏的AI工具箱
开源动态7

用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源

browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成让LLM理解视频,有完整流水线和设计原则,还给出使用方法。

AI寒武纪
新闻资讯8

Claude Opus 4.7连夜突袭:或将抢走全球7亿打工人饭碗!

Anthropic正式发布Claude Opus 4.7,定义为当前可广泛使用的最强Claude模型。其核心升级在复杂任务执行、高清视觉理解和长链路工作流,视觉能力大幅提升,在多方面超越对手,普通用户使用有三大变化。

新智元
算法论文7

G2ConS将微软GraphRAG的成本被打下来了~

传统Text - RAG处理多跳推理表现不佳,GraphRAG虽能提升准确率,但成本高。作者提出G2ConS方案,在3个多跳QA基准全面SOTA,平均节省30%费用,EM提升31.44%,整体流程仅3步。

PaperAgent
推荐文章7

2025 年 InfoQ 趋势报告:云计算和 DevOps 篇

InfoQ 2025 年云计算和 DevOps 趋势报告展示技术采用阶段趋势,介绍新增或更新技术。涉及 AI Agent、MCP、平台工程等趋势,指出云 DevOps 生态成熟有新挑战,新阶段需整合多种要素。

InfoQ
推荐文章8

谁在赚钱,谁爱花钱,谁是草台班子,2025 年度最全面的 AI 报告

Nathan Benaich发布《State of AI Report(2025)》,如AI全景,覆盖研究、行业等领域。2025年AI业务赶上炒作,模型竞争激烈,开源、智能体等发展显著,还对未来一年AI发展作出预测。

Founder Park
产品应用8

我用一张照片,生成了一个能走进去的世界

斯坦福李飞飞创办的World Labs发布新产品Marble,用一句话或一张照片就能生成3D游戏世界,用户可自由探索。它能降低3D建模门槛,提高影视游戏行业工作效率,潜力大但前景或取决于Token成本。

新智元