「对话式创作」共找到 1456 篇相关文章
相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作
S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。
AI 教父辛顿最新对话:超级智能诞生之后,我们唯一的生路是当“婴儿”
在大模型热潮下,“AI 教父”杰弗里·辛顿接受采访,剖析神经网络奥秘,分享对 AI 未来构想与忧虑,包括五年内超级智能诞生可能、人机共存方案,还谈及监管、就业影响等问题。
ElevenLabs 发布“视频到音乐”:AI 读懂视频内容,为其创作氛围匹配的 BGM。
ElevenLabs推出“视频到音乐”功能,其“Eleven Music”模型能分析视频上下文、情绪和风格,一键生成匹配的定制背景音乐,还能添加画外音和音效,为创作者提供端到端音视频解决方案。
重磅!Meta开源通用神经输入系统!人人可用的非侵入式手环登场
Meta开源通用神经输入系统,用基于手腕的输入技术结合上下文感知AI带来新交互体验。关键技术EMG可读取大脑电信号,将其转成数字命令,系统表现优秀,为“隐形”人机交互奠基。
李开复入场Agent!零一万物推出“万仔”,直接对话CEO走独特“一把手工程打法”
今早,李开复宣布零一万物升级万智平台2.0并推出企业级Agent智能体。他指出AI Agent正重构企业架构,零一万物采用“一把手工程打法”,万智2.0有五大功能,还预计了AI Agent三个演进层级。
揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估
文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。
她如何把“系统2”带给了大模型 |对话微软亚洲研究院张丽
本文是量子位对微软亚洲研究院首席研究员张丽的访谈。张丽团队在2023年开始探索大模型深度推理能力,2025年1月发布rStar - Math,用蒙特卡洛搜索算法让7B模型实现o1级数学推理能力,引发广泛讨论。
0成本升级,快手OneSearch-V2全量上线,生成式搜索进入「懂你」时代
快手技术团队在 OneSearch 基础上推出 OneSearch-V2 框架,解决电商搜索复杂查询理解不足等问题。该系统全量上线,不增成本与时延,业务收益显著,还缓解信息茧房与长尾稀疏问题。
对话英韧科技刘刚:AI浪起,从芯到盘的存储马拉松与国产破局
2026年存储行业受AI驱动变革,存力成新“卡脖子”环节。英韧科技CEO刘刚在闪存峰会接受采访,谈及技术、市场与战略,展现企业在AI浪潮中的生存法则与战略取舍,如技术超前布局、“以模组促主控”等。
对话港大黄超、任旭滨:龙虾热潮、nanobot、CLI与AI开源方法论|甲子光年
本文是甲子光年对港大黄超、任旭滨的访谈实录。二人介绍多个开源项目,如nanobot、ClawWork、CLI - Anything等,探讨OpenClaw热潮,认为焦虑与机会并存,还分享团队开源理念与研究方向选择方法。