多风格图像」共找到 4502 篇相关文章

算法论文7

少说‘Wait’,做题:NoWait重塑大模型推理路径

现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在任务中表现出色,且颠覆对推理的认知。

深度学习自然语言处理
产品应用8

UCSD首个智能体浏览器发布!页面设计,颠覆传统交互

加州大学圣地亚哥分校推出Orca浏览器,把网页视为可塑材料,浏览器变为可塑空间。用户能在无限画布中浏览、管理网页,调度智能体完成任务,还可进行大规模查看、管理等操作,项目将开源。

新智元
新闻资讯8

马斯克公布SpaceX火星新计划,迈向行星生命之路!

马斯克在德州Starbase公布SpaceX火星最新计划,介绍从Starbase发展、星舰生产目标、技术突破到火星城市建设等方面内容,展示人类成行星物种的清晰路线,还提及火星时间表等信息。

AGI Hunt
算法论文8

沉默的进化:LatentMAS 如何通过“潜意识通信”重塑智能体协作?

这是对智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。

深度学习自然语言处理
产品应用8

刚刚,MiniMax新模型接管「音乐圈」!20秒出歌Cover全风格

4月10日,MiniMax带来重磅更新,上线Music 2.6模型并发布专属Music Skills,核心新功能Cover翻唱可自由进行风格置换。Music 2.6在速度、音乐性和音质上改进明显,还开放三个Music Skills套件。

机器之心
新闻资讯8

让龙虾看懂屏幕!谷歌模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
产品应用7

The Batch:831 | 机器翻译正在实践中发挥作用

人工智能为语言学习应用巨头 Duolingo 带来生产力提升,借助生成式 AI 构建 148 门课程,总量翻倍。其 AI 辅助课程构建法能快速转化语种版本,还在评估模型,不过此举也引发批评。

DeeplearningAI
新闻资讯8

重磅发布 |智能体协同驱动,新一代流体力学工业软件平台正式亮相!

2025年11月29日,第四届智能流体力学产业联合体大会上,西北工业大学等联合发布“智能体协同驱动的新一代流体力学工业软件平台”,解决流体设计仿真瓶颈,含完整体系,有项关键技术及典型应用场景。

力学与人工智能
新闻资讯7

OpenAI解散「灾难风险应急」团队!GPU大神Scott Gray也跑路了

OpenAI解散「Preparedness」团队,该团队负责评估自家AI灾难级社会风险。官方称安全工作已融入开发流程。此前个安全团队也已解散,名安全高管离职,引发员工不安。

量子位
开源动态7

全球首个智能体Eigent开源!内置200+MCP,支持SSO企业级

OWL团队开源智能体Manus类工具Eigent,能智能体协作处理复杂任务。它可整合工具和数据,处理任务时清晰拆解执行。有种预定义智能体,内置200+MCP工具,还支持人工干预。

CourseAI