多视图输入」共找到 4263 篇相关文章

产品应用7

The Batch:831 | 机器翻译正在实践中发挥作用

人工智能为语言学习应用巨头 Duolingo 带来生产力提升,借助生成式 AI 构建 148 门课程,总量翻倍。其 AI 辅助课程构建法能快速转化语种版本,还在评估模型,不过此举也引发批评。

DeeplearningAI
新闻资讯8

重磅发布 |智能体协同驱动,新一代流体力学工业软件平台正式亮相!

2025年11月29日,第四届智能流体力学产业联合体大会上,西北工业大学等联合发布“智能体协同驱动的新一代流体力学工业软件平台”,解决流体设计仿真瓶颈,含完整体系,有项关键技术及典型应用场景。

力学与人工智能
新闻资讯7

OpenAI解散「灾难风险应急」团队!GPU大神Scott Gray也跑路了

OpenAI解散「Preparedness」团队,该团队负责评估自家AI灾难级社会风险。官方称安全工作已融入开发流程。此前个安全团队也已解散,名安全高管离职,引发员工不安。

量子位
开源动态7

全球首个智能体Eigent开源!内置200+MCP,支持SSO企业级

OWL团队开源智能体Manus类工具Eigent,能智能体协作处理复杂任务。它可整合工具和数据,处理任务时清晰拆解执行。有种预定义智能体,内置200+MCP工具,还支持人工干预。

CourseAI
开源动态8

开源AI真人级互动老师,Agent+可视化画布,函数/思维导图实时作图!

本文介绍开源项目ChatTutor,它是可视化互动式AI老师,能边说边画。有数学画布、思维导图等功能,未来将支持代码、物理等画布,可用于解题、备课等,已上线chattutor.app。

开源星探
开源动态8

社区供稿 | VibeVoice实现90分钟、角色播客生成,拓展语音合成新边界

微软亚洲研究院提出全新语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最长 90 分钟、最 4 人对话的高质量播客音频,在方面有显著优势,未来潜力大。

Hugging Face
算法论文7

AI如何看懂足球?上海交大团队打造Multi-Agent系统,全面解析“美丽足球”!

现有足球AI研究存在不足,上海交大团队打造Multi - Agent系统。他们构建SoccerWiki知识库、SoccerBench评测基准和SoccerAgent智能体系统,该系统工具协作,实验中碾压GPT - 4,数据和代码将开源。

深度学习自然语言处理
开源动态8

告别 Selenium 痛点!全新升级版 Selenium 自动化框架,斩获10.2K标星!

Selenium 编写 Web 自动化脚本痛点,SeleniumBase 深度封装 Selenium,内置智能等待等功能,解决诸问题。它功能强大,安装使用简单,适用于场景,像“智能助手”让自动化测试变简单。

开源星探
算法论文8

突触神经元模型问世,国内团队打造类脑计算新引擎,登上《自然·通讯》

当前人工智能高能耗问题凸显,脉冲神经网络被认为更具生物合理性、能效更高,但缺乏平衡计算效率和生物合理性的脉冲神经元模型。国防科技大学与中科院团队合作提出 MSF 脉冲神经元模型,相关研究发表于《自然・通讯》。

机器之心
算法论文8

Google研究发现:Multi-Agent的核心竟然是Prompt设计!

Google和剑桥大学研究智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比种方法,在任务上性能显著提升。

PaperAgent