可迁移大脑」共找到 4372 篇相关文章

开源动态8

多模态Deep Research,终于有了「核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
新闻资讯7

大模型终于通关《宝梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝梦对大模型的挑战,谷歌将继续探索,网友提议用通关宝梦测试大模型 。

量子位
产品应用8

实测灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测灵2.5新视频模型,它已灰度内测并登上釜山电影节。与灵2.1对比,灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过学习参数融合,提出学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或降低大规模计算成本。

力学与人工智能
新闻资讯8

MIT:过度依赖ChatGPT会让大脑功能萎缩

MIT完成首个ChatGPT用户脑部扫描研究,发现AI没让我们高效,反而致大脑“认知破产”。研究追踪54人,监测脑电波和神经连接模式,发现过度依赖会让大脑功能萎缩,还探讨了如何正确使用AI。

AGI Hunt
产品应用7

Agentic 应用时代,Dify 全链路观测最佳实践

文章讲述 Dify 平台在 Agentic 应用开发的观测性挑战,从开发者与运维方视角分析现状、局限与改进方向。云监控推出全景观测方案,还介绍各组件监控接入步骤及实践指南,最后提及 Qwen - Image 生图优势。

阿里云开发者
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
产品应用7

本地运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore
产品应用7

魔笔 AI Chat Builder:让 AI 对话秒变交互界面

文章介绍阿里云魔笔AI Chat Builder,它能将AI对话变交互界面。对比现有AI应用开发方式,阐述其综合优势,还介绍核心能力、搭建方法、多端发布等,未来将打磨能力并推新功能。

阿里云开发者
开源动态7

给 iPhone 装个“最强本地大脑”:Google 开源模型 Gemma 4

Google 4 月初发布开源模型 Gemma 4,离线运行在 Google AI Edge Gallery 上。它在多项基准表现出色,采用 Apache 2.0 协议,开发者集成到 App。还介绍了在 iPhone 离线使用方法及适用场景。

MacTalk