「认知核心」共找到 1912 篇相关文章
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。
当智能成为主要生产资料,硅基经济学引爆「AI+金融」
华东师范大学上海人工智能金融学院院长邵怡蕾提出「硅基经济学」,它以人工智能等为生产资料与经济驱动核心。她还介绍了SAIFS金融智能引擎,认为AI应创造经济价值,提出硅基世界“权力三角形”等观点。
附部署代码|云数据库RDS 全托管 Supabase服务:小白轻松搞定开发AI应用!
本文展示借助 RDS Supabase 搭建 AI 应用的全流程,对比传统开发,其在效率、成本、扩展性上优势显著。介绍 Supabase 特性、适用场景、核心能力,还给出基于它开发简易 Agentic RAG 应用的步骤。
小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案可复现
国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。
一篇持续强化学习技术最新综述
文章对持续强化学习(CRL)进行全面考察,关注其核心概念、挑战和方法,提出新的分类体系,从知识存储和/或转移角度将CRL方法分为四类,并分别介绍各类方法特点。
开源端到端语音大模型:直接从原始音频输入,生成语音输出
目前大模型大多只能输出文本,人机音频交互不顺畅。Step - Audio团队开源端到端语音大模型Step - Audio - AQAA,能直接听懂音频问题并合成语音回答,介绍了其架构和各核心模块。
一文读懂深度表格数据表示学习 | 南京大学
南京大学团队系统介绍表格表示学习领域,将现有方法按泛化能力分三类,比较DNN与树模型优劣,剖析核心挑战,探讨扩展方向及数据集评估策略,旨在建跨数据集稳健评估体系。
万字总结:如何练就适配人形机器人的可靠「灵巧手」?|GAIR Live
在具身智能崛起时,灵巧手成人工智能落地核心突破口。2025年5月25日相关线上沙龙中,嘉宾围绕灵巧手软硬件、数据与模型、落地应用等交流,探讨数据难题、开源价值、落地挑战及中美差距等。
Anthropic CPO:AI写9成代码后,我们迎来了新噩梦!
本文是对Anthropic CPO Mike Krieger的播客访谈。他谈到AI重塑软件开发,约90%代码由AI编写;还分享产品经理价值、Anthropic战略、Artifact关闭原因等,对AI认知从工具变为战略伙伴。
大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点
加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。