高性能计算芯片」共找到 2909 篇相关文章

算法论文8

港中文薛天帆团队:实现 4K 全景视频生成,普通视频也能「长出空间」丨CVPR 2026

香港中文大学薛天帆团队提出CubeComposer框架,可将普通视角视频扩展成原生4K的360°视频。研究在两个数据集测试,结果显示其在多指标上优于基线。该成果突破技术上限,让普通人也能制作360°视频。

AI科技评论
新闻资讯8

聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?

本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。

刘言飞语
算法论文8

前OpenAI科学家&GPT之父:预训练精准数据过滤,极低成本削弱大模型危险能力数千倍

Claude价值观塑造者Neil Rathi和GPT之父Alec Radford发论文,提出预训练时精准“删掉”危险知识碎片,以极低计算成本将大模型特定危险能力削弱数千倍,且不损通用智能。

AIGC开放社区
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
算法论文8

阿里巴巴新论文:让LLM学会管理记忆,告别人工规则

大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。

AI工程化
新闻资讯7

谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?

当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。

新智元
新闻资讯8

黄仁勋CES放出大杀器:下一代Rubin架构推理成本降10倍

在CES 2026展上,英伟达黄仁勋介绍多项进展。下一代Rubin平台含六款芯片,推理成本降10倍;发布Alpamayo 1开源模型助力自动驾驶;还推出物理AI新模型等,携手伙伴展示机器人。

机器之心
产品应用8

阿里通义实验室出品!全新 GUI 智能体 MAI-UI,精准操控你的手机

阿里通义实验室推出 GUI 智能体模型家族 MAI - UI,覆盖多种规模。针对当前 GUI 智能体问题,采用统一方案让模型更强。在多项任务中刷新行业成绩,有性能提升与隐私保护双收益。

带你学AI
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理