上纬新材」共找到 5119 篇相关文章

算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌研究:模型内心多个角色吵翻了

过去两年大模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类多智能体交互结构“思维社会”,还提出利用“群体智慧”方向,并介绍了研究方法、实验结果等。

AINLPer
算法论文8

矩阵乘法突破!XX^T原来可以更快!RL助力搜索,世界纪录又被提升了5%

深圳市大数据研究院、香港中文大学(深圳)研究团队,结合强化学习与组合优化技术,发掘算法 RXTX,让 XX^T 运算减少 5% 运算量,成果在国际引发关注,不过产业化落地仍面临挑战。

机器之心
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌研究:模型内心多个角色吵翻了

谷歌等机构研究指出,推理模型能力提升源于‘思维社会’,即模拟类多智能体交互结构。如 DeepSeek - R1 等在推理中展现高视角多样性,对话特征能提升推理准确率,还提出利用‘群体智慧’方向。

机器之心
推荐文章7

推特热议、AI 万亿美元赛道,「下文图谱」到底是什么?创业机会在哪?

文章围绕「下文图谱」展开,探讨其定义、构建问题及创业机会。指出它是决策轨迹积累形成的结构,构建要解决双时钟等问题。大厂难以捕捉决策轨迹,初创公司有三条路可走,捕捉决策轨迹或成万亿级平台。

Founder Park
新闻资讯8

微软发布GUI Agent范式!告别传统方式,小参数少数据,7B吊打72B模型

微软发布GUI Agent范式GUI - Actor,告别传统Agent定位死板、缺乏空间感和兼容性差等问题。它用无坐标交互技术,在测试中表现优异,省数据算力,未来在多领域有应用潜力。

深度学习自然语言处理
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务达SOTA。

量子位
算法论文8

ICLR 2026 Oral|中科院团队提出框架「SparseRL」,深度强化学习可自动生成高性能CUDA代码

中科院计算所团队提出 SparseRL 框架,将深度强化学习引入稀疏 CUDA 代码生成任务。实验显示,在 SpMV 任务编译成功率提升 20%,执行速度提升 30%。该成果已入选 ICLR 2026 Oral。

机器之心
新闻资讯8

曾对AI嗤之以鼻,如今2周生成7万行代码:Rust大佬与Claude联手打造语言Rue

2025年,Rust社区早期核心人物Steve Klabnik心态转变,开始借助Claude编写代码。他重启念头设计语言Rue,探索编程语言‘中间地带’,两周生成约7万行代码,开发中人与AI分工明确。

机器之心
新闻资讯7

骂战半年、站队失效,具身智能公司集体换了“剧本”,VLA“自救”成功了吗?

2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索架构,具身智能无完整技术路线图。

InfoQ
新闻资讯7

代码为刃 创意为甲,探索国产AI应用路径 ——“算网杯”2025 AIGC开发者大赛圆满落幕

1月17日,“算网杯”2025 AIGC开发者大赛决赛在中国科大苏州高等研究院落幕。大赛受业界关注,吸引500余名开发者。以“探索国产AI应用路径”为导向,成果丰富,发掘了人才与项目,为产业注入动能。

AIGC开放社区