与爱为舞」共找到 9181 篇相关文章

产品应用8

NVIDIA 推出Rubin CPX,专AI推理设计的GPU

NVIDIA发布专大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成视频处理,多家公司将采用,2026年底上市。

AI工程化
产品应用8

参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”GeminiClaude

阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力更新速度。

AI前线
新闻资讯7

展览聚焦|类型叙事中的技术、情感未来主义

中间美术馆正展出“抛锚歌单”,汇集16位中瑞艺术家作品。本文聚焦艺术家杨迪,他以影像和装置媒介,借类型文学电影叙事框架探讨科技时代困境。其作品揭示虚拟迁徙代价,还分享创作相关看法。

北京中间美术馆
推荐文章8

深入理解OpenClaw技术架构实现原理(上)

文章深入解析OpenClaw技术架构原理,它以Gateway核心,是高度灵活的个人AI助手系统,改变了软件开发范式。涵盖统一控制平面、推理循环、定时任务等多模块。如Gateway负责消息路由等,推理循环控制运行逻辑。

阿里云开发者
算法论文7

TransformerRNN合体,谷歌打下显存门槛,解锁超长上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。

机器之心
开源动态7

TanStack Start 推出导入保护机制,强化服务器客户端边界划分

TanStack Start引入基于Vite的导入保护功能,防止服务器客户端代码相互泄露,默认在新项目启用。该功能以插件形式运行,开发和生产环境行不同,还能添加自定义规则,用户反响积极。

InfoQ
算法论文8

Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性效率

传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AIUCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性效率,本文对其全面解读。

深度学习自然语言处理
算法论文8

北大团队提出 SHINE:将任意文本转化大模型 LoRA,仅需一次前向传播!

北大团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化大模型 LoRA 参数,支持多轮对话。该方法实用潜力大、架构创新高效,训练流程成熟,推理快速,大模型持续学习提供新思路。

机器之心
开源动态7

第六章 Coding优先编的是「过程约束」,不是「参数」

本章以开面包店类比训练大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学极简主义固定约束。

CourseAI
新闻资讯8

对话西湖大学刘癸庚:从拓扑光子学到太赫兹芯片,他想做连接AI大脑身体的人

本文是对西湖大学刘癸庚的访谈。他在拓扑光子学研究成果丰硕,如三维光子陈绝缘体、光子轴子绝缘体的研究。如今专注太赫兹芯片通信,想构建连接‘AI 大脑’‘AI 身体’的链路。

DeepTech深科技