中国技术突破」共找到 4037 篇相关文章

算法论文8

关键突破:理论验证了 RL for LLM 路线的可行性

传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。

深度学习自然语言处理
新闻资讯7

亚马逊发布新AI大模型,部署机器人突破100万

全球电商、云计算巨头亚马逊宣布推出新AI基础大模型Deep Fleet,部署机器人超100万。该模型可提升机器人车队出行效率,还能协调机器人移动,带来交付快、成本低等好处。

AIGC开放社区
新闻资讯7

英伟达中国一把手造国产GPU,冲刺IPO了

摩尔线程完成上市辅导,冲刺IPO。其创始团队来自英伟达,创始人张建中深耕GPU近二十年。公司产品丰富,涵盖全功能GPU、大模型训推产品、专业和游戏显卡等。同时介绍了燧原和壁仞的上市情况。

量子位
新闻资讯8

刚刚,老黄官宣在中国台北建AI超算!

英伟达CEO黄仁勋在Computex 2025演讲官宣,将在中国台湾建首台世界级巨型AI超算及新总部,还推出GB300等新品,介绍NVLink Fusion等亮点,展望AI发展及通用机器人市场。

新智元
新闻资讯7

李飞飞刚发Atlas,中国开源“同款”已抢跑半年?

9月2日,李飞飞团队发布多模态世界模型Atlas,引发好评。而国内影溯3月就开源InSpatio - World模型,有类似能力。影溯登顶权威榜单,还联合启动大规模空间智能3D数据开放计划。

量子位
新闻资讯8

OpenAI Astra发布在即,全自动网络攻防能力已突破天际!

OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。

新智元
新闻资讯7

Anthropic 技术栈里的「五宗罪」由何而来?

Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行时的5个具体位置,导致各方面互相拖后腿。

AI科技评论
产品应用8

刚刚,中国AI交卷!40年难题56分钟破局,AI不再「学习」

文章介绍AI科研应用新趋势,从学习已知知识转向搜索未知解。以百度‘伐谋’为例,它助力南京林业大学检测松材线虫病,还在多学科和产业场景中展现价值,百度还启动科学家计划推动其发展。

新智元
8

纯CPU“踢开”GPU,中国超算九年后再登顶!

6月23日,国家超级计算深圳中心“灵晟”超算以2.19EFlops性能登顶全球超算TOP500榜单,这是世界首台超2EFlops的超算系统。它基于“灵鲲”平台,采用纯CPU设计,展现我国超算全栈自主可控能力。

芯师爷
新闻资讯8

美国ATOM报告:Qwen称霸武林,中国统治开源世界

美国ATOM报告显示,2025年夏中国开源语言模型超美国,下载、使用量差距显著。Qwen成王者,DeepSeek在大模型领域表现出色。新势力如Nvidia、OpenAI等也在追赶,报告引入新指标衡量模型热度。

AIGC开放社区