生成器与验证器」共找到 7122 篇相关文章

算法论文8

大模型训练新突破!“不对称”训练让AI学会自我反思,推理零开销

字节团队提出全新语言模型训练方法PCL,首次打破训练推理对称约束,实现‘训练-推理不对称’。在训练时让模型反思评估结果,推理时仅输出答案,零额外开销,显著提升模型能力。

量子位
算法论文8

AI记忆系统首获统一框架!6大操作让大模型拥有人类记忆能力

香港中文大学等团队发布AI记忆机制综述,首次构建统一框架,划分记忆类型,提出六种操作,探讨关键主题,还对比人类AI记忆,指明未来AI记忆系统需突破瓶颈,迈向认知跃迁。

量子位
新闻资讯7

65亿!OpenAI收购Jony Ive的AI硬件创企,Altman要开始做硬件了

今天凌晨,OpenAI宣布以近65亿美元全股票交易收购Jony Ive参成立的AI设备初创公司io。Jony Ive将OpenAI CEO Sam Altman联手打造新公司,合作两年前已开始酝酿。

Founder Park
新闻资讯7

GoPro卖身了,准备搞光模块

当地时间9月1日,GoProStarman Optical达成合并协议,后者2.85亿美元收购约90%股权。GoPro曾辉煌,后因产品、对手、内存等问题衰败。Starman看中专利等,GoPro或涉足新领域。

DeepTech深科技
产品应用8

首发!成都华微亿门级逻辑综合加固EDA工具来了

6月26日,成都华微电子科技股份有限公司济南研发中心主任王宁发布亿门级FPGA逻辑综合安全加固综合EDA工具。该工具前端性能比肩国外,还补上市场空白,集成加固功能,有本地化服务优势。

芯师爷
8

在线等:如何优雅地分走鹅厂这600+万?

AI时代风口转变,Meta、字节跳动、腾讯等头部玩家扎进推荐系统统一建模方向。2026腾讯广告算法大赛KDD联动,赛题聚焦‘大一统’,设高额奖金和创新奖,吸引全球顶尖人才参赛。

量子位
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。

机器之心
7

Claude祭出「记忆搬家」,60秒搬空ChatGPT灵魂!70万用户退订OpenAI

Anthropic为Claude上线「导入记忆」功能,可60秒将ChatGPT上下文复制到Claude,这是对OpenAI挑衅。自奥特曼官宣国防部合作,网友抵制ChatGPT,70万用户退订,未来或出现AI记忆互通协议。

新智元
算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背逻辑推理,揭示新稀疏性分配定律。

AIGC开放社区
新闻资讯7

中国设计智造大奖作品展来了!从具身智能到智慧空间,打开未来生活想象

第十届中国设计智造大展在国美良渚校区开启,展示200余件获奖作品。展览设5大主题、打造新场景,验证新技术产业化应用,还展示增强外骨骼等案例,助力未来产业集群培育。

MANA新媒体艺术站