「测试时扩展技术」共找到 4723 篇相关文章
快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题
快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。
全球仅9所,清华姚班校友当选!亚马逊AI博士奖学金豪掷6800万美元
亚马逊官宣AI博士奖学金,两年共6800万美金,为全球九所顶尖大学100多名博士生提供支持,资助智能体系统等硬核方向。目前,MIT、CMU、UC伯克利公布获奖名单,多位华人学者入选。
文本已死,视觉当立!Karpathy狂赞DeepSeek新模型,终结分词器时代
DeepSeek新成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。
Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让新模型跑在N卡上
DeepSeek发布新模型DeepSeek - OCR,有诸多技术贡献,获Karpathy等盛赞。它或让文本token输入方式被淘汰。开发者Simon用Claude Code让其在N卡上运行成功,分享了详细过程与经验。
瑞能半导体王越:汽车发展浪潮中,国产SiC器件机遇何在?
瑞能半导体王越在大会演讲,剖析碳化硅器件汽车应用前景,介绍瑞能车规级SiC产品布局。电动汽车电气架构集成化、电压平台高压化,为SiC器件带来机遇,瑞能技术积累深厚,产品布局全面。
Sora2不够香了!这款国产AI视频模型已经能边看边生成,生成快还互动佳
国内AI视频玩家弯道超车,百度蒸汽机(文心专精版)开卷实时流式生成。它能边看边生成,生成快还互动佳,实现生成迅速、实时交互、无限续写,重新定义AI视频生成领域。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
OpenAI自研芯片内幕曝光!18个月前开始用AI优化芯片设计,比人类工程师更快
OpenAI与博通官宣合作,将共同部署10GW规模AI加速器。双方头头齐聚爆料合作契机与细节,OpenAI总裁称已用AI优化芯片设计,比人类工程师更快,且合作已持续约18个月。
斯坦福新论文:微调已死,自主上下文当立
斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试中表现优于多种方法。
Cursor 1.7 新增 Agent 生命周期管控钩子函数
Cursor 1.7 版本推出钩子系统,可在预定义生命周期节点拦截并修改 Agent 行为,如阻断命令、自动运行工具等。早期反馈有好有坏,虽有团队探索集成,但应用范围有限,还存在文档缺失等问题。