全栈式优化」共找到 2931 篇相关文章

算法论文8

强化学习远不是最优,CMU刚刚提出最大似然强化学习

CMU等机构研究指出,现实中广泛使用的强化学习未真正做最大似然优化,只是优化其一阶近似。基于此,团队提出最大似然强化学习,实验显示其在性能与计算效率权衡上优于现有方法。

机器之心
算法论文7

估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」

新智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出新范式,为训练大模型提供新思路,还介绍了流形优化器及相关算法。

新智元
新闻资讯7

FUTURUS未来黑科技徐俊峰:侧翼突围,构建AR栈解决方案|甲子光年

2026崇礼论坛上,FUTURUS未来黑科技徐俊峰指出AI产业面临瓶颈,创业者应‘侧翼突围’。他认为以汽车挡风玻璃为介质的AR技术是数据闭环关键切口,还描绘了AR栈解决方案赋能车厂的商业蓝图。

甲子光年
新闻资讯8

Veo 3逼真脱口秀爆火网,网友:彻底超越恐怖谷!Sora已被完爆

Veo 3生成的脱口秀视频网爆火,人物、场景真实,声音和嘴型能对上,已超越恐怖谷。它或让人类进入‘模糊时代’,还会颠覆游戏、电影、广告等行业,未来AI生成内容或远超非AI内容。

新智元
新闻资讯8

Gemini 2.5 Pro强势更新并霸榜,Claude 3.7首次遭遇方位碾压!

Google DeepMind推出的Gemini 2.5 Pro在LMArena各大排行榜面登顶,实现文本、视觉、Web开发方位霸榜,编码能力也大幅升级。虽有质疑,但短期内难有对手,还引发对Google I/O大会更多惊喜的期待。

AGI Hunt
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
产品应用8

Gemini 3.0还在预热,中国AI抢先!30秒造APP网首测

谷歌Gemini 3.0预热时,国内新生AI神器蚂蚁灵光上线。它能30秒造APP,实现“生成涌现”落地,以闪应用开启范式革命,用信息美学融合模态,探索“摄像头+AI”新形态,让普通人提前感受未来AI世界。

新智元
产品应用8

华为超节点:用「一台机器」的逻辑,驱动AI万卡集群

在华为联接大会2025上,华为基于自研灵衢互联协议创新超节点架构,重新定义大规模有效算力新范式。它能解决传统集群通信问题,还推出覆盖场景的产品组合,并强调‘硬件开放、软件开源’生态战略。

机器之心
开源动态8

流式数据集:效率提升 100 倍!

现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。

Hugging Face
开源动态8

浙大联合北大开源 Easel:一个 Agent 包办社媒链路,从热点发现到多平台发布!

浙江大学和北京大学联合开源Easel,这是面向社媒创作者的内容工作台,用一个Agent打通链路,有画像驱动等六大亮点,还给出清晰的快速上手流程。

开源星探