新能安」共找到 7855 篇相关文章

开源动态8

OpenAI去年挖的坑填上了!奖励模型首现Scaling Law,1.8B给70B巨兽上了一课

奖励模型「POLAR」采用对比学习范式,摆脱对海量人工标注依赖,有强大Scaling潜力。它衡量训练与目标策略「距离」作奖励信号,用自动化合成数据预训练,小模型超越大数十倍规模对手。

新智元
算法论文8

数学推理热潮下的冷思考!如何训练真正"全"的推理模型?

论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智体提供路径。

深度学习自然语言处理
算法论文7

【CIKM'2026】CQ-SID:LLM生成式检索在手猫搜索召回中的探索与应用

文章围绕LLM生成式检索在手猫搜索召回的应用展开。先点明当前搜索召回机制问题及生成式检索挑战,提出CQ - SID等方法,经实验验证其效果佳,还介绍了线上实验成果,最后展望未来探索方向。

阿里云开发者
产品应用7

LibTV这个邪修功,大大减少AI视频抽卡次数!

作者分享在LibTV用「深度动作捕捉」功做AI视频,将视频动作提取成深度图,可减少AI视频生成失败率,且不花积分,深度图管几何,提示词管外观,提一次用多次。

花叔
产品应用7

Karpathy头疼的“AI游戏困境”,被这款15分钟出包的国产神器破解了

8月初Andrej Karpathy指出通用AI做游戏时,LLM无法高效审查工作的弱点。而国产平台Spellcaster先解析自然语言确定游戏设计,15分钟出包,还内置测试员验证,团队想工程化落地方向。

AI寒武纪
产品应用7

实测updream预演台:一张图,换来一整个3D片场!

作者实测updream预演台,它可传图自动重建3D白模场景,可摆人物、调机位等,再配合Seedance 2.5渲染成片。作者还做了对照实验,证明白模锁定拍摄意图,并给出使用建议。

花叔
开源动态8

具身智的Skill时刻!英伟达开源机器人技库,Jim Fan:范式变了

英伟达开源让机器人持续成长的技库ASPIRE,类似机器人版Coding Agent,会沉淀机器人操作经验。英伟达机器人主管Jim Fan称其代表全持续学习范式,论文实验验证其效果好于此前方法。

量子位
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性表现出色。

PaperAgent
开源动态8

断网可用!首款全双工全模态大模型技术报告发布,附一键装包

面壁智等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧装包等,低显存GPU即可运行,性表现优秀,应用潜力大。

新智元
新闻资讯8

从工具到生命形式:OpenClaw 引发的 Agent 再思考

InfoQ《极客有约》X QCon 直播聚焦 OpenClaw 落地难点。嘉宾探讨其验证的价值、生产级形态、落地难题等,还谈及 AI 与人类共生关系、记忆系统问题及解决方案,最后分享企业落地经验和会议信息。

InfoQ