上科大」共找到 6393 篇相关文章

算法论文8

10步优化超越强化学习,仅需1条未标注数据!后训练强势破局

无监督的熵最小化(EM)方法仅需一条未标注数据和约10步优化,就能显著提升模型在推理任务的表现,甚至超越依赖量数据和复杂奖励机制的强化学习(RL)。EM为模型后训练提供了更高效简洁的新思路。

新智元
新闻资讯8

刚刚,百度抛出“王炸”:全球首个可商用自我演化智能体!李彦宏:技术迭代速度是唯一护城河

在百度世界,李彦宏指出产业结构不均衡问题,介绍AI产业从‘正金字塔’向‘倒金字塔’转变。百度展示内化AI能力成果,如发布数字人、重构搜索、更新秒哒等,还推出昆仑芯、文心模型5.0和全球首个可商用自我演化智能体百度伐谋。

InfoQ
算法论文8

模型「越用越快」!SpeedupLLM首次验证,降56%推理预算

Emory学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。

新智元
6

出海AI工具,一定要付费,订阅,年付订阅!

AI工具的付费订阅模式能为网站带来持续稳定的收入,通过胆尝试年付订阅,可以显著提升MRR。

哥飞
新闻资讯7

LeCun出局,Meta变天!Llama 4翻车清洗,「学院派」败退

LeCun宣布年底离开效力12年的Meta,创立专注「世界模型」的AI公司。Llama 4翻车成其离职导火索,他的离去意味着学院派在Meta的AI战略中被边缘化,也预示硅谷AI路线之争进入新阶段。

新智元
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理模型与普通模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考

随着推理模型和思维链普及,模型有了‘深度思考’能力,但现在有些偏,简单任务也复杂化。AI牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,模型发展不能只追求分数。

机器之心
开源动态8

北交开源 CutClaw,自动踩点音乐的 AI 智能视频剪辑师!

湾区学GVC实验室和北京交通学团队开源CutClaw,它是模拟专业后期流程的多智能体系统,能实现音乐驱动剪辑,按文字指令自动剪辑,适配多平台,还可解构素材。操作简单,支持多模型。

开源星探
新闻资讯7

太卷了!专属Coding的新一代Arena榜单来了,有国产模型登榜首

模型编程竞争激烈,编码能力提升成军备竞赛。LMArena发布新世代模型编码评估系统Code Arena,国产模型智谱GLM - 4.6登榜首,其编码能力获认可,彰显国产模型硬核实力。

机器之心
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让模型学会反思总结。模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为模型推理难题提供了解决方案。

AIGC开放社区