在离线混部」共找到 8196 篇相关文章

算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
新闻资讯7

Kimi K2里找到了DeepSeek V3架构

Kimi新模型K2热度高,多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2前端制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。

量子位
算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
新闻资讯7

10岁寒武纪,迎来好日子

常年亏损的寒武纪2024年四季度和2025年一季度连续单季盈利,2025年一季度营收同比大增4230.22%。其云端产品线贡献大,受益于英伟达芯片出口受限。不过,它生态和战略上与英伟达有差距,还面临诸多竞争。

芯师爷
开源动态8

预训练就学会思考!字节、北大等用14亿参数,撬动百亿模型推理能力

字节、北大等联合发布Ouro模型,用14亿参数实现百亿级模型推理能力。它预训练阶段学会循环思考,通过三大创新构建推理能力,基准测试中表现优异,实现参数效率提升,是潜推理范式的胜利。

AIGC开放社区
产品应用8

Listen Labs:把用户研究“黑灯流水线”化,AI Agent 系统实现小时级洞察

Listen Labs由两位哈佛校友2024年底创立,2025年4月获2700万美元融资。今年2 - 5月发布三项核心能力,可实现全流程自动化深访。文章详解其如何实现小时级交付,分析竞争态势与优势,也指出未来待改进处。

海外独角兽
新闻资讯7

伯牙智能创始人兼CEO刘欣:灵巧手重塑具身智能|甲子引力X

2024年4月28日,「AI共潮生—2025甲子引力X科技产业新风向」大会举办。伯牙智能CEO刘欣分享称,AI物理世界赋能需灵巧手,其操作发展尚处初期,有软硬件挑战,还提出对数据及触觉传感能力的新思考。

甲子光年
算法论文8

V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其视频生成和预测上性能出色。

机器之心
产品应用8

昨晚,OpenClaw大更新,亲手终结「旧插件」时代

昨晚OpenClaw重大版本更新,内容多到需单独做目录梳理。重点ClawHub插件市场、多模型支持等。最重要变化是插件生态重心转向,且体系大改、工具能力收敛,还多方面有更新,创始人指出正式版有功能加载问题。

机器之心
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,多学科专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂科学的AI助手。

GiantPandaLLM