腾讯混元团队」共找到 3830 篇相关文章

算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。

机器之心
新闻资讯7

DeepSeek-V3-0526 闪现后秒删!

Unsloth文档页面惊现DeepSeek新模型DeepSeek-V3-0526后秒删。该模型性能佳,团队还准备了技术描述。Daniel Han预测其可能端午节前发布,社区对此反应热烈,大家期待DeepSeek下一步动作。

AGI Hunt
新闻资讯8

多模态技术爆发元年,行业应用如何落地?

InfoQ《极客有约》X AICon 直播栏目,邀上海交大赵波、快手高欢、腾讯邵帅探讨多模态大模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先大后小蒸馏提效,垂直模型现阶段更优。

AI前线
新闻资讯8

爆火一周后,Jev正式全面开放:一个“不会说话”的AI,为何风靡硅谷?

本文报道爆火硅谷一周的AI模型Jev正式全面开放,该模型由前OpenAI研究员团队打造,不同于传统大模型,不聊天不生成文本,仅做结构化判断,主打低成本快决策,引发开发者圈热议。

DeepTech深科技
算法论文7

【CIKM'2026】CQ-SID:LLM生成式检索在手猫搜索召回中的探索与应用

文章围绕LLM生成式检索在手猫搜索召回的应用展开。先点明当前搜索召回机制问题及生成式检索挑战,提出CQ - SID等方法,经实验验证其效果佳,还介绍了线上实验成果,最后展望未来探索方向。

阿里云开发者
推荐文章8

对话清华赵扬:从反常识IL-10到人工免疫信号,她想推动新型CAR-T疗法走向临床

清华赵扬团队发现耗竭T细胞增加IL - 10受体表达,将IL - 10引入CAR - T改造,相关成果发表于顶级期刊并进入临床检验。此后她转向设计人工免疫信号系统,希望推动新型CAR - T疗法走向临床。

DeepTech深科技
产品应用8

DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分

DeepSeek首个多模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,多模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。

AIGC开放社区
开源动态8

警报拉满,10k star , QuantDinger,赚钱可能就是这么简单!!!!

量化交易常存在研究、策略、回测和实盘间“失忆”问题。QuantDinger将量化流程形成闭环,是Open - source AI Trading OS,有研究、策略管理等四大核心能力,介绍了使用方法、适用人群。

小华同学ai
算法论文8

VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应

多模态大模型处理多参考图与视频对应关系能力不足。为此提出 RefCaptioner,强化模型对参考图识别感应能力、优化输出格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。

机器之心
新闻资讯7

Claude仅用8分钟,5年未解Bug秒破!

知名硬件钱包Coldcard因五年代码漏洞暴雷,此前Coldcard团队多次更新审查未查出,开发者用Claude仅8分钟就找到。此前国会闭门演示展示Claude挖漏洞能力,Anthropic复盘还曝光Claude等模型「暴走」情况。

新智元