打新收益」共找到 3875 篇相关文章

算法论文8

扩散语言模型扛把子LLaDA迎来版本,数学、代码、对齐能力均提升

中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。

机器之心
产品应用7

文旅玩法!藏师傅教你做食物微缩景观宣传海报&视频

作者玩 Gpt - 4o 图片生成时,用食品做键盘图,又结合食物与城市做微缩场景海报,还用 Veo3 做微缩景观生长动画,给出各工具提示词,鼓励大家尝试。

歸藏的AI工具箱
产品应用7

这样更公平:用jina-reranker-m0为多模态文档分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的思考:Why We Think

北大校友Lilian Weng更博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
算法论文8

CMU朱俊彦等上LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?

近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。

机器之心
算法论文8

大模型手语翻译进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

vivo AI Lab团队针对自动手语翻译生成中,无视觉证据支撑的错误累积导致语义偏移的痛点,提出置信度感知策略优化方法CAPO-SLT,仅调整强化学习更规则,不修改主干网络,在中文手语翻译测试中拿下三项指标最高分,成果将发表于EMNLP'26。

量子位
新闻资讯7

Claude Sonnet 5 上线一日差评刷屏:不过千问和 Minimax,性价比全面翻车

Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。

AI科技评论
新闻资讯7

商汤模型 SenseNova-U1 Pro 曝光,对标 GPT-Image-2,瞄准「设计」赛道

商汤科技在股东大会预告下一代旗舰多模态基座模型 SenseNova-U1 Pro,预计 2026 年 7 月邀测,对标 GPT-Image-2,瞄准「设计」赛道,具备多核心能力,还支持 8K 分辨率输出。

AI科技评论
算法论文8

扩散模型自引导范式:直接交换token就能变强! | CVPR‘26 Oral

上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。

量子位
新闻资讯7

Midjourney副业曝光:50万个传感器藏进浴池,60秒生成你的3D身体地图

搞AI绘画的Midjourney官宣将在旧金山开Spa馆,背后是进军医疗硬件的项目Midjourney Medical。其用Midjourney Scanner做全身超声波扫描,能快速生成高精度3D身体地图,还规划了落地路径和长期扩张目标。

量子位