无数据代理模型」共找到 8891 篇相关文章

产品应用7

智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子

智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力自由与安全管控。

AIGC开放社区
开源动态8

135 个项目、七大趋势、三大赛道:撕开大模型开源生态真相,你会怎么卷?

在开发者大会密集登场之际,5月27日蚂蚁集团开源团队发布《2025大模型开源开发生态全景图》。展示135个项目、七大趋势、三大赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。

机器之心
算法论文8

AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能
推荐文章8

近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角

宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。

机器之心
新闻资讯7

直播预约 | 推理模型的“过思考”现象与高效推理,2.5h的深度分享

本期GenTalk学术分享邀请刘梓辰、齐朋辉等4位博士生,在2025年6月6日15:00 - 17:30带来“推理模型的‘过思考’现象与高效推理”报告,由夏鹤明主持,NICE学术等支持。将分析‘过思考’因素,总结高效推理思路。

深度学习自然语言处理
开源动态8

社区发布丨全面开源!商汤日日新SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日新SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还能连续性图文创作。

Hugging Face
开源动态8

AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
开源动态8

阿里杀进Agent上下文战场:钉钉聊天、企业文档、工作数据终于要被Agent吃进去了

个人、企业用户苦工作场景「上下文」久矣,Agent常不懂真实业务。阿里千问办公开源的「MyContext」,将分散工作数据加工成Agent可消费的上下文,处理多种难题,还将能力向组织延伸,助力Agent融入工作流。

量子位
算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。

新智元
算法论文8

上科大何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」

上海科技大学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。

AI科技评论