上纬新材」共找到 5119 篇相关文章

开源动态8

DeepSeek多模态范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek线多模态并开源范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区
产品应用8

告别复杂提示词!蚂蚁方式让AI自动理解你的个性化需求

蚂蚁通用人工智能研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏好并动态更。该方法训练分两阶段,支持流式偏好推断,实验表现优异,是大模型个性化尝试。

量子位
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
新闻资讯7

AI股大爆发!甲骨文单日增长40%,创始人超马斯克成世界首富

甲骨文公布AI云业务强劲增长预期,股价单日暴涨40%,创始人成世界首富。受其带动,多只AI股涨。OpenAI将与甲骨文签3000亿美元算力采购协议,但双方合作有风险,甲骨文债务比例高。

AIGC开放社区
算法论文8

扩散语言模型扛把子LLaDA迎来版本,数学、代码、对齐能力均提升

中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务性能提升,VRPO 为扩散语言模型对齐提供框架。

机器之心
8

100 页 Agentic RL 综述!牛津、国立、AI Lab 等联合定义 LLM 下半场

2025 年大语言模型热潮持续,但当前主流训练范式显瓶颈。牛津、国立等 16 家机构学者发布 100 页 Agentic RL 综述,明确定义从‘会说’到‘会做’进化路径,剖析理论、结构与实践,展望未来挑战。

特工宇宙
开源动态7

Python只是前戏,JVM才是正餐!Eclipse开源方案,在K8s不换栈搞定Agent

近期,Eclipse 基金会在开源平台 Eclipse LMOS 推出‘代理定义语言’(ADL)。LMOS 项目旨在用统一、开放方式重构企业级 AI 代理开发与运维链路,对标专有平台与 Python 技术栈,避免企业‘推倒重来’。

InfoQ
算法论文8

CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑范式开源

当前图像编辑模型在处理概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务取得优异效果。

机器之心
推荐文章8

“每给 Claude Code 提一个请求,我就点一根烟,放松下”

OpenFGA核心维护者Siddhant Khare写博客吐槽在使用AI编程中的“疲惫感”,指出AI带来职业疲惫,如任务量膨胀、角色转变、输出不确定等,还提及行业追工具的弊端,强调工程师要设边界保护认知资源。

AI前线
推荐文章7

架构师困境:选择已被验证的道路,还是自行开辟一条路?

开发软件时,团队要做产品功能和架构决策,面临选已验证路径还是自辟路的困境。使用平台和框架虽能加快开发,但有副作用。团队需通过实验判断何时扩展或替换平台。

InfoQ