大模型开发」共找到 10003 篇相关文章

新闻资讯7

突发!微软与OpenAI同日开火:语音之战+通用模型,AI霸权决战打响

OpenAI发布语音模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为与OpenAI谈判增加筹码。

新智元
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布模型版类GAN训练法

康奈尔学团队提出面向语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心
算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
开源动态7

开源多模态模型EarthMind,观测地球统一框架

地球观测数据复杂,现有多模态模型难适用。意利、德国多所高校研究人员联合开源多模态模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。

AIGC开放社区
算法论文8

700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆模型推理

今年6月Sapient Intelligence提出的HRM影响模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试中超越参数多10000倍的模型,还介绍了TRM原理、改进及实验结果。

机器之心
开源动态8

写Verilog、调CUDA,总翻车?工业代码模型开始学会「先想后写」了

工业代码模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
新闻资讯7

DeepSeek 新模型曝光,即将发布

据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。

AGI Hunt
算法论文8

知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳

东南学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。

量子位
新闻资讯7

Cursor“自研”模型套壳国产开源?网友:毕竟好用又便宜

美国顶流AI产品Cursor和Windsurf发布新模型,被指“套壳”中国开源模型。Cursor新模型干活时说中文,Windsurf或用智谱GLM。中国开源模型物美价廉,在榜单和下载量上表现出色。

量子位
算法论文7

只因一个“:”,模型全军覆没

一篇论文发现冒号等符号、“Thought process:”等语句能欺骗LLM,让虚假回答通过。实验表明所有测试模型都会触发假阳性响应。研究人员构建新“评委”模型Master - RM,可让假阳性率接近0%。

量子位