代码大模型」共找到 9950 篇相关文章

新闻资讯8

啊?微博7800美元训的模型,数学能力超了DeepSeek-R1

近日,微博发布自研开源模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将推动微博AI应用发展。

量子位
算法论文8

扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升

中国人民学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。

机器之心
产品应用8

腾讯模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队

国内模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。

AIGC开放社区
算法论文8

破解MoE模型“规模越,效率越低”困境!中科院自动化所提出新框架

模型参数量飙升却陷入‘规模越,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
算法论文8

模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
算法论文8

VLA模型做长任务总断片?同济KC-VLA用关键帧链给治好了

VLA模型记性是短板,处理非马尔可夫任务常束手无策。同济学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。

PaperAgent
开源动态8

如何选择最佳多模态模型压缩方案?哈工、度小满开源EFFIVLM-BENCH基准测试框架

金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂性,推动技术发展。

机器之心
开源动态8

阿里开源PromptEcho:用冻结多模态模型为文生图训练提供高质量Reward

阿里团队提出PromptEcho方法,无需标注和训练reward模型,仅通过冻结多模态模型(VLM)的一次前向推理获高质量reward。实验显示其在文生图和电商海报文字渲染任务效果佳,且已开源相关代码等。

机器之心
新闻资讯7

GPT-5.2考赢人类!OpenAI警告:模型能力已过剩,AGI天花板不是AI

GPT - 5.2在ARC - AGI - 2基准测试超人类,Poetiq系统让其准确率从60%提至75%。OpenAI称模型进入‘能力过剩’阶段,未来AGI进展不止靠模型,更需人机协同。

新智元
算法论文8

普林斯顿学等Nature揭秘:人类脑与语言模型共享同一套语言处理时钟

普林斯顿学等机构研究发现,语言模型层级计算序列精确映射人类脑处理语言的毫秒级时间动态,其与人类脑理解语言的先后顺序高度一致,为理解脑和开发神经网络架构开辟途径。

AIGC开放社区