线性扩展效率」共找到 1686 篇相关文章

开源动态8

罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年

大模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。

甲子光年
算法论文8

SIGGRAPH Asia 2025 | OmniPart框架,让3D内容创作像拼搭积木一样简单

香港大学等机构研究者推出OmniPart框架,解决3D内容创作难题,已被SIGGRAPH Asia 2025接收。它将生成任务解耦为两阶段,保证部件独立又能完美组合,质量和效率超现有方法,应用潜力大。

机器之心
产品应用8

「双线实测」Qwen 3.6-Plus,Agentic Coding 已经这么能“扛活儿”了?

4月7日阿里云通义千问Qwen3.6-Plus上线,作者用两套真实复杂任务评估其智能体能力。结果显示它在复杂决策和编码任务表现出色,有工业级交付水准,但也有首字延迟等短板,且参数效率优势明显。

AI科技评论
新闻资讯8

Ilya的首个模型来了!

掌握内幕的草莓哥爆料,Ilya正构建以TTT为核心的小型推理引擎。他预见传统大模型的死穴,SSI将TTT概念落地,其引擎在数据效率等方面优势明显。SSI获投资,本月或发新模型。

新智元
开源动态8

英伟达新架构引爆全模态大模型革命,9B模型开源下载即破万

英伟达推出全模态大模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
新闻资讯8

光刻机巨头变身AI金主,Mistral AI成欧洲估值最高初创企业

法国初创公司Mistral AI在2025年9月完成20亿欧元融资,估值达140亿美元,成欧洲估值最高科技初创企业,由阿斯麦牵头投资。该公司技术实力强,模型参数效率高、架构创新,还注重开源和多语言支持。

AIGC开放社区
开源动态8

狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探
8

实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子

实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。

开源AI项目落地
算法论文8

大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”

近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。

深度学习自然语言处理