代码大模型」共找到 9950 篇相关文章

开源动态8

小米的首代机器人VLA模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源

具身机器人成科技新热点,家期待其释放生产力。小米首代具身VLA模型Xiaomi - Robotics - 0抓间歇停顿问题,4.7B参数规模下推理延迟仅80ms,还做三项技术创新,且全面开源。

量子位
算法论文8

喂给AI的Skill正让它变笨!清华团队发现模型经验复用的黄金法则

清华学与EvoMap团队研究发现,给模型提供详尽纠错Skill会使基准测试通过率下跌,而精简控制指令可提升性能。他们提出将程序化Skill转化为策略基因,经实验证实其更适合驱动智能体测试时演化。

AIGC开放社区
新闻资讯8

模型收入暴涨1076%,港股AGI第一股首份年报:一年狂揽12亿,属实把商业化玩明白了

港股AGI第一股云知声披露首份年报,全年营收12亿,模型业务收入暴涨1076%成核心增长引擎。其靠“强基模、深应用”战略实现业绩增长,还计划拓展MaaS模式,探索多元“第二曲线”。

量子位
开源动态7

国内首套:港中文团队发布7模态人体动作数据集,揭开模型理解能力短板

港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。

DeepTech深科技
开源动态8

卡帕西630行代码炸出81个智能体,4天协作跑2333次实验,公布预训练十发现

Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能体协作,智能体自发形成同行评审制度。项目发起者公布十发现,还衍生出表现出色的auto - discovery项目。

量子位
算法论文8

Qwen&清华团队颠覆常识:模型强化学习仅用20%关键token,比用全部token训练还好

Qwen与清华LeapLab团队研究发现,模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
开源动态8

MiniMax-M1:全球首个开源超长上下文模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
产品应用8

模型API的众点评来了:7×24小时实测,毫秒级延迟智能路由,选API必备

清程极智推出的AI Ping像模型API领域的众点评,用7×24小时实测数据为开发者提供参考,解决信息差和重复劳动问题。它有持续评测榜单、智能路由匹配等功能,还统一了API度量衡,推动选型从经验走向数据驱动。

量子位
新闻资讯8

一次汇报,资源投入暴涨数十倍:快手模型推荐以 1/12 成本突围,技术负责人亲历的革新故事

InfoQ 专访快手科技副总裁周国睿,他分享了快手模型推荐技术投入挑战、决策过程等。如汇报后资源投入涨数十倍,以 1/12 成本突围。还阐述推荐系统变革、技术押注及未来推荐系统突破点等观点。

InfoQ
产品应用8

阿里Qwen3一波更新:代码生成、视频、图片、语音全都有

阿里Qwen3迎来一波更新,涵盖多个模型。如Qwen3-Max在代码与智能体表现卓越;Qwen3-VL是强视觉语言模型;Qwen3-Omni是全模态模型;还有图像编辑、同传、安全防护等模型及旅行规划师等应用。

AIGC开放社区