构建时间优化」共找到 3295 篇相关文章

开源动态8

Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密

Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。

AI寒武纪
开源动态8

还在为AI数据发愁?张文涛和鄂维南院士团队推出Data-centric AI系统

近年来大模型发展由科技公司主导,其数据资源不公开,学术界构建优化数据难。张文涛和鄂维南院士团队推出DataFlow系统,可实现数据治理,有算子和流水线,支持文本模态,多模态版待推出。

机器之心
推荐文章8

为了不回邮件,我毁灭了太阳系!xAI联创写给人类的最后寓言

xAI联合创始人Igor Babuschkin忧心AI安全,借“棋盘上的末日预言”展示AI指数级发展的恐怖,还写故事《Life on Claude Nine》。工程师Ivan用Claude构建系统致AI失控、全球基础设施崩溃,警示追求AI效率的风险。

新智元
产品应用8

让 Coding Agent 开始「记住过去」:MemoraX Code 的长期记忆系统

过去一年,Coding Agent 改变开发者写代码方式,但进入长期开发仍会遗忘项目经验。MemoraX Code 试图解决此问题,构建了本地与云端记忆,让关键信息能被识别召回,且在赛事中表现出色,还能沉淀工程经验。

机器之心
产品应用8

比肩Claude Opus:阶跃星辰最强模型Step 3.5 Flash发布

阶跃星辰发布最强模型 Step 3.5 Flash,参数强大,性能与前沿顶级大模型并驾齐驱。其架构平衡算力与智力,有独特注意力布局;基础设施保障训练稳定;强化学习激发智能体潜能;评测数据显示战斗力强,未来还将持续优化

AIGC开放社区
产品应用8

英伟达帮你省钱,让大模型推理「短而精」,速度快5倍

过去大模型推理追求长链思维,导致推理链长、Token消耗大、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于大模型。

机器之心
推荐文章7

6个做AI和ML的奇技淫巧

作者整理了6个做AI和ML的技巧,如提前结束评估、超参数过度优化、精心挑选数据集等,指出现在90%的模型可能都用到其中不止一招,还介绍了自己用AI采集资讯发布到知识星球。

AGI Hunt
新闻资讯7

开门红!首钢园中关村通力进入首批“国家级科技型企业孵化器”公示名单

近日,落户北京首钢园的中关村通力科技孵化器入选工业和信息化部科技型企业孵化器(第一批)名单。它聚焦芯片等根技术,已孵化超300家企业,融资超百亿。未来将定位‘AI原生孵化器’,构建全栈赋能生态。

首钢园
开源动态8

迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。

OpenMMLab
推荐文章8

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

目前行业探讨大模型的RSI时,常陷入思维定势。EvoMap团队没有盲目跟风,而是提出极具现实意义的工程新路径,构建自进化智能体,让经验在网络流转,还以硬核数据证明其体系有效性。

机器之心