「训练流程」共找到 2811 篇相关文章
王小川:30亿现金在手,明年IPO,toC产品马上就发
百川智能CEO王小川明确发展主线,百川开源新一代医疗大模型Baichuan-M3,在医疗评测中表现优异。公司约30亿资金,预计2027年IPO,今年将发两款to C医疗产品,重点在院外诊疗。
注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案
Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。
Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远
OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。
性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准
NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。
沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?
这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。
ICLR重磅回应:评审回滚、AC重置、封禁泄密者、严查贿赂串通
自11月27日OpenReview平台曝出重大API漏洞,ICLR 2026超10000篇投稿数据泄露,评审流程熔断。ICLR公布处理方案,回滚评审数据、重分领域主席,封禁泄密者,涉串通论文将拒稿。
五年,终于等来Transformers v5
Transformers v5发布首个RC版本v5.0.0rc0,跨越从v4到v5长达五年的技术周期。其日下载量从2万次激增至超300万次,总安装量突破12亿次。v5将PyTorch确立为唯一核心后端,聚焦四大维度进化。
Github 1.8k star Skyvern:AI直接接管鼠标键盘,3行API干掉你写了3年的脆弱XPath脚本!
Skyvern是开源AI浏览器代理,结合LLM和计算机视觉,自动执行浏览器业务流程。它用简单API复刻人工操作,替代传统脚本,解决脚本脆弱、流程复杂等痛点,功能丰富,技术优势明显,适合多业务场景。
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
大模型浪潮下,企业对AI投入加大,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。