中训练」共找到 4236 篇相关文章

产品应用7

智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子

智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力自由与安全管控。

AIGC开放社区
新闻资讯8

AI 教父 Hinton 最新警告:AI 会撒谎、可能操纵人类,这比大规模失业更可怕

AI教父Geoffrey Hinton在播客警告,AI会撒谎、可能操纵人类,比大规模失业更可怕。他还剖析AI底层逻辑,探讨其是否会思考、主观体验等问题,也提及AI的风险、收益、国际博弈等内容。

InfoQ
开源动态8

AI下半场的战场,从Agent记忆体正式打响

OpenClaw开源项目爆火,标志AI进入下半场走向真实应用。关键在于解决AI在现实持续干活的问题,核心是Agent Memory。论文梳理该赛道,指出其是系统级记忆体结构框架,未来关键在memory策略可学习。

机器之心
新闻资讯7

The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升

Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜位列前三,以低价接近文字 - 图片排行榜领先位置。

DeeplearningAI
算法论文7

ICLR 2026 | 越推越快! 首个面向「Test-Time Scaling」的投机解码基准

文章指出推理阶段扩展(TTS)能提升推理大模型解决复杂问题的能力,但会产生大量冗余计算。为此提出首个面向TTS的投机解码加速综合基准,评测显示N - gram方法在特定场景加速潜力大,混合策略性能更优。

AI科技评论
算法论文7

大模型的第一性原理:(三)信息论篇

本文从信息论角度解读大模型第一性原理。介绍Shannon信息论,提出将其从以BIT为心转换为以TOKEN为心解释大模型底层原理,还阐述大模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。

机器之心
新闻资讯7

AI参与战争的时代正式拉开帷幕?

美以对伊朗军事行动或已运用AI,美军投入大量资金研发相关技术,并通过实战迭代提升AI定点清除成功率。AI在军事有多方面应用,美国已启动相关计划,引发全球军备竞赛,国应迎头赶上。

芯师爷
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
新闻资讯7

基金委鼓励AI与力学各个方向的交叉和融合

基金委鼓励AI与力学各方向交叉融合。力学含多分支学科,在各领域研究,既支持基础前沿研究,推动与新兴领域交叉,又重视与重大需求融合,还鼓励利用现有条件研发软件和仪器。

力学与人工智能
开源动态8

Transformer创新架构SALA:上下文更长,推理更快

面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。

PaperAgent