大厂自研」共找到 5843 篇相关文章

新闻资讯8

对话八位具身智能咖:模型之争、数据来源与第一性原理|甲子光年

在11月20日智源具身OpenDay上,甲子光年创始人张一甲与八位具身智能领域核心践行者对话。探讨世界模型、统一架构等问题,指出具身智能虽前景好,但面临数据、模型等困境,各方分享应对策略与决策原则。

甲子光年
推荐文章7

AI 基础知识从 0.6 到 0.7—— 彻底拆解深度神经网络训练的五核心步骤

文章以 PyTorch 手写数字识别代码为引,深入剖析深度神经网络训练的五核心步骤,涵盖前向传播、计算损失、反向传播、更新参数和循环训练,还介绍激活函数、Dropout 等概念及正则化、优化器等技术。

阿里云开发者
算法论文8

腾讯发布模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。

腾讯技术工程
算法论文8

用「进化+压力测试」动生成的竞赛级编程题,各家模型谁更hold住?

北京学与通用人工智能研究院联合提出 UniCode 框架,构建进化式评测系统,能动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心
新闻资讯7

老黄玩Nano Banana上瘾,拉着哈萨比斯夸特夸,“不会有人不喜欢吧?”

英伟达CEO黄仁勋公开宣称是Nano Banana的忠实粉丝,还向DeepMind CEO哈萨比斯夸特夸。他也常用多种AI工具处理事务,提升效率。Nano Banana有新玩法,让Gemini走红,拉下ChatGPT下载量榜首。

量子位
算法论文8

图像分词器造反了!华为 Selftok:回归内核完美统一扩散模型,触发像素主推理

华为盘古多模态生成团队推出 Selftok 技术,通过反向扩散将回归先验融入视觉 token。它突破传统,实现因果 token、强化学习友好型 token 及纯 AR 一统架构,实验在多方面表现优异,论文还入选 CVPR 2025 最佳候选。

机器之心
新闻资讯7

印度国家级模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国学生模型都有20万!

印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 研究突破,支持 10 种印度本地语言,但上线两天仅 334 次下载,投资人批评其成果‘令人尴尬’,引发社区激烈争论。

InfoQ
新闻资讯8

新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪

2025年9月7日新智元举办十周年峰会,主题为「新天终启,万象智生」,汇聚多位重量级嘉宾探讨AI前沿突破。当下AI发展迅猛,模型密集发布,如OpenAI的GPT - 5、谷歌的Gemini 2.5等,中国造模型也在开源领域领先。

新智元
算法论文8

EMNLP25 | "模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式

本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用模型成本高的问题。

深度学习自然语言处理
开源动态8

智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节公开

上个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术报告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了在多任务上的表现。

机器之心