「大模型3.0」共找到 10199 篇相关文章
1万亿参数Ling-1T开源,国产LLM牛了~
Ling-1T是Ling 2.0系列首款旗舰“非思维”模型,总参数量达1万亿。预训练数据超20万亿token,支持128K上下文长度。在多项任务中表现出色,是目前已知最大的FP8训练基座模型,已完成全面评测。
deepseek v4.1? 梁圣的端午礼物突袭。
群里小伙伴称deepseek官方灰度新模型,手机和web端Flash模型思考模式大变,典型bug修复。测试发现幻觉严重,知识库截止大概25年6月。同时,deepseek获500亿首轮融资,梁文锋自掏200亿,投资方无投票权,五年锁定期。
骂战半年、站队失效,具身智能公司集体换了“新剧本”,VLA“自救”成功了吗?
2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索新架构,具身智能无完整技术路线图。
边画边想!多模态Reasoning迎来巨大提升!
论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。
AI制造AI、仓库级Coding到Agent底座:2026奇点智能技术大会首批议题公布
2026 奇点智能技术大会将于 11 月 20 - 21 日在北京举行,同期还有 C++ 及系统软件技术大会。大会公布首批核心议题,涵盖 AI 制造 AI、AI Coding、Agent 基础设施、世界模型、具身智能等前沿技术,多位专家将分享实践经验。
Claude Code 究竟牛在哪里?(以及如何在你的 AI 智能体中复刻它的魔法!)
文章介绍Claude Code是出色的AI智能体,比Cursor等好用。它设计简单,提示词和工具弥补模型缺点。作者基于使用经验,给出打造类似智能体的要点,包括控制循环、提示词、工具和可引导性等方面。
5张 H800 带来 20 FPS 高保真实时虚拟人生成
传统扩散模型做视频生成速度慢、画面不稳定,难用于实时虚拟人场景。阿里Live Avatar框架将算法和系统一起设计,用TPP并行推理策略和RSFM机制等,5张H800 GPU能实现20 FPS高保真实时虚拟人生成。
超越GPT-4o!华人团队新框架让Qwen跨领域推理提升10%,刷新12项基准测试
加拿大滑铁卢大学与TikTok新加坡的华人团队提出全新训练框架General - Reasoner,让Qwen系列大模型跨领域推理准确率提升近10%,在多项基准测试中超越GPT - 4o。该框架有全领域推理数据集和生成式答案验证器两大创新。
14B打败671B!微软rStar2-Agent在数学推理上超过DeepSeek-R1
如今的大语言模型推理能力关键在于测试时扩展,但长思维链有局限。微软研究团队用主动式强化学习探索,成果 rStar2 - Agent 方法训练出 14B 的 rStar2 - Agent - 14B 模型,性能超 671B 的 DeepSeek - R1。
CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样
扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。