「推理性能」共找到 3456 篇相关文章
英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型
英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。
Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局
Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合多种控制信号,实验效果良好。
手机也能跑,腾讯混元一口气开源4款小模型
腾讯混元团队开源4款小模型,最大7B。可在低功耗场景运行,支持微调。是融合推理模型,有快、慢思考模式,在多领域表现出色,亮点是agent和长文能力,已落地多元业务场景。
我们用飞书开了个选题会,一下进入现代化办公,编辑部直呼:真香
2025年飞书未来无限大会上,飞书发布和升级诸多产品。如达M3标准的知识问答,可秒搜文档;达M4标准的飞书会议,支持声纹识别。多维表格性能提升、应用构建升级,还有AI工具全家桶。
为什么我觉得AGI并不会马上到来
作者Dwarkesh Patel认为AGI不会马上到来。当前大语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。
DeepSeek V4正式版太便宜辣!5毛钱做出3D射击游戏,网友直呼绷不住
DeepSeek V4 Flash正式版API上线公测,其价格便宜得离谱,如0.07美元就能制作第一人称3D射击游戏。与Claude Opus 5、GPT - 5.6等对比,功能相近但成本低很多。它靠MoE架构等降低成本,还提升了性能。
AAAI 2026|新突破:北大彭宇新团队提出可见光-红外终身行人重识别方法CKDA
终身行人重识别有重要应用价值,但现有方法在学习特定模态新知识时,会阻碍跨模态公共旧知识保留。北大彭宇新团队提出CKDA方法,解耦并净化不同模态信息,实现跨模态知识权衡,在相关基准上取得最优性能。
说句话,造个3D世界!腾讯VibeWorlding氛围造世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
全行业的「龙虾热」中,什么是AI Infra下半场的「神之一手」?
OpenClaw爆火,标志AI进入「自主执行时代」,但面临安全、资源利用和并发规模等挑战。腾讯云Agent Runtime为企业级AI智能体打造专业支持,解决状态管理和行为治理难题,还助力MiniMax突破性能瓶颈。