「设计到代码」共找到 4496 篇相关文章
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1
NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。
小米罗福莉:MiMo-V2.5如何做到又快又强又便宜? | ICML 2026
2026年7月ICML大会上,小米MiMo团队负责人罗福莉介绍MiMo - V2.5系列。该系列跳出传统思路,从架构、训练、推理协同设计,实现“聪明、快速、便宜”,如预训练降成本、后训练有硬核算法、推理加速达1000 TPS。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
首个国产开源AI原生后端,不再写后端,AI就是全栈工程师。
Aipexbase是首个国产开源AI原生后端即服务平台,能在AI辅助下完成前后端一体化开发。开发者无需编写后端代码,通过前端SDK或MCP一键调用后端能力,适配国内生态,定义了AI原生开发新模式。
马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费
近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。
20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛点
国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛点,与DeepSeek构想契合,或成大模型专用架构分水岭。
停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它
这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。
VerseCrafter:给视频世界模型装上4D方向盘,精准运镜控物
复旦大学与腾讯等机构提出VerseCrafter,这是通过显式4D几何控制实现的动态逼真视频世界模型,能精准控镜和指挥物体3D运动。它用独特方法构建4D可控世界模型,实验超现有SOTA方法,代码与模型已开源。
腾讯混元AI开源3D世界生成模型!文图即可生成3D沉浸式场景!
腾讯混元AI实验室开源HunyuanWorld 1.0,这是业界首个支持沉浸式、探索性和交互性3D世界生成的全开源模型。它能通过文图生成3D场景,为多领域提供支撑,还给出安装和代码使用示例。