「模型生态」共找到 8263 篇相关文章
美国开源被中国甩在身后,套壳创业者更遭惨烈清算!OpenRouter CEO:天天乱用高价AI的员工要小心了
顶级科技播客20VC访谈OpenRouter联合创始人兼CEO Alex Atallah。他指出美国开源大模型落后中国,企业怕依赖巨头,AI时代员工成本应动态化,还探讨了模型生态、路由技术等行业热点。
时隔9个月Meta全新模型Muse Spark发布:闭源,原生多模态,一发布就落后?
时隔9个月,Meta推出Muse家族首款大模型Muse Spark,原生多模态推理,但能力表现一般,编程领域落后于opus 4.6和GPT 5.4等。它有沉思模式,致力于成个人超级智能,技术亮点多,性能高效。
把20亿参数装进胸针?高通补齐了个人AI生态的最后一块拼图
在MWC巴塞罗那展会上,人们渴望专属AI智能体。高通认为AI须进驻微型载体,推出骁龙可穿戴平台至尊版,将AI运算能力延伸到微型设备,其还构建以用户为中心的生态,让私人助理融入生活。
大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?
大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、长上下文和多模态直接读图等因素。
英伟达为机器人推出懂推理的“大脑”!升级版Cosmos世界模型来了
在SIGGRAPH大会上,英伟达推出全新升级的Cosmos世界模型,重点升级规划能力与生成速度。还升级配套软硬件,如Omniverse库等。英伟达全力布局机器人领域,认为图形与AI融合将变革该领域。
揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估
文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。
大模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了
在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。
一年前让英伟达蒸发6000亿,一年后被老黄搬上PPT
北京时间1月6日,黄仁勋在CES 2026上展示Kimi K2、DeepSeek V3.2、Qwen等中国模型。此前英伟达因谷歌、Meta等对手的冲击市值蒸发。老黄花200亿美元挖人,用中国开源模型反击,构建开放生态。
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
香港科技大学研究发现,大模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。