大语言模型」共找到 9290 篇相关文章

产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的社会实验

YuLan-OneSim是大语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
算法论文8

读万卷书,模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中科等机构团队综述将现有研究划分为模块化、顺序、统一三架构集成范式,并指出未来研究方向。

机器之心
新闻资讯8

连续发布两款万亿参数模型,蚂蚁 AI 来势汹汹

国庆期间模型行业热闹非凡,各团队产品侧重不同。蚂蚁百灵模型团队在十天内连续发布并开源两款万亿参数模型 Ling-1T 和 Ring-1T-preview,引发关注。万亿参数模型难训,国内达到此规模的屈指可数。Ling-1T 综合性能出色,应用场景广泛。蚂蚁选择开源,意在构建开放 AGI 生态。

AI科技评论
开源动态8

小红书发布FireRedChat:首个可私有化部署的全双工模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
产品应用7

从被吐槽“套壳中国模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍

10月29日,Cursor 2.0发布Composer模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。

InfoQ
算法论文8

定位模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆

此前学术界发现模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。

量子位
产品应用8

腾讯AngelSlim重磅升级!面向全模态的模型压缩算法工具包,推理速度飙升 1.8倍!

近年来,推理阶段的成本等因素制约模型规模化应用。腾讯混元升级的 AngelSlim 围绕 Eagle3 投机采样训练范式构建系统化实现,支持多模态场景,最高可实现 1.9× 推理加速,还具备多亮点。

腾讯技术工程
新闻资讯7

全球首个 IPO 模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股

12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于模型研发,还引入多家基石投资者。

InfoQ
新闻资讯8

百川开源医疗模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park