硬件自研」共找到 1528 篇相关文章

开源动态8

能让DeepSeek进化的Harness!LlamaFactory作者开源新工具:0.2元动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent进化的Harness,能动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
新闻资讯7

语言模型内部还藏着众多策略模型?底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出底向上强化学习策略,为究架起新桥梁。

深度学习自然语言处理
算法论文8

大模型如何泛化出多智能体推理能力?清华提出策略游戏博弈方案MARSHAL

近日,清华大学等机构究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
算法论文8

回归更灵活、比离散扩散更通用,首个纯Discrete Flow Matching多模态巨兽降临

近年来多模态大模型多采用回归架构,推理缺乏灵活性。香港大学和华为诺亚方舟实验室究团队提出FUDOKI,基于全新非掩码离散流匹配架构,能并行去噪、动态修正,为多模态模型开辟新路径。

机器之心
新闻资讯8

百川开源医疗大模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗大模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park
算法论文8

微信、清华连续回归模型CALM,新范式实现从「离散词元」到「连续向量」转变

腾讯微信 AI 联合清华提出连续回归语言模型 CALM,它将语言建模为连续向量而非离散词元,显著改善性能与计算成本权衡,解决了 LLM 效率瓶颈,虽面临技术挑战但实验效果佳,还指明未来究方向。

机器之心
开源动态7

一周斩获8k星!港大开源AI学习助手,学练全流程覆盖,教师也要失业了?

港大开源的DeepTutor是AI个性化学习助手,利用多智能体协作等技术,有文档问答、难题解析等四大核心功能,能构建专属知识库,提供全流程辅导,为学、练、打造一体化平台。

开源AI项目落地
开源动态8

蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和回归模型标杆vLLM,代码已开源。

AIGC开放社区
算法论文8

LLM工业级进化:北邮与腾讯AI Lab提出MoE-CL架构,解决大模型持续学习核心痛点

北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。

机器之心
产品应用7

写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」

在全动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如写驱动绕过限制等,但也存在不验证假设等局限。

AI寒武纪