大模型开源」共找到 10166 篇相关文章

开源动态8

Agent记忆赛道洗牌!LoCoMo-Refined重磅发布,主流记忆框架迎来核心检验

南京学与上海人工智能实验室联合推出 LoCoMo-Refined,这是严苛的 Agent 记忆评测基准。它指出当前记忆评测基准有两漏洞,在其标准下主流记忆框架得分普降,且相关数据集和评测脚本已开源

AI科技评论
开源动态8

当Sora 2意外停摆,这个国产视频生成创业团队,直接「开源」三连击

OpenAI叫停Sora 2项目,同期北京AI初创公司Sand.ai在GitHub连续三天开源核心技术栈,包括音视频同出模型、分布式Attention组件、全局编译框架,还介绍了团队和产品,展现全栈实力。

机器之心
开源动态8

7.3K Star!港开源神作,集问答、可视化、出题于一身的 AI 超级导师!

香港学 HKUDS 开源的 DeepTutor 是爆火的个人学习助手,集文档问答、可视化讲解、智能出题、深度研究于一体,解决自学痛点,还给出了快速入手步骤。

开源星探
产品应用8

告别卡脖子,华为黑科技破局!昇腾推理加速1.6倍打破LLM降智魔咒

模型参数规模,推理部署难。华为诺亚提出Pangu Light框架,结合算法创新与国产昇腾平台,通过跨层注意力剪枝等技术,解决剪枝后模型失稳问题,实现高压缩率、推理加速与高精度。

新智元
新闻资讯7

太炸了!小扎2亿美金挖走了庞若鸣,比库克年薪还高

外媒爆料小扎花2亿美金挖走苹果智能基础模型负责人庞若鸣,薪酬比库克高,且部分与绩效挂钩。庞若鸣履历出色,领导苹果自研模型核心团队,成果关乎苹果产品未来。

AI寒武纪
产品应用8

18个月,中国Token消化狂飙300倍!别乱烧钱了,清华系AI Infra帮你腰斩API成本

中国模型API服务碎片化、“黑盒”问题严重,成本高。清程极智1月29日发布AI Ping,类似“中国版OpenRouter + Artificial Analysis”,可评测、路由模型,帮开发者降低成本、提升效率,还能重塑服务市场秩序。

机器之心
算法论文8

逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%

Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。

AIGC开放社区
新闻资讯8

突破125年世纪难题!北校友联手科少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北校友邓煜、中科少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三维度

随着语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩后会失稳、低效。美国、英国和澳利亚研究人员提出三维分类框架描述规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
新闻资讯7

打脸哲学无用!牛津博士教出Claude,自曝百万年薪提示词秘诀

Anthropic驻场哲学家Amanda Askell主导设计Claude的性格等机制,她分享制定有效AI提示词方法,认为需哲学思维。此外还提及不同人对提示词看法,以及模型存在的「裂脑问题」。

新智元