「代码向量模型」共找到 8739 篇相关文章
推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型
OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。
0.01%参数定生死!苹果揭秘LLM「超级权重」,删掉就会胡说八道
苹果研究人员发现大模型中极少量的「超级权重」,即便占比仅0.01%,对模型能力影响巨大。这一发现为大模型「科学瘦身」提供思路,还提出定位方法,助力模型量化和未来研究。
对话原力灵机周而进:模型2.4B就够用,关键是“具身原生”;能闭环才是最高效方法
原力灵机推出首个具身原生模型产品DM0,仅2.4B参数,却能支撑实时处理画面与真机进化。其合伙人周而进称要走具身原生路线,还介绍了数据采集、模型训练等多方面内容及公司发展规划。
Paper2Page: 让每一篇论文都能“自己长出”一个项目主页
AI领域论文众多,研究者难让工作脱颖而出,精美项目主页很重要但制作繁琐。AutoPage是多智能体协作框架,能将论文一键转为项目主页,经三步协作,在速度、成本、质量等方面表现出色,代码已开源。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
NanoCoder:我把50万行的claude code核心机制浓缩成1000行,不可能学不会了吧!
Claude Code 源码泄露后,kimi Agent 团队何宇峰大佬的 NanoCoder 项目,用 950 行 Python 代码重写其核心机制。它实现 7 种关键设计模式,可助理解顶级 AI 编程 Agent 核心设计,还能按需修改。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章聚焦HyperGraphRAG模型,介绍其架构由知识超图构建、超图检索策略、超图引导的生成机制组成,阐述构建步骤,该模型能提升检索效率,或成ACL 2025爆款。
全球首次实测通过!CMU华人用AI设计的乐高「不翻车」
CMU研究人员提出LegoGPT,它微调Meta的LLaMA模型,结合47000个稳定结构数据集,确保98.8%的乐高设计符合物理定律,可实际搭建。目前,数据集、代码和模型均已开源。
狂赚 21.6K star!超牛的Cursor免费平替项目,隐私友好、功能超强,真的香!
开源君分享了开源AI代码编辑器Void,它是基于VS Code魔改的「开源版Cursor」,保留VS Code优点,AI辅助编码出色。在Github获21.6K star,有隐私保护等特色,操作简单易上手。