算法论文8
DnD:几秒定制大模型,效率飙升12000倍
新智元
AI 摘要
NUS、UT Austin等机构研究人员提出DnD,它是基于提示词的参数生成器,无需训练微调LLM。其计算开销低,性能强,泛化好,速度比传统微调快2500 - 12000倍。
阅读原文 · 新智元
LLM进入「拖拽时代」!只靠Prompt,几秒定制一个大模型,效率飙升12000倍
新智元报道,NUS、UT Austin等机构研究人员提出「拖拽式大语言模型」(DnD),它基于提示词生成模型参数,无需微调适应任务,效率最高提升12000倍,零样本泛化能力出色。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
DeepSeek高毛利,冲刺5000亿估值A股上市
据外媒报道,DeepSeek今年前七个月营收约4.75亿,较2025年全年增长近10倍,净亏损收窄,综合毛利率44.6%,API业务毛利率达82.9%。它正磋商500亿二轮融资,筹备明年沪上市,靠优化基建降本,低价策略吸客。
AI前线
产品应用7
Google发布“法律版Gemini”进军法律界
8月25日,Google Cloud发布Gemini Enterprise for Legal面向律所和企业法务团队开放预览。它想解决让模型进入律所现有工作系统,不打乱权限等规则的问题,通过MCP连接系统并继承权限,还组织各方合作。
AIGC开放社区
算法论文8
NovaSilicon:造芯瓶颈在组织而非工具
NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。
五源资本 5Y Capital
新闻资讯8
OpenAI自研芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
机器之心