「超并行实验」共找到 3420 篇相关文章
Hugging Face 推出 GOLD:让不同模型家族也能做知识蒸馏
Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也能做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集成到TRL库。
突破单token预测局限!南洋理工首次将多token预测引入微调,编程任务准确率提升11.67%
当前主流大语言模型依赖下一token预测训练,难理解跨多token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将多token预测引入微调,能让模型理解完整概念,多领域实验显示其可显著提升模型性能。
清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟
清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。
AI版Office全网首测,键盘鼠标彻底退休!打工人沸腾
昆仑万维天工超级智能体(Skywork Super Agents)结合Deep Research和通用Agent优点,带来AI版office。它有超能Office「六件套」,六大卖点亮点足,具五大自研硬核实力,填补市场空白,有望成智能体赛道黑马。
Agent效率X10,ClaudeCode/Codex 专属的文件管理Agent:Agentfile
Claude Code创始人用多Claude并行开发,作者受启发做了Agentfile。它能将项目文件夹变为标签页,便于切换,从Wave改进而来,轻量且适合承接HTML结果,是Skill驱动的Agent,定位为多Agent工作流收口台。
Claude 最歧视的,是印度阿三
AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。
工业级 LLM 数据工程:北京大学 DCAI 团队 DataFlow 框架的架构设计与实践
2026 年大模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京大学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能。
BeyondSWE:AI编程80分是真的强,还是考卷太简单?
前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。
Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点
2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。
LangChain Agent 年度报告:输出质量仍是 Agent 最大障碍,客服、研究是最快落地场景
LangChain对1300名行业人士调查,揭示AI Agent应用情况。超半数受访者已将Agent投入生产,客户服务、研究与数据分析是热门方向,但输出质量仍是落地最大障碍,成本不再是难题。