清华段然团队」共找到 3625 篇相关文章

开源动态7

如何重现 DeepSeek 推理性能突破

DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。

InfoQ
新闻资讯7

狗子被人类驯化后,脑子萎缩了一半

法国团队研究发现,狗被驯化后大脑容量缩减。35000 - 15000 年前犬类脑容量未缩减,5000 - 4500 年前脑容量比同期狼小 46%,现代家犬比狼小 32%。这或与农业革命人类需求有关,且不意味狗变笨。

DeepTech深科技
算法论文8

仅需一个混频器的无线射频机器学习推理,登上Science Advances!

杜克大学和MIT教授团队提出广播模型并在射频上完成计算的分离式计算方案,在边缘端混频器模拟计算中完成推理,解决传统方案问题,还在测试平台验证,能耗低且能完成多项机器学习任务。

机器之心
新闻资讯7

硅谷大佬带头弃用 OpenAI、“倒戈”Kimi K2!直呼“太便宜了”,白宫首位 AI 主管也劝不住

硅谷正从昂贵闭源模型转向便宜开源替代方案。“SPAC 之王”Chamath Palihapitiya 团队将大量工作负载迁移至 Groq 平台的中国模型 Kimi K2,因其性能优且成本低。节目中还探讨中美开源模型现状等。

InfoQ
新闻资讯7

LSTM之父向何恺明开炮:我学生才是残差学习奠基人

LSTM之父Jürgen Schmidhuber替学生Sepp Hochreiter发声,称残差学习30年前已诞生,1991年Sepp就用循环残差连接解决梯度消失问题,为残差思想奠基。他觉得将成果全归何恺明团队有失偏颇。

量子位
推荐文章7

Manus首次揭秘:Agent的关键在上下文工程

Agent成大模型主战场,构建方法待探索。Manus发blog揭秘,认为成功的AI Agent依赖上下文工程。团队选此实现快速迭代,虽实践不易,但总结出围绕KV缓存设计等关键点,其经验影响Agent表现。

AI寒武纪
算法论文8

舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿

本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。

机器之心
新闻资讯7

Duolingo 和 Shopify 纷纷宣布 AI 优先,围绕 AI 工作的时代已来

Duolingo和Shopify宣布AI优先政策,将用AI取代部分人类工作。Duolingo推出AI创建的新语言课程,转型为“AI优先”模式;Shopify要求全员高效用AI。此外,Genspark Super Agent ARR增速快,未来或属“小团队+AI”时代。

投资实习所
推荐文章7

Mastra 还是 LangGraph.js?选型先看三条断层线

2026 年上半年,TypeScript 团队做 AI Agent 常面临 Mastra 和 LangGraph.js 选型难题。二者功能清单趋同,但工程哲学不同。文章从语言原生与跨语言移植、缩到零的 serverless 与常驻的持久化、完整工具箱与自由原语三条断层线分析选型依据。

AI Reading Hub
开源动态8

Qwen3.8-Flash-Next:SGLang Day-0 支持

2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8-Flash-Next,是Qwen4架构早期预览版。SGLang在发布首日提供完整支持,模型架构多方面升级,亮点众多,还介绍各组件优化及PLE架构与卸载优势。

GiantPandaLLM