能力显著向量」共找到 3722 篇相关文章

算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
算法论文8

303页年度最佳AI Code综述:阿里、字节、快手30家顶级机构出品

分享303页《从代码基础模型到智能体与应用:代码智能实践指南》,由近30家顶尖机构出品。介绍2021 - 2025年代码大型语言模型发展,分析通用与代码专用LLM能力,阐明研究 - 实践差距,还开展实验。

PaperAgent
算法论文8

“坏”数据让模型更“好”?重新审视数据过滤

传统观点认为大型语言模型预训练应过滤“坏数据”,但论文《When Bad Data Leads to Good Models》提出反直觉观点,适度加入有毒数据,通过后训练技术可降低模型毒性,保持一般能力,挑战常规做法。

深度学习自然语言处理
新闻资讯7

20美元,撕开人类思维鸿沟!宾大教授警告AI隐形阶层战

宾大教授Ethan Mollick指出,AI已成新社会基础设施,正制造人类内部分层。从免费到20美元、200美元,不同付费层级对应不同使用模式和能力,思维差异才是关键,未来需培养与AI协作的直觉。

新智元
算法论文8

综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满

该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。

深度学习自然语言处理
新闻资讯8

Hinton与姚期智对谈:认为人类的意识特殊,那是危险的无稽之谈

图灵奖得主Geoffery Hinton与姚期智对谈AI相关话题。Hinton认为人脑可给AI借鉴,还探讨人类未来与AI道德,强调训练善良AI重要;他觉得大模型有理解能力,将人类意识特殊化是危险无稽之谈。

AI科技评论
产品应用8

5亿融资后清华具身团队首秀:55自由度拿捏360°大旋转,街舞叠衣服都在行,手速堪比电竞选手

这是星动L7机器人秀出的最新能力,打造者是清华叉院背景的星动纪元团队。不久前他们获近5亿新融资,此次新进展惊艳众人,该机器人全身多达55个自由度,创下多项纪录。

量子位
开源动态8

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。

InfoQ
新闻资讯7

用AI,写代码只会更慢!但一定更「快乐」

METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反降。开发者本预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力

新智元
算法论文8

PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)

当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。

AINLPer