评测指标」共找到 875 篇相关文章

产品应用7

PDL 在 SGLang Kimi K3 中的应用

文章介绍 PDL 在 SGLang Kimi K3 中的应用,K3 内核优化接入 PDL 以缩短相邻内核间隙。分析 PDL 原理、在 bs=1 decode 中解决的问题,阐述计算链和通信链上的应用,还提及性能数据和实现问题。

GiantPandaLLM
推荐文章7

Agent 形态一天一个样,Infra 到底该为谁而建?

过去一年,Agent 应用形态多变,但进入稳定生产环境的项目有限。清程极智师天麾认为,Agent Infra 重要性待显,当前应提高 Token 生产交付效率。还探讨了 Agent 发展问题、Token 相关指标及收费模式等。

InfoQ
新闻资讯7

世界模型的GPT时刻:距离物理AGI出圈,还有多远?

InfoQ《极客有约》X AICon 直播栏目探讨物理 AI 下一个战场。嘉宾认为世界模型未出圈,生成加重建是折中探索。还讨论了其定义、升温原因、数据结构、技术范式、评测标准等,也提及挑战与未来格局。

AI前线
新闻资讯7

Cyber天花板被打穿!AISI实测Mythos能力正以4.5月翻倍速冲向ASI

英国AI安全研究所(AISI)实测Anthropic的Mythos和OpenAI的GPT - 5.5,发现其网络攻防能力4.5个月就能翻倍,加速冲向ASI。Mythos在模拟企业内网32步渗透任务中表现出色,瓶颈在于Token而非智力。

新智元
算法论文8

「压缩,就是你所需要的全部」!菲尔兹奖得主Michael Freedman新作揭开数学真相

菲尔兹奖得主Michael Freedman认为人类真正创造和关心的数学本质是「柔软且可塑」的。他在最新论文提出「压缩,就是你所需要的全部」,并在采访中探讨人类数学直觉与机器逻辑的鸿沟,认为理解压缩机制是人类与AI在数学领域协作的起点。

机器之心
产品应用8

首个实时端侧部署世界模型,20万小时人类视频,BeingBeyond实现「两级跃迁」

4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小时,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实时部署,打通数据闭环,推动模型通用与专家能力跃迁。

AI科技评论
开源动态8

从多模态大模型中「拆」出音频向量模型

Google 发布原生多模态向量模型 Gemini Embedding 2,推动 Omni Embedding 发展。Jina AI 团队分享从多模态大模型中「拆」出音频向量模型的经验,介绍架构、训练数据,对比四种做法,还提及评测、应用场景及结论。

Jina AI
7

Anthropic发布AI就业冲击报告,数据让人意外

Anthropic发布AI对劳动力市场影响的报告,基于真实数据和理论智能分析。提出“观察暴露度”新指标,揭示AI理论能力与实际应用差距大,还给出高危职业排行,分析受影响人群、安全职业等。

AI工程化
开源动态8

千星项目LLMRouter:多模型路由,16+策略优化推理

UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。

新智元
新闻资讯7

一文彻底看懂6G!

文章深度解读6G,介绍其定义、与5G差异、网络指标、发展进展等。指出6G是新一代移动通信标准,速率更快,有革命性跃迁,预计2029年发布首个商用标准版本,2030年左右商用。

芯师爷