成本性能」共找到 6938 篇相关文章

新闻资讯8

被锁死的想象力:当AI了科研本身,人类只是观众

新智元报道,Steve Newman指出,我们对未来想象力或被锁死,AI一旦跨过「适应性阈值」,将进入「不可认知时代」。他提出「谷神星实验」,揭示AI超越人类节奏后,人类社会不再是必经之路等残酷真相。

新智元
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也拿到上千万投资

过去半年,三家未型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因大模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
开源动态7

最受欢迎的开源大模型推理框架 vLLM、SGLang 是如何炼的?

文章介绍了开源推理引擎 vLLM 和 SGLang,包括起源、创新、社区发展、版本迭代等。vLLM 借鉴分页缓存管理技术,SGLang 基于 RadixAttention 优化。二者竞争激烈,性趋同,还获投资与基金会关注,受科技公司青睐。

AI科技大本营
算法论文8

大模型训练新突破!Meta提出LSP:无数据也实现力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
新闻资讯7

2025年了,AI还看不懂时钟!90%人都答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可原因,还对比了不同模型表现及在各类问题上的差异。

新智元
开源动态8

腾讯混元最新开源“最强翻译”:国际机器翻译比赛获30个语种第一

腾讯混元团队的Hunyuan-MT-7B以7B总参数量获国际翻译比赛冠军,还开源了该模型及翻译集模型Hunyuan-MT-Chimera-7B。其Shy框架有三大创新,在多方面表现优异,还为垂直领域优化提供模板。

量子位
新闻资讯7

全球首例「AI谋杀案」,56岁IT精英弑母后自杀!ChatGPT教唆元凶,聊天曝光

本报道分析了索尔伯格的视频、警方报告等,讲述56岁IT精英索尔伯格在现实碰壁后与ChatGPT深度互动,AI不断肯定其妄想,最终他弑母后自杀。这引发对AI与人祸责任的讨论。

新智元
新闻资讯7

AI人才争夺战加大薪资差距,OpenAI前副总裁:留住人才是最重要的

随着AI人才争夺战白热化,大模型公司员工薪酬差距扩大,研究与非研究人员薪资差距明显。OpenAI前副总裁Peter Deng认为留住人才最重要,有独特优势的人定价力强,Meta未来战略看重超级智

量子位
新闻资讯7

AI正在疯狂吞噬一切!数据中心价值暴涨,但这场狂欢持续多久?

文章指出AI数据中心投资使美国GDP增长显著,市场规模将大幅增长。科技巨头疯狂砸钱,投资集中在北弗吉尼亚。专家观点分裂,作者认为需求真实但短期有泡沫,投资可推动进步,也可重蹈覆辙。

AIGC开放社区
推荐文章8

AI 基础知识从 0.5 到 0.6—— Transformer 架构为何统治AI领域?

文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在多领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、多头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。

阿里云开发者