算力大考」共找到 5573 篇相关文章

新闻资讯7

LeCun出局,Meta变天!Llama 4翻车清洗,「学院派」败退

LeCun宣布年底离开效力12年的Meta,创立专注「世界模型」的AI公司。Llama 4翻车成其离职导火索,他的离去意味着学院派在Meta的AI战略中被边缘化,也预示硅谷AI路线之争进入新阶段。

新智元
算法论文7

一半人明天不上班,GDP不会掉一点!耶鲁学揭AGI残酷真相

耶鲁学者Restrepo论文指出,AGI时代经济因算力扩张狂飙,但普通人工资被「算力成本」锁死,与增长脱钩。劳动在GDP占比将归零,财富流向算力资本,人类或被边缘化到附属岗位。

新智元
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理模型与普通模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思

随着推理模型和思维链普及,模型有了‘深度思’能力,但现在有些偏科,简单任务也复杂化。AI牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,模型发展不能只追求分数。

机器之心
开源动态8

北交开源 CutClaw,自动踩点音乐的 AI 智能视频剪辑师!

湾区学GVC实验室和北京交通学团队开源CutClaw,它是模拟专业后期流程的多智能体系统,能实现音乐驱动剪辑,按文字指令自动剪辑,适配多平台,还可解构素材。操作简单,支持多模型。

开源星探
新闻资讯7

太卷了!专属Coding的新一代Arena榜单来了,有国产模型登上榜首

模型编程竞争激烈,编码能力提升成军备竞赛。LMArena发布新世代模型编码评估系统Code Arena,国产模型智谱GLM - 4.6登上榜首,其编码能力获认可,彰显国产模型硬核实力。

机器之心
新闻资讯7

剧情反转!马斯克牵手 Dario,Anthropic 与 SpaceX 罕见合作

Anthropic官宣与马斯克的SpaceX合作,将使用其超算集群全部算力。因Claude火爆致宕机,Anthropic急需算力。其估值疯涨,而SpaceX闲置算力出租也符合商业逻辑,马斯克还对Anthropic团队表示认可。

AGI Hunt
算法论文8

不训练,解锁Agentic智能!微软:只需给LLM一台电脑

、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把模型放进“虚拟机”,让其在6任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。

PaperAgent
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让模型学会反思总结。模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为模型推理难题提供了解决方案。

AIGC开放社区
新闻资讯7

国产推理芯片,赢了英伟达?

算力市场风向生变,国产算力崛起。政策从资金、市场、规则多维度发力,为国产算力扫清障碍。在推理场景中,国产方案性价比更高。其独特分销体系使贸易环节信息透明度低,步入卖方市场,市场也迎来新局面。

芯师爷