「上科大」共找到 6432 篇相关文章
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。
卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?
随着大模型能力突破,Agent 从概念走向应用,各类框架不断涌现。清华系团队发布开源框架 Cooragent,获 1.9k stars。创始人王政分享 Agent 发展洞察,指出大模型能力提升推动 Agent 商业化,还探讨 MCP、框架等多方面问题。
AI折叠!Fable 5和GPT-5.6,正沦为少数人的特权
当前AI体验出现严重“阶层折叠”,极少数人用Fable、GPT - 5.6等顶级大模型,大众用的是低参数的平庸产品。算力成本让普通人难以触及顶级AI,在医疗等领域也存在使用差距,不过也有人认为普通工作无需顶级模型。
中国芯片就差一台EUV
中国芯片代工取得佳绩,全球前10大晶圆代工厂中大陆占3个。但与台积电差距大,核心在于缺EUV光刻机。9位业内大佬联名呼吁造中国版ASML,国家也将推动产业链协同攻克此技术。
黄仁勋不信泡沫,OpenAI需要“印钞机”
文章围绕OpenAI与AMD、英伟达等的“股权换订单”合作展开,分析AI行业泡沫问题。指出OpenAI收入与投入落差大引发担忧,但也有人认为这次泡沫或不同。还提及科技公司资本支出增长,AI发展空间大。
Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题
LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。
逆天! Claude Opus几小时攻破C++大神4年死磕Bug
Reddit上有30多年C++开发经验的大神ShelZuuz,被一个困扰四年的Bug折磨,投入约200小时未解决。用Claude Opus几小时就找到症结,而此前GPT - 4.1等模型都失败。大神认为AI在编写新代码上像初级开发者。
训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法
将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。
Karpathy的编程经验Skills,开源了,Star涨疯了。
周末,Karpathy大佬的编程经验开源skills项目火了,它把其吐槽大模型写代码的问题编译成大模型可理解的约束。安装简单,还列举了一些规则示例。如今行业把人的经验编译成Agent可执行格式,开源范式改变。
清华等发布UltraRAG 2.0,仅用50行代码解锁RAG高性能开发
大语言模型存在“知识截止”问题,RAG技术应运而生,成为大模型落地主流方案。但随着需求提升,其工程实现变复杂。清华等推出UltraRAG 2.0,仅50行代码实现同等功能,降低开发门槛,性能提升,还能落地多种场景。