预训练时代」共找到 3280 篇相关文章

开源动态8

100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star

AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获超4500 star,功能丰富,但他认为它不适合个性化应用。

机器之心
算法论文7

越可靠的AI就越人机,牛津大学:高情商模型错误率显著增加

牛津大学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。

量子位
新闻资讯7

任期超越乔布斯,库克给苹果留下的「三本账」

今年8月库克在全员会回应外界质疑,强调AI革命重要性。他从会计大师转变为引领者,任期超乔布斯。库克算对「市值账」,却难清「人才账」,其创新理念在AI时代面临挑战。

芯师爷
新闻资讯7

人类击败OpenAI守住编程冠军!10小时激战两次反超,AI最后关头功亏一篑

在AtCoder世界巡回总决赛编程赛中,OpenAI的OpenAI - AHC前期领先,后半程失误,人类选手Psycho两次反超夺冠。Psycho曾在OpenAI训练AI战胜人类,此次挑战老东家获胜。

量子位
开源动态7

阿里达摩院开源多模态医学大模型—灵枢

大模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心
新闻资讯8

刚刚,云计算一哥出手,大家AI Agent自由了

亚马逊云科技在re:Invent大会发布诸多面向Agentic AI的成果,包括Strands Agents SDK更新、模型定制工具等,还介绍了构建Agent的四个方面,展示了完整蓝图,指引AI时代新方向。

机器之心
产品应用8

Vibe Coding爆火,YouWare靠「社区+产品思路」突围

AI时代,Vibe Coding兴起,谷歌DeepMind与OpenAI围绕AI Coding人才和技术博弈。YouWare创始人明超平洞察到AI Coding作品分享的断层,以「社区+产品思路」打造平台,在Vibe Coding领域突围。

机器之心