「可迁移模型」共找到 10138 篇相关文章

7

硅谷的「十万大裁员」:Meta按代码量裁员

2025年,AI浪潮席卷硅谷,引发新一轮裁员潮。从互联网巨头到初创企业,纷纷边裁边招,将资源转向前沿大模型。基层岗位被自动化压缩,顶尖AI人才需求飙升,裁员是职位版图重塑的前奏。

新智元
算法论文8

NeurIPS25高分论文|以判别式监督学习强化推理LLM,解决难度偏差和熵崩塌难题

德州农工大学博士生李港在NeurIPS25高分论文中,分析GRPO优化目标,发现难度偏差局限及与判别式监督学习联系,提出DisCO框架强化大型推理模型,其优势显著,实验表现优于GRPO及其变体。

机器之心
算法论文8

比Transformer更强的架构来了?浙大新作Translution,一统卷积和自注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。

新智元
产品应用8

制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践

在数智化转型中,企业开展AI培训却难转化业务价值。极客时间与制造企业合作,用“线上+线下+实战”的OMO训练营,实现AI产品经理“能力复制”,成果获认可,模式可复制。

InfoQ
新闻资讯7

马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI的尽头是卖薯片?

新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。

新智元
新闻资讯7

Andrej Karpathy:“ChatGPT套壳”的说法大错特错,提示词工程已过气

Andrej Karpathy力挺用“上下文工程”取代“提示词工程”,指出“提示词”过于简单,“上下文工程”更能揭示构建强大AI应用的本质。他强调“上下文工程”仅是构建大模型应用的一环,“ChatGPT套壳”说法大错特错。

AI寒武纪
推荐文章7

默认联网搜索开启,DeepSeek、豆包、Kimi、百度文心一言、腾讯元宝、通义、智谱、天工等AI生成内容信息采集主要来自哪?

作者白杨SEO分享AI搜索优化,提到部分AI大模型默认开启联网搜索,利于做AISEO。还逐个分析DeepSeek、豆包等AI生成内容信息采集来源及占比,助于做好AI搜索优化。

白杨SEO优化教程
产品应用8

鹿明发布NexCore:当机器人技能成为一种基础设施

8月19日鹿明机器人发布具身智能进化引擎Lumos NexCore,试图在数据、模型等与机器人间建立生产与运行链路,让机器人能力成可复用‘技能资产’,解决具身智能技能生产效率问题。

机器之心
开源动态8

真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????

文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持多模型,有任务流程和多Agent协作功能,还分析适用人群并给出启动方法。

小华同学ai
算法论文7

一针注射,体外控波,科学家研发新型无线神经刺激器重塑疼痛管理

全球约20%成年人受慢性疼痛困扰,现有神经刺激设备有局限。纽约大学阿布扎比分校等团队研发SEED可注射无线神经刺激器,大鼠实验实现坐骨神经精准刺激,但面临效率、电荷平衡等问题。

DeepTech深科技