新能安」共找到 7785 篇相关文章

开源动态7

Vercel 发布语言 Zero:代码不是写给人看的,而是写给 AI 的

Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,不过在 Hacker News 上遭部分质疑。

InfoQ
算法论文7

微软等提出「模型链」范式,与Transformer性相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性相当且扩展性、灵活性更好。

机器之心
开源动态8

Agent王诞生!Hermes 7周追上龙虾,中国用户可微信直连

2026年二季度,Hermes Agent成潮流,由美国Nous Research开源,其GitHub stars数达84.4k。国内云厂商支持部署,手机厂商接入并限免。它原生支持微信,开发者评价高,与OpenClaw双雄并立,正掀起生产力革命。

DeepTech深科技
产品应用7

GPT-5 不是技术范式,是 OpenAI 加速产品化的战略拐点

文章从不同视角评价 GPT - 5,指出它是 ChatGPT 产品重要升级,是 Router 驱动系统。介绍其力提升与短板,如 Vibe coding 性价比高但 Agentic 力不足,还探讨了商业影响、价格战等,期待其 Agentic 力发展。

海外独角兽
产品应用7

求稳的全IP,谋科技如何守正出奇?|甲子光年

12月24日,谋科技推出一代SPU IP——“山海” S30FP/S30P,给出面向高性计算芯片的全栈全解决方案。该方案从硬件IP层、软件中间件到云端服务构建一栈式全防护体系,有五大核心亮点。

甲子光年
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

SFT在帮倒忙?研究:直接进行强化学习,模型多模态推理上限更高

学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理上限更高,该团队训练的模型还刷了纪录。

机器之心
新闻资讯8

极客部落“OPC 创业者招募计划”正式发布,赋 AI 时代“一人独角兽”

3月20日,极客部落“OPC创业者招募计划”开放日活动举行。活动聚焦OPC创业范式,多方探讨AI应用生态建设。现场为生态园揭牌,宣讲扶持政策,发布合作基金,还举办圆桌论坛探讨OpenClaw对创业生态的影响。

InfoQ
新闻资讯7

5个月估值翻10倍,AI数据赛道跑出一家独角兽

成立约18个月的AI训练数据公司AfterQuery正筹一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和全风险待解。

DeepTech深科技
开源动态7

知名产品工程师开源「一整套编程skill」,每个人都有顶级的工程习惯

现在用AI写代码存在效率低、浪费token等问题,知名开发者tw93发起开源AI编程skill库Waza,将顶尖工程师习惯转化为Claude Code可运行技,推出8实用技,还提供两个小脚本。

开源AI项目落地