上纬新材」共找到 5119 篇相关文章

推荐文章8

翁荔博客提出「自进化先从Harness开始」,DeepSeek崔添翼转发附议

前OpenAI安全副总裁翁荔博客探讨AI自进化,提出从Harness开始的现实路径。DeepSeek崔添翼转发附议,认为Harness方向自进化很可能出成果。翁荔梳理研究,展示优化递进趋势,也指出实现递归自我改进存在的瓶颈。

量子位
新闻资讯8

LeCun公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙

图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供解法,还将落地多领域,且承诺开源研究。

AIGC开放社区
产品应用7

2499 元产品背后:地瓜机器人将智驾 know-how 转为机器人解法

AI重塑机器人技术边界,具身智能成战场。地瓜机器人从地平线拆分,将智驾经验用于机器人。它提出大小脑分层架构落地更快,还推出RDK S100套件,搭建具身智能底座应对数据和应用难题。

AI科技评论
推荐文章8

“每给 Claude Code 提一个请求,我就点一根烟,放松下”

OpenFGA 核心维护者 Siddhant Khare 写博客吐槽使用 AI 编程的‘疲惫感’,指出 AI 带来职业疲惫却被行业回避,还分析了原因,如任务量膨胀、角色转变等,并给出应对建议,引发工程师共鸣。

InfoQ
算法论文7

微软等提出「模型链」范式,与Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
开源动态8

Agent王诞生!Hermes 7周追龙虾,中国用户可微信直连

2026年二季度,Hermes Agent成潮流,由美国Nous Research开源,其GitHub stars数达84.4k。国内云厂商支持部署,手机厂商接入并限免。它原生支持微信,开发者评价高,与OpenClaw双雄并立,正掀起生产力革命。

DeepTech深科技
产品应用7

GPT-5 不是技术范式,是 OpenAI 加速产品化的战略拐点

文章从不同视角评价 GPT - 5,指出它是 ChatGPT 产品重要升级,是 Router 驱动系统。介绍其能力提升与短板,如 Vibe coding 性价比高但 Agentic 能力不足,还探讨了商业影响、价格战等,期待其 Agentic 能力发展。

海外独角兽
新闻资讯8

Claude模型危险,鲍威尔召集华尔街紧急开会!全美安全股暴跌2万亿

Anthropic的模型Mythos能力超强,被指或对金融业造成重大风险。鲍威尔和贝森特紧急召集华尔街开会预警。消息传出,美国软件板块暴跌,SaaS领域近2万亿美元市值蒸发。Anthropic拒绝向公众发布该模型,启动防御项目。

新智元
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

SFT在帮倒忙?研究:直接进行强化学习,模型多模态推理限更高

学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理限更高,该团队训练的模型还刷了纪录。

机器之心