小厂」共找到 1206 篇相关文章

7

10亿天价挖角惨遭12人连环拒,扎钞能力失灵!OpenAI系初创0人卖身

Meta为从OpenAI前CTO初创公司挖人,开出10亿美元天价,却遭12人拒绝。同时,苹果AI团队一月内流失4员大将。此外,Meta的Llama 4发布遇挫,扎豪掷重金重组AI部门,其AI豪赌回报成疑。

新智元
新闻资讯7

图灵奖大佬向97年孩哥汇报?扎1亿年薪买新贵,老将痛诉熬夜捡GPU!

新智元报道,扎砸143亿拿下Scale AI 49%股权引入Alexandr Wang任Meta首席AI官,甚至可能让LeCun向其汇报。而Meta老员工因GPU受限研究受阻,科技圈有人上亿年薪,有人被裁,AI圈呈职业体育趋势。

新智元
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放模型潜力,还构建技术组合拳。

机器之心
开源动态8

32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理模型 AM-Thinking-v1

2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索体量实现大能力路径。

AI科技评论
开源动态8

又是王冠:27M模型超越o3-mini!拒绝马斯克的00后果然不同

27M模型HRM由拒绝马斯克的00后王冠开发,超越o3 - mini - high和DeepSeek - R1,推理不靠思维链。它采用分层推理等五项核心技术,在多测试中表现出色,虽被指通用性不足,但有人看好其仿脑架构。

量子位
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、模型在路上,还承诺尽快发新模型!

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
推荐文章7

与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源酒馆Vol.31

五源酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。

五源资本 5Y Capital
开源动态8

狂揽 11.8K Star!用大 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用大PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探
开源动态8

红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
新闻资讯7

2026“企业 Agent 上岗元年”?零一万物六大判断定义企业多智能体,不再沿用大标准化产品模式”

1月5日,零一万物发布《中国企业智能体2026六大预判》,展示“万智2.5企业多智能体”。基于实践总结六大核心预判,还升级万智平台,不沿用大标准化模式,规划企业多智能体进化“三步走”布局。

AI前线