多阶段训练」共找到 6001 篇相关文章

新闻资讯7

营收67亿、净利8.7亿,这家上海芯片公司再冲刺港股

4月12日,晶晨半导体向港交所主板重新递交H股上市申请,这是其第二次冲击港股。该公司有“硅谷基因、国内运营、全球销售”独特身份,产品覆盖领域,业绩创新高,但也有客户集中、存货激增等风险。

芯师爷
新闻资讯7

Anthropic最新战报:年化收入突破300亿美元,反超OpenAI,千家企业客户单笔年消费超百万

Anthropic宣布与谷歌和博通扩大合作采购算力,首席财务官称是为跟上增长步伐。其年化营收破300亿美元超OpenAI,超千家企业客户单笔年消费超百万,Claude在平台上线,二级市场已重新定价。

AI寒武纪
产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从方面改进,如优化推理和偏好对齐,重构训练数据,采用种强化学习算法,使其性能比肩大模型。

AIGC开放社区
开源动态8

AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜

Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。

量子位
算法论文8

DeepSeek比你更懂反思!谷歌重磅发现,智能的本质竟是一场社会化对话

谷歌等机构研究发现,像DeepSeek - R1等推理模型思考复杂问题时,内部模拟角色辩论赛,形成思维社会机制,让AI准确率提升,证明智能本质或是内化社会互动,还为调优AI提供新方法。

AIGC开放社区
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
新闻资讯7

反超Gemini 3!马斯克放出Grok4.1快速推理版,还曝出了新一轮150亿美元融资

Grok4.1被Gemini 3反超后,据华尔街日报爆料,xAI正计划150亿美元融资,公司估值将达2300亿美元。xAI成立两年来估值飙升,马斯克还发布Grok 4.1 Fast击败Gemini 3。

量子位
新闻资讯7

4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?

Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。

InfoQ
开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理参考图像,在模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
新闻资讯7

刚刚!软银系创始人4个月打造机器人超级黑马,获2轮近亿元融资

9月23日,成立仅四个月的具身智能机器人企业浩海星空,获浙江仙通4000万战略投资。其创始人齐建伟有二十年技术积累,浩海星空精准卡位,选教育等场景破局,还前瞻布局双足人形机器人。

新智元