「小模型逆袭」共找到 8202 篇相关文章
大模型公司挖墙脚哪家强?报告:Anthropic人才吸引力是OpenAI的8倍,留存率达80%
风险投资公司SignalFire报告显示,大模型公司人才争夺激烈,Anthropic是大赢家,顶尖AI人才留存率达80%,从OpenAI等公司挖人成效显著,秘诀在于精准挖角、独特文化和产品共鸣。
小米在AI方向有了大动作,但AI不该是资本掩盖信息的手段。
今年下半年小米MiMo团队陆续开源多个模型,或因年初挖来技术天才罗福莉。新开源MiMo - V2 - Flash模型,总参数量309B。但小米AI对外服务网站搜自家产品舆论无果,引发对AI应坦诚审慎的思考。
Jina AI创业复盘:AI团队的Scaling Law是什么
文章是Jina AI创始人肖涵的创业复盘。他率团队六年创业后将公司出售,期间两次转型,聚焦搜索底座模型。他分享创业经历、公司命名、业务调整等,还谈收购、模型竞争、未来创业方向及给创业者的建议。
新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪
2025年9月7日新智元举办十周年峰会,主题为「新天终启,万象智生」,汇聚多位重量级嘉宾探讨AI前沿突破。当下AI发展迅猛,大模型密集发布,如OpenAI的GPT - 5、谷歌的Gemini 2.5等,中国造大模型也在开源领域领先。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
T2R-Bench发布:业内首个由表格生成报告工业基准
为解决大语言模型将表格信息转化为报告的难题,研究团队提出“表格到报告”任务,构建双语基准T2R - bench,其涵盖多垂域表格,还设计评价指标体系,实验显示大模型在该基准上提升空间大。
混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab
上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。
这个项目专治建模手残党,给张图就能转变可编辑能转动的3D模型
img2threejs上线11天获4.8k Star,专治建模手残党。给它一张图,它让AI写代码把物体“搭”出来,不重建几何,也不下素材包,还省Token、零依赖,有严格质量门控。
最高能效比!他又死磕“存算一体”2年,拿出全新端边大模型AI芯片
后摩智能CEO吴强在今年WAIC期间发布业界能效比最高的存算一体端边大模型AI芯片后摩漫界®M50。它搭载第二代存算一体技术,全栈自研实现软硬件协同优化,还配套系列产品,构建端边智能新生态。