「模型能力提升」共找到 10014 篇相关文章

新闻资讯7

死敌爆料是狠!OpenAI内部信阴阳Claude营收注水80亿,然后泄露了…

OpenAI首席营收官Denise Dresser给员工的内部信被泄露,信中透露Q2企业业务方向,还贬低对手Anthropic,称其300亿年化营收虚高80亿。此外,还提及OpenAI未来计划,如推新模型Spud、与Amazon合作等。

量子位
推荐文章8

硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。

文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。

AI大模型应用实践
产品应用8

DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了

DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。

AIGC开放社区
算法论文8

零Token部署GraphRAG,LinearRAG做到了~

现有GraphRAG模型在实际应用中常不如朴素RAG,原因是自动构建的知识图谱质量不佳。LinearRAG框架通过Tri - Graph架构、两阶段精准检索和零Token范式重构GraphRAG,在多数据集上超越现有方法,代码和数据已开源。

PaperAgent
算法论文8

让机器人「不仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,在多领域有应用前景。

机器之心
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
新闻资讯7

刚刚,Gemini 宣布将前往太空!

刚刚,Starcloud宣布与Google Cloud合作,要把Gemini模型送上卫星运行。计划今年底或明年初通过SpaceX发射搭载NVIDIA H100 GPU的演示卫星。虽面临诸多技术难题,但在AI算力需求增长下,此举或开启新时代。

AGI Hunt
新闻资讯7

印度裔 AI 负责人删掉 Karpathy 90%遗留代码,马斯克 Robotaxi 终上线!用户体验:不要小费,还可能倒给你钱

当地时间6月22日,特斯拉在奥斯汀启动Robotaxi试点服务。其AI团队核心成员是印度裔阿肖克和德国工程师米兰。技术上精简代码、扩展模型上下文长度,用户体验顺畅,但与马斯克此前设想设计有差异,国内也有多家企业开展此业务。

InfoQ
新闻资讯7

Meta出1亿美元,挖角OpenAI员工

CNBC消息,Meta曾试图以1亿美元签约奖金和高年薪挖OpenAI员工,但未成功。Meta CEO扎克伯格亲自为AI实验室组顶尖团队,此前还推迟旗舰模型发布,近期收购Scale AI部分股份并挖来多名人才。

AIGC开放社区
新闻资讯7

4B Qwen3逆袭671B DeepSeek!字节DAPO微调方法这么猛的吗

最新模型Jan - nano引发关注,它在智能体任务上超671B的DeepSeek - V3 0528,在SimpleQA基准获80.7分。它基于Qwen3 - 4B用字节&清华DAPO微调方法。其研发团队是Menlo Research,有开源产品和长远规划。

量子位