动态目标重加权」共找到 932 篇相关文章

7

马斯克从英伟达挖人做AI游戏!第一步:研发世界模型

据《金融时报》报道,今年夏天xAI从英伟达挖来多名资深研究员入局世界模型。马斯克重申2026年底前发布AI生成游戏的目标,xAI首批落点或为电子游戏,还组建全模态团队,若各板块通过世界模型互通,其AI帝国将形成闭环。

量子位
新闻资讯8

从马斯克并购 Cursor 说起:国内编程智能体的牌桌、裂缝与全链自主之路

文章从马斯克600亿美元收购Cursor切入,分析海外编程智能体“垂直整合”趋势,指出护城河在全链掌控。对比国内,玩家分散,面临版权、安全等风险。强调中国须走全链自主之路,各层发力,目标是经略全球。

AI科技评论
新闻资讯7

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了

DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。

机器之心
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。

深度学习自然语言处理
产品应用8

AI发布首个全球科学家社区爆火,硅谷投资圈:科技研究领域的「谷歌地图」来了!

O-DataMap,由AI论论全球打造的全球科学家社区爆火,被赞为科技研究领域的「谷歌地图」。它将全球论文实验数据整合到二维坐标系,形成动态「科技地图」,还分三层助力科研决策,本月18号论论全球将直播演讲。

机器之心
推荐文章8

深度解析 Claude Code 在 Prompt / Context / Harness 的设计与实践

本文深度解析Claude Code在Prompt、Context、Harness三方面的设计与实践。介绍了Prompt动态组装过程,探讨CLAUDE.md项目说明、上下文压缩体系和记忆系统,还阐述了系统级提醒、多Agent及安全体系等内容,文末分享了项目有趣彩蛋。

阿里云开发者
开源动态8

一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一

文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。

量子位
新闻资讯7

被困住的日本数据中心

日本一座合资建设的数据中心是AI战略象征,承载训练大模型任务。但生成式AI兴起让数据中心成“电老虎”,与日本环保目标冲突。日本在发展AI与碳中和间艰难平衡,面临能源结构等多方面困局。

芯师爷
新闻资讯7

AI训练初创公司Mercor,年运收入4.5亿美元,冲击100亿美元估值

AI训练初创公司Mercor正洽谈C轮融资,目标估值100亿美元或更高。它为OpenAI等对接专家,还提供数据标注服务,年化运营收入近4.5亿美元,但也面临Surge AI等对手竞争,OpenAI新平台或带来新威胁。

AIGC开放社区
推荐文章8

Agent 如何用搜索?这家最懂 AI 搜索的团队,把踩过的坑都分享出来了

AI时代搜索与传统搜索大不同,人类搜索是静态检索,AI搜索是动态、流式、可追问的。小宿科技作为AI Agent基础设施提供商,分享了为Agent提供搜索服务的经验,包括不同场景下AI应用接入搜索的难点与解决方案。

Founder Park