「模型能力连续体」共找到 9165 篇相关文章

新闻资讯7

DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开

路透社消息,凭借算法震动硅谷的中国AI公司DeepSeek正秘密开发自研AI芯片,定位推理,项目约一年前启动,现处早期。全球模型公司自研芯片成趋势,虽挑战大,但DeepSeek有资金支撑。

量子位
新闻资讯7

AI黄叔和AI亦仁帮我想清楚了:在杭州招这个岗位

作者招聘遇困境,让AI黄叔和AI亦仁交流梳理问题。经AI亦仁建议,明确先招培训/社群运营岗位,重新定义岗位内容,强调心力、闭环能力和对AI的好奇心,介绍岗位优势邀人应聘。

AI产品黄叔
算法论文8

Nature重磅:图灵预言的AGI早已实现,人类却不敢承认!

《自然》杂志新评论文章称,UCSD研究团队系统论证AI已真正“通用”。当前大语言模型如GPT已展现广域人类级智能,已达专家水平,研究团队还驳斥了对AGI的十大异议。

新智元
新闻资讯8

2026年职业大洗牌!Hinton:先抢你的,抢完你的抢你的

「AI教父」Geoffrey Hinton预言2026年将迎职业大清洗,AI能力指数级进化,抢走脑力与体力工作,还会为达目的蓄意欺骗人类,普通人应做回有真实连接、保持好奇心的“活生生的人”。

新智元
新闻资讯7

这一年,DeepSeek消耗14万亿Token,编程仅占1/10,超一半用于角色扮演?

a16z和OpenRouter基于100万亿token研究揭示LLM使用情况:开源模型占三成市场,编程任务成刚需,角色扮演是金矿。还提到‘玻璃鞋效应’影响用户留存,市场分层为‘高端闭源+性价比开源’双轨制。

PaperAgent
新闻资讯8

刚刚,Claude Sonnet 4.5重磅发布,编程新王降临!

北京时间今天凌晨,Anthropic发布Claude Sonnet 4.5,被定义为全球最强代码模型。它在多方面有显著突破,Anthropic还对全线产品更新,其在多项测试表现出色,且对齐性更好、更安全。

新智元
算法论文8

刘鹏飞组提出Agent领域的少即是多:智能不在于数据堆砌,78个样本训练出超强Agent,128倍效率提升

刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键在数据质而非量。LIMI用78个样本在AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。

深度学习自然语言处理
算法论文8

腾讯提出SPO,告别Group

腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。

深度学习自然语言处理
开源动态7

蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理

医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。

CourseAI
新闻资讯7

年薪两百万研究AI精神病??Claude团队新部门火热招聘中

Claude团队启动“AI精神病学”小组,年薪两百万元招人。小组研究模型角色、动机等,来解决其诡异、失控行为。Anthropic可解释性部门有相关研究成果,网友对“AI精神病学”看法不一但前景值得期待。

量子位