「Qwen2.5-0.5B」共找到 3974 篇相关文章
实测DeepSeek V3.1,不止拓展上下文长度
文章实测了DeepSeek V3.1和V3,发现V3.1在编程、写作、翻译等方面有变化,如编程更全面、写作风格变文艺等。网友测试其在aider得分71.6%成非推理模型SOTA,但线上API有问题。
Sam Altman :GPT-6已经在路上,DeepSeek是OpenAI开源重要因素
Sam Altman称GPT-6已在路上,节奏比GPT4到GPT5间隔更快,记忆是其重要方向。他还认为美国低估中国AI,像DeepSeek等中国开源系统是OpenAI开源重要因素。
扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta
本周五,前OpenAI研究科学家Hyung Won Chung晒照,显示他、孙之清与Jason Wei已加入Meta新成立的超级智能实验室。孙之清曾是ChatGPT Agent核心开发者,还和山姆・奥特曼直播发布该产品,一个月后跳槽。
鸿蒙终端数量突破千万后,华为发布亿元级应用开发激励计划
华为宣布搭载HarmonyOS 5的终端数量突破千万后,推出「鸿蒙应用开发者激励计划2025」,上亿元补贴,单个开发者累计奖金上限600万。该计划激励力度更大、应用形态更广,意在引导开发者长期投入。
行业新突破:行为基础模型可实现高效的人形机器人全身控制
该综述聚焦行为基础模型(BFM)在人形机器人全身控制中的应用,梳理进展并分类算法,介绍应用与限制,还探讨未来研究机会与风险,有望引导该领域研究者和从业者。
打脸OpenAI!谷歌Gemini高级版获IMO 2025官方认证金牌:纯自然语言端到端推理
谷歌DeepMind宣布高级版Gemini在2025年IMO中6题解5题获金牌,经官方认证,全程用自然语言推理。对比OpenAI自我宣称拿金牌,谷歌成绩更有说服力,还介绍了Gemini进步及实现方法。
浙商大佬,带出350亿芯片独角兽
68岁浙商大佬王东升二次创业,投身半导体领域。他带领奕斯伟计算,锚定RISC - V指令集砸钱研发,虽三年累计亏损49.5亿,但D轮融资后估值达350亿,还四处扩建朋友圈推动生态建设。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
30余家单位确认加入,国内首部AI数据标注标准欢迎参与起草!
数据标注对AI产业发展至关重要,但行业存在合规问题。国内首部AI数据标注合规标准《面向人工智能的数据标注合规指南》应运而生,草案稿研讨会已召开,30余家单位已加入,现诚邀相关单位参与起草。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。