「Qwen-0.6B」共找到 1852 篇相关文章
aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍
3月25日,硅心科技发布专为代码变更应用场景设计的模型aiX - apply - 4B。它平均准确率达93.8%,超越Qwen3 - 4B和DeepSeek - V3.2,算力成本仅为后者5%,推理速度提15倍。还采用创新训练方法,适配企业场景。
阿里千问落地谷歌UCP+A2UI,中国率先进入AI办事时代
谷歌联合零售巨头发布UCP和A2UI协议,试图定义智能体商务全球标准。而阿里千问App上线千问任务助理1.0,打通淘宝、支付宝等核心业务,接入多项生活与政务服务,快速落地应用,让中国进入AI办事时代。
Karpathy、Claude Code之父Boris,最新访谈,把整个程序员圈炸了!
假期红衫AI Ascent 2026上,Claude Code之父Boris与Karpathy演讲引发关注。Boris称编程执行层已解决,他用Claude App工作,全公司代码由模型生成;Karpathy提出Software 3.0概念,还谈到模型能力不均匀。两人还对面试、创业等给出看法。
4.55亿美金!中国具身智能最大单笔融资诞生,高瓴红杉联手押注具身大脑
近日,成立仅一年的它石智航完成4.55亿美金Pre - A轮融资,刷新中国具身智能最高单轮融资纪录。高瓴、红杉等20余家机构投资。其战略重投大脑和人才,大脑AWE 3.0能力突出,还在高难度场景落地领先。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
万亿思考模型新速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!
蚂蚁集团发布全球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和全模态大模型Ming - flash - omni - 2.0,想做成可复用底座。
对话罗剑岚:机器人必须在真实世界中持续变强
DeepTech对话智元机器人首席科学家罗剑岚,围绕其团队发布的机器人世界模型τ0 - WM展开。罗剑岚认为机器人不能只在静态数据集上模仿,要能预测动作后果,还探讨了数据作用、工作关系及开源意义等。
LangChain 彻底重写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值
本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的重写。它最初是副业,后成热门开源项目,此次重写解决了过往问题。
百度造了个“AI星舰”?或成业界最完备的企业级AI平台
在2025百度云智大会上,百度智能云千帆企业级AI开发平台发布4.0新版本,核心聚焦Agent。它一站式提供开发所需能力,解决模型选型、数据盘活等难题,还有RFT工具链降精调门槛,“白盒化”助问题诊断。
13小时不眠不休,300个分身狂敲代码!开源第一易主了
4月20日深夜,Kimi K2.6出道即开源,展示了强大的「全栈交付」能力,跑分超GPT - 5.4等。它能完成多类型官网制作,300个Agent协作能力强,还能复刻高盛研报、交付三件套,其Claw群组开启小范围测试。