文心大模型 X1.1」共找到 8376 篇相关文章

新闻资讯8

梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑

9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《自然》封面。该模型借助强化学习自主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。

InfoQ
产品应用8

神秘霸榜模型现真身:小米MiMo-V2 Pro,国内首个万亿参数+1M上下文,为Agent而生!

小米全新一代面向 Agent 的大模型家族官宣,包括 MiMo-V2-Pro Preview、MiMo-V2-Omni 和 MiMo-V2-TTS。MiMo-V2-Pro 性能优异,在多场景实测表现出色,技术有创新,API 开放且定价低,已融入小米多业务与生态。

机器之心
产品应用7

RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代具身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1。它搭载自研VLOA架构通用具身大模型Visics,面向多场景,能在真实世界完成任务闭环,具备多方面优势。

机器之心
新闻资讯8

马斯克首个编码模型上线,编程飙进Top5!这9位华人天团爆肝打造

xAI上线首个编码模型Grok Code Fast 1,速度快且性价比高,在编程基准测试中冲进前五。它全栈开发能力出色,背后核心团队华人学者占多半,xAI还给出提示词编写指南。

新智元
产品应用8

实测可灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测可灵2.5新视频模型,它已灰度内测并登上釜山电影节。与可灵2.1对比,可灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克
新闻资讯7

小扎的残酷算术题:砸6000亿搞AI,裁1.6万人省钱

路透社爆料Meta计划裁员20%约1.6万人,这或为其自2022年底以来最大规模裁员。与此同时,Meta在AI投入巨大,如6000亿美元建数据中心等,但模型表现不佳,如Llama 4反响平平、Avocado推迟发布。

新智元
产品应用8

只用国产GPU训练的大模型性能飙升100%!国内唯一,更懂你

科大讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音大模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。

新智元
产品应用7

字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流

文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,预训练语料丰富,后训练结合多种方法,推荐在huggingface体验。

CourseAI
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
新闻资讯8

AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入

AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。

量子位