「MiniMax-M2.5」共找到 3312 篇相关文章
BRIGHT榜单SOTA!人大&百度ReasonRank:用推理增强的段落重排序器
传统listwise在复杂查询表现差,近期工作泛化性不佳。人大与百度等提出ReasonRank,通过全自动合成13K推理数据及两阶段训练,在BRIGHT等榜单表现优异,且ReasonRank-7B比Rank1-7B快2.5倍。
拾象 AGI 观察:LLM 路线分化,AI 产品的非技术壁垒,Agent“保鲜窗口期”
这是「海外独角兽」的AI领域观察栏目访谈,拾象CEO李广密和财经作者张小珺梳理LLM领域信号。2025 Q2全球大模型爆发性强且分化,还提到AI Labs路线、产品壁垒、“保鲜窗口”及Agent体验等内容。
AI Coding 产品的陷阱:有 PMF 但还没有做到 BMPF
AI Coding 产品增长迅速,如 Lovable 预计年底 ARR 达 2.5 亿美金。但也暴露出盈利难题,多数产品利润为负。解决办法要么自建模型,但成本高;要么等大模型成本下降,却不太可行。AI Coding 产品或未实现 BMPF。
单卡可跑18万原子!分子模拟的“规模焦虑”该终结了
至知创新研究院UBio团队发布的UBio-MolFM v1.5,是可进行分子动力学模拟的机器学习原子间势函数。它在精度和规模上有提升,实测中表现优于经典力场,架构、数据和训练都有创新,误差降45%,速度提8倍,现已开源。
非Transformer架构落地之王,带着离线智能和原生记忆能力在上海WAIC浮出水面
在上海WAIC现场,RockAI展台的机器狗和灵巧手在离线状态表现出色,背后是其非Transformer架构的大模型Yan 2.0 Preview,有原生记忆和离线智能能力。该公司成立两年,押注此架构,产品已商业落地,还构想群体智能未来。
多模态AI黑马刷榜后再造神器:一个产品搞定图片视频播客生成,自带百种特效,大牛梅涛团队出品
AI大牛梅涛创立的智象未来公司推出vivago2.0(智小象AI),支持图片、视频、播客生成,有上百种特效模板,生图还能自动优化prompt。其依托HiDream - A1,结合HiDream - I1和HiDream - E1能力,团队技术实力强且融资顺利。
Qwen3 变身扩散语言模型?不从零训练也能跑,30B参数创纪录
扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。
12K Star 的 claude-seo:免费 SEO 审计能替掉哪些付费工具
2026年2月底GitHub上claude - seo仓库有3500 star,五个月后达12.3K star。该项目作者一人开发,能给站点做SEO审计。它把判断层抽出开源,审计后可直接改代码。不过也有动态渲染弱等问题。
不可思议!400B大模型在iPhone上跑起来了
一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。
一家低调的工业AI公司,用TPT跨越生成式AI鸿沟|甲子光年
麻省理工学院报告指出约95%生成式AI企业试点无实质回报,存在生成式AI鸿沟。工业AI落地难,中控技术的TPT及TPT 2模型,在兰州石化榆林化工应用效果好,其优势源于数据和行业经验,也体现了破局决心。