「小模型性能」共找到 8714 篇相关文章
M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」
如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户零成本体验。
AI问答,直接「拍」给你看!来自快手可灵&香港城市大学
来自快手可灵团队和香港城市大学的研究者提出「视频作为答案」任务范式,发布VANS模型。它由视觉语言和视频扩散模型构成,通过联合分组相对策略优化算法协同优化,在教学和预测应用上效果超现有模型。
一个Dispatch Dtype引起的fp8 quant kernel性能问题
文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。
模型是谁的?LLM版权保护首个技术综述论文发布
浙江大学和君同未来团队发布《Copyright Protection for Large Language Models: A Survey of Methods, Challenges, and Trends》。论文以“模型指纹”为核心理念,打通三个技术流派,指出文本水印难护模型版权,还分析各类指纹技术优劣势并给出未来方向。
两种小金属卡了AI脖子,中国供应链占主导
在AI数据中心扩产潮中,IEEE点出铒和钇两个此前少被关注的小金属,它们分别用于数据中心长距离光通信网络和供电燃气轮机。我国占这两种小金属近100%产量,且分离加工能力强。
美团视频生成模型来了!一出手就是开源SOTA
美团开源视频生成模型LongCat - Video,参数13.6B,支持文生/图生视频,时长可达数分钟,生成视频真实自然,文生视频能力顶尖,整体质量优,采用MIT协议。还介绍了其功能、技术原理及美团此前的AI成果。
苹果分享 iOS 26 即将推出的 AI 基础模型的细节
苹果在技术报告中公布 iOS 26 新 AI 基础模型细节。该模型有 3B 参数和更大版本,前者在设备运行,后者用于私有云平台。介绍了架构、评估结果,还强调实现可信赖 AI 的方法。
OpenAI发布新模型 GPT-Rosalind:专攻生物学、药物发现和转化医学
OpenAI发布生命科学前沿推理模型GPT - Rosalind,目标是生物学研究等领域。它是生命科学模型系列首款产品,在多方向表现强。当前以研究预览版向特定合作机构开放,有意机构可申请。
从预测到干预,Aether AI为什么押注因果世界模型?
Aether AI 定义技术路线为「因果世界模型」,关注模型识别影响结果的变量、理解因果结构、模拟干预后果。它从预测未来的局限切入,介绍了因果能力的三类核心问题及研究成果,还用四层架构实现能力落地。创始人黄碧薇看好当下时机,从 Physical AI 切入创业。
FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性
FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。