Llama-4-Maverick-17B」共找到 1602 篇相关文章

新闻资讯7

78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队大溃散引争议

据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta大模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。

AI科技大本营
算法论文8

首创像素空间推理,7B模型领先GPT-4o,让VLM能像人类一样「眼脑并用」

当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作能力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM能像人类一样「眼脑并用」,在四大视觉推理基准测试中,7B的Pixel - Reasoner表现碾压GPT - 4o等。

量子位
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
产品应用7

刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升超36%,V4/R2还远吗?

DeepSeek最新模型DeepSeek-V3.1-Terminus发布,解决了此前输出随机带「极」字、中英文混杂等问题,在多个基准测试中成绩提升,最大提升超36%,Agent能力也有进步,还引发网友对V4/R2的期待。

新智元
开源动态8

项目在GitHub上已获得约3600+star,探秘 ChatDoctor:LLaMA 微调后的 AI 医生,真能在线问诊?

现代医疗资源不均、问诊效率低,ChatDoctor应运而生。它基于LLaMA微调,有医学对话微调等亮点,技术优势多,适用于在线问诊等场景,与同类对比优势明显,开源助力医疗对话模型发展。

小华同学ai
产品应用8

一夜暴涨至2100亿!开源新王MiniMax M2.5,革了Opus 4.6的命

新智元报道,国产AI春节档,MiniMax M2.5昨夜登场,今日市值涨至2108亿港元。其编码性能逼平Claude Opus 4.6,价格仅为1/20,适配开发者工具,在办公、深度研究等场景表现出色,基于Agent RL技术体系。

新智元
产品应用7

智能体请求暴增9.4倍,token账单却没涨:Uber 公开AI软件工厂省钱方法

Uber 在 2026 年 AI 工程师大会分享软件工厂愿景。其 AI 工具嵌入开发各阶段,2 至 8 月智能体请求增 9.4 倍,成本稳定。介绍智能体会话四层、成本公式及优化手段,如选优模型、优化 token 等。

AI前线
产品应用7

AI花17小时写了篇30页学术论文!自主选题,包含实验,还符合APA格式规范

Virtuous Machines AI系统花17小时、114美元,找288个真人做实验,写了篇30页认知心理学领域学术论文,从选题到成稿全自动化。其架构独特,不过也存在理论误解等小缺点。

量子位
新闻资讯8

重磅!Claude Sonnet 4.5发布,可连续编程30小时,Claude Code同款构建工具也开放了

Anthropic发布Claude Sonnet 4.5,官方称是全球最强代码、复杂智能体构建及擅用计算机的模型。伴随产品全家桶升级,还开放Claude Code构建工具,发布Imagine with Claude。该模型能力强且更安全。

AI寒武纪
产品应用8

Anthropic 深夜祭出 Claude Sonnet 4.5,能自主工作 30 小时!CEO:它更像你的同事

昨夜凌晨,Anthropic 推出新一代模型 Claude Sonnet 4.5,官方称其是世界上最好的编码模型等。该模型性能跑分登顶,工程落地能力强,还带来产品生态升级,开放 Agent SDK,误报率降低,价格亲民。

InfoQ