Llama 3」共找到 2055 篇相关文章

算法论文8

北大团队让AI学会考古!全球首个古希腊陶罐3D视觉问答数据集发布,还配了专用模型

北大团队推出全球首个面向古希腊陶罐的3D视觉问答数据集VaseVQA - 3D,配套专用视觉语言模型VaseVLM。传统模型面对文化遗产复杂对象有不足,新数据集和模型让AI迈向‘文化考古Agent’,未来将拓展到更多领域。

量子位
产品应用8

新一代AI教师是什么样?学而思让它从L2「助手」跃迁至L3「老师」

在AI应用落地成关键的当下,教育成AI融合创新前沿。好未来CTO田密提出「AI教师L1 - L5分级」理论,指出当前AI老师达L2水平,L3正演进。学而思学习机的「小思AI一对一」迈向L3,依托硬件和自研大模型,结合优质内容,从可用走向可信。

机器之心
产品应用7

不用花Anthropic API的钱,本地跑Qwen3.5就能用Claude Code

文章介绍不花Anthropic API的钱,用本地Qwen3.5跑Claude Code的方法。包括选模型、编译安装llama.cpp、下载量化模型、启动本地服务、配置Claude Code指向本地服务等步骤,还提及踩坑建议和使用方法。

AI工程化
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
新闻资讯7

LlaMa 辞职事件之后,微软被爆AI 部门裁员波及6000人!包括AI总监

微软突然宣布裁员约6000人,占全球员工总数3%,横跨多条产品线,AI总监也被裁。官方称是为集中资源,员工不满靠模型决定去留。同时,Meta的LLaMA团队也有人员离职,折射AI行业资金与人才的矛盾。

AGI Hunt
开源动态8

阿里 Qwen3:持续开源,SOTA 连连!

很多从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在多方向发力且拿下多个开源榜单第一。

特工宇宙
新闻资讯8

刚刚,阿里发布最强推理模型Qwen3-2507,用疯狂一周暴击美国AI行动计划!

美国发布AI行动计划,欲成“世界AI冠军”,但阿里在7月22 - 25日三连发,推出Qwen3 - 235B非思考版本、Qwen3 - Coder、Qwen3 - 235B - A22B - Thinking - 2507推理模型,冲击美国计划。千问3在多领域表现出色,不过也有使用费用等小问题。

AGI Hunt
新闻资讯7

「硅谷大乱」小扎挖人细节来了:4年总包3亿美金,第一年可直接获得1亿美金,被OpenAI多人拒绝

为组建Meta超级智能团队,挽回Llama4失败局面,扎克伯格简单粗暴挖人,开出四年总包超3亿美元、首年到手1亿的薪酬,还提供领先算力。至少10名OpenAI员工拒绝,这撕裂了硅谷“使命驱动”文化。

AI寒武纪
开源动态8

The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战

阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。

DeeplearningAI
新闻资讯8

刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃

深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在多场景表现出色。已面向不同群体开放。

机器之心