「LFM2.5-1.2B-Thinking」共找到 4437 篇相关文章
3天5k+星标,港大开源极致轻量OpenClaw, 1%代码量打造个人专属贾维斯
硅谷被 Agent(OpenClaw/ClawdBot)刷屏,但 40 万 + 行代码让开发者望而却步。港大黄超老师课题组将其重构为 4000 行的 nanobot,保留功能且降低门槛,上线三天获 5000+ 星标。
谷歌王炸开源编程 Agent:Gemini 2.5 Pro 塞进命令行,每天1000 次免费调用,重新定义 CLI 开发体验
谷歌正式开源 AI 编程智能体 Gemini CLI,它是全能终端 Copilot,免费且开源,免费额度高,不止编程,还原生集成。能满足开发者在 CLI 中对集成式 AI 辅助的需求,带来全新开发体验。
2天1k多星!BAGEL横空出世:字节跳动发布全球首个多模态全能AI,开启智能新纪元!
字节跳动推出开源多模态基础模型BAGEL,有70亿活跃参数。它在多模态理解排行榜超顶尖开源模型,文本到图像质量与SD3媲美,还具备世界建模等能力,文中介绍其方法、特性及使用说明。
NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1
NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。
实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型
今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。
DeepSeek-V3.2正式版发布,将开源模型的能力推向极致
DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。
AMD苏姿丰公开怼扎克伯格!反对1亿年薪挖人,“使命感比钞票更重要“
AI人才争夺战激烈,Meta扎克伯格开1亿美元年薪挖人,AMD苏姿丰明确反对,称钱非最重要,使命感才是,还指出天价挖人会摧毁公司文化,AMD不靠此也吸引到人才。
哈?Q1狂烧250亿!OpenAI财报泄露全网炸锅
最新泄露财报显示,2025年OpenAI收入130.7亿美元,支出340亿,亏损385亿。今年Q1收入57亿美元,却烧掉37亿。虽账上现金充裕,但后续烧钱预计递增。与Anthropic对比,财务状况差异大。不过亏损不绝对影响其IPO。
小红书提出社交大模型RedOne 2.0:兼听、敏行
在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。
Code2Video:全新AI教学视频生成框架,助力高质量教学
生成式模型在生成专业教育视频时受限,新加坡国立大学Show Lab提出Code2Video框架,以代码为中心,由三个协作智能体组成,能通过Python代码自动生成高质量教育视频,代码驱动生成优势明显。