LFM2.5-1.2B-Thinking」共找到 4437 篇相关文章

开源动态8

英伟达巧用8B模型秒掉GPT-5,开源了

英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。

量子位
产品应用8

Sora 2 中国首测?Open AI 这次真成了!

OpenAI提前发布Sora 2模型,可克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。

歸藏的AI工具箱
产品应用8

从操作系统到Agent Team,字节Seed 2.0来了!

作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。

AI产品黄叔
新闻资讯7

Thinking Machines Lab获20亿美元,没发布任何产品

前OpenAI首席技术官Mira Murati创立的Thinking Machines Lab获20亿美元种子轮融资,对该保密公司估值达120亿美元。投资者众多,公司将在未来几个月推出含开源组件的首款产品,还会分享科研成果。

AIGC开放社区
新闻资讯7

奥特曼:我承认GPT-5发布搞砸了

GPT-5发布堪称AI圈翻车现场,OpenAI一刀切下架其他型号后又加回GPT-4o。奥特曼承认搞砸,称学到为亿人升级产品的教训。他还有建数据中心、投资脑机接口等计划,也指出存在AI泡沫。

量子位
开源动态7

智谱GLM-5强调的Agentic Engineering能力是什么?|甲子光年

智谱上线并开源GLM - 5,在Coding与Agent能力上达开源SOTA,刺激股价上涨。它验证了Agentic Engineering可行性,提升能力阈值,但成本阈值也更显性,未来软件工程或分层发展。

甲子光年
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
开源动态7

一周1.2k星!兼具质量与效率的OCR模型MonkeyOCR,支持多样化的中英文PDF

MonkeyOCR采用SRR三元组范式,简化多工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。

GitHubStore
新闻资讯8

Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角

上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。

花叔
算法论文8

微软:DeepSeek-R1等推理模型循环的原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点是推理模型在低温/贪心解码下易循环,根源是学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent