「模型问题」共找到 9544 篇相关文章
美团开源Agentic新王,速度拉满,工具调用打爆Kimi?
周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。
Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?
LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。
JManus - 面向 Java 开发者的开源通用智能体
在Manus火热背景下,Spring AI Alibaba JManus诞生,它是用Java实现的开源OpenManus。可集成多个大模型,功能完善,能让Java开发者低门槛搭建智能体系统,还给出了运行方法及共建思路。
Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39
Claude Fable 5消失19天后全球再上线,7月1 - 7日Pro等订阅用户可用,但额度受限。它实力强但贵,与多模型对比表现优,远程工作能力突出。不过使用限制变多,安全分类器易误伤。
月薪3万,去内蒙草原给DeepSeek守机房
深度求索放出数据中心高级运维工程师等岗位,要将效率至上哲学从软件延伸到机房运营。其选择乌兰察布建数据中心,因当地条件优、产业生态成熟。且传闻其新一代大模型V4将发布,算力成决胜关键。
阿里WebDancer:训练类DeepReaserch的Agentic Model
来自阿里巴巴通义实验室的研究员推出WebDancer,这是一个原生信息检索的Agentic Model,能自主浏览网页、思考和决策。它基于ReAct框架,经多阶段训练,在信息检索基准测试中表现出色,为解决复杂检索问题提供新思路。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
别怀疑,就是这么强!!!13.7k Star Casdoor,爽爽爽爽爽~~~~
Casdoor是可自己部署的IAM/SSO服务端,像“身份门”,一次认证后将多种身份管理功能集成。它协议覆盖广、能衔接认证与权限管理等。但使用时也得认真治理,避免越权问题。
突破三维感知瓶颈:魔芯科技发布VGGT系列成果,实现动态高保真重建并获新一轮融资
魔芯科技联合同济大学等团队,基于 VGGT 架构发布四项成果,突破三维感知在流式处理、动态鲁棒性和精细感知上的瓶颈。还获新一轮融资,后续将加大对空间智能与世界模型技术投入。
52k Star,Hermes Agent试图杀死OpenClaw
近期龙虾(OpenClaw)热度下降,harmess engineering大火。开源项目hermes-agent已有52.7k Star,是自学习型AI智能体,能积累技能、持续学习,可轻松切换多种模型,还给出安装、使用指南和文档教程。