参数化求解器」共找到 1472 篇相关文章

开源动态8

英伟达开源9B参数小模型,比Qwen3快6倍

英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。

量子位
推荐文章7

To Agent, not Human

软件开发正从面向人类转向面向Agent。作者将newtype内容生产系统CLI,供Agent使用。当前各种工具CLI,Skill生态爆发,技术栈含CLI、MCP、Skills、Framework四层。

newtype AI
新闻资讯7

OpenAI 宣布启动“全国人工智能教育研究院”:美国K-12教育全面AI

OpenAI宣布与美国教师联合会合作,启动‘全国人工智能教育研究院’,这是为期五年的计划,目标是为全美40万K12教育工作者提供AI培训和支持。OpenAI五年内投入1000万美元,计划在多地建中心。

AI寒武纪
开源动态8

当大模型陷入幻觉循环,如何用工程给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
开源动态8

给Agent加上知识图谱,开源版Palantir

Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片企业数据变成结构、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。

GitHubStore
新闻资讯8

Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖

Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。

花叔
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
技术文章8

加一个JVM参数,让系统可用率从95%提高到99.995%

文章针对高并发系统不稳定问题,定位是系统内存索引切换时 GC 压力大所致。围绕让索引尽早晋升、直接分配到老年代等思路探索优,经多番尝试,最终实现索引无感切换,使系统可用率达 99.995%。

阿里云开发者
产品应用7

Claude Code也要龙虾!凌晨床上发条消息,Mac Mini瞬间亮屏狂敲代码

Claude Code团队宣布新增Channels功能,可通过MCP控制会话,首批支持Telegram和Discord。用户能手机远程控制AI写代码,目前已灰度测试。不过其功能依赖会话存活,后续或接入更多平台。

新智元
算法论文7

ACL2025 | 传统符号语言传递知识太低效?探索LLM高效参数迁移可行性

中科院自动所谭宇乔等研究跨规模大模型参数知识迁移(PKT)可行性。指出传统符号语言传递知识低效,LLM 模仿此范式也有局限。提出新 Pre - Align PKT 范式,实验分析 PKT 效果,揭示神经不兼容性致其失败。

机器之心