「等变建模」共找到 8450 篇相关文章

算法论文8

模型「漂移」新范式,何恺明新作让生成模型无须迭代推理

训练生成模型复杂,传统扩散模型训练费时费力。何恺明团队提出「漂移模型」新范式,不依赖微分方程,支持一步推理,实验验证其在多领域性能佳,有望解决生成式AI质量与效率权衡问题。

机器之心
推荐文章8

Agent面向结果交付,技术正从单点突破加速转向工程与系统竞争 |《中国软件技术发展洞察和趋势预测研究报告 2026》正式发布

2025 年技术热点不断,竞争重心从单点突破转向系统级等竞争。InfoQ 研究中心发布《中国软件技术发展洞察和趋势预测研究报告 2026》,盘点技术发展,还展望 2026 年十大技术趋势。

InfoQ
产品应用8

Codex 独立 App 来了,这是一个新东西

OpenAI 推出 Codex 独立桌面应用,或改变 AI 编码方式。它是 Agent 的指挥中心,有 Worktree、Skills、Automations 等功能,支持双个性模式和安全沙箱,限时开放且付费用户额度翻倍。

AGI Hunt
算法论文8

一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线

Anthropic和牛津大学研究发现,大模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。

AIGC开放社区
产品应用7

Clawdbot为何大火?

LLM记忆问题是业界难题,Clawdbot采用极简方式破解,用写Markdown实现记忆。其记忆系统优势明显,如极简易用、透明可控等,但也有劣势,像数据扩容能力有限、功能扩展性不足等。

CourseAI
新闻资讯7

LeCun离职后不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会

离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。

量子位
开源动态8

刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」

年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。

PaperAgent
开源动态7

RunAnywhere:简单几步让AI应用跑在手机上

介绍能在手机本地运行的大模型项目RunAnywhere,它让开发者在iPhone 16 Pro Max部署Llama 3.2 3B模型。AI处理本地化,用React Native和RunAnywhere SDK,支持多模型,有多种功能,优势明显。

AI工程化
新闻资讯7

中美服务器CPU供不应求

受AI算力需求增长驱动,存储芯片自2025年进入“超级牛市”。2026年服务器CPU也供不应求,英特尔和AMD考虑提价。缺货因云厂商抢货及厂商供需错配,相关芯片股走强。

芯师爷
开源动态8

Clawdbot爆火:Karpathy点赞的开源AI助理,到底是什么?

这两天AI圈被Clawdbot项目刷屏。它是能在手机已有应用中工作的AI助理,有记忆、会主动联系用户、能执行任务。它可在廉价云服务器运行,能力分两层级,成本每月25 - 150美元。

AI寒武纪