浮点数非结合性」共找到 1159 篇相关文章

算法论文8

谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发学新构造

著名学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合

机器之心
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等多机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
开源动态8

WAIC抢先爆料:金融“黑马”大模型超DeepSeek刷新SOTA,论文已上线

WAIC期间,蚂蚁科金融推理大模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁科还提出评测基准Finova。

量子位
新闻资讯7

Karpathy 教它的 nanochat 单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 单词里字母 r 的量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
算法论文8

Tool-Star:赋予大模型结合多工具推理的能力

文章提出Tool - Star框架,旨在解决大模型多工具协作推理难题。它从据端到训练流程优化,让模型调用多种工具,在复杂计算和知识型推理任务表现卓越,还探讨了未来多模态及多工具扩展方向。

PaperAgent
推荐文章7

刚刚,Anthropic 工程师公开了内部百个 Skill 的打造秘诀

Anthropic工程师Thariq分享Claude Code Skills打造经验,介绍Skill类型、写作技巧、分享与度量方法。指出Skill是文件夹,有九大类,还给出九条写作技巧,强调好Skill在实践中成长。

AGI Hunt
新闻资讯8

刚刚,GPT-5.5 Instant全员免费!亿人的ChatGPT变了

OpenAI深夜推出GPT - 5.5 Instant,全面接管ChatGPT默认模型且全员免费。它亮点诸多,如幻觉率暴降、学成绩提升、回复字减少、记忆和个性化功能升级等,三个月后GPT - 5.3将退役。

新智元
新闻资讯8

15 块钱的纸手机,看哭无人的 AI 短片

清明节,一支AI制作的短片刷屏,讲述小男孩用15块钱买手机想和去世奶奶通话,老板画纸板手机圆其念想,后又追出去给真手机。短片用纸手机装下思念,展现人心善意。

搜狐看展
开源动态8

Karpathy强推,大厂抢着「复古」命令行,Star全都上千了

飞书、钉钉、企业微信接连推出 CLI,GitHub Star 上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。

机器之心