基础数学研究」共找到 2624 篇相关文章

算法论文8

68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数大厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被大量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
新闻资讯8

清华突破「光毒性」难题,活体显微进入无扰观测时代

清华大学团队研发出LF-denoising自监督去噪算法,可在超低光毒性下实现长时间高保真三维亚细胞成像,突破了长时间活体成像的光毒性限制,为多领域研究提供新工具。

新智元
算法论文8

DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代稀疏模型提前剧透

DeepSeek最新论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。

量子位
新闻资讯7

创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系

2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。

郎园Station
新闻资讯7

250份文档就能给大模型植入后门:不分参数规模

Claude母公司Anthropic联合英国AISI和图灵研究研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。

量子位
开源动态8

出自小米的模块化图像编辑改造:让 AI 学会「搭积木」

小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。

AGI Hunt
算法论文8

大突破!实验证明,RL能为LLM注入“创新”能力

研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。

深度学习自然语言处理
新闻资讯8

AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河

在 AICon 大会上,IDEA 研究院张磊剖析多模态智能体发展难题,提出从“半结构化”场景切入的落地路径,分享工业界研究与产品平衡见解,还为年轻人在 AI 浪潮中发展给出建议。

AI前线
新闻资讯8

刚刚,GPT-5.5 Instant全员免费!数亿人的ChatGPT变了

OpenAI深夜推出GPT - 5.5 Instant,全面接管ChatGPT默认模型且全员免费。它亮点诸多,如幻觉率暴降、数学成绩提升、回复字数减少、记忆和个性化功能升级等,三个月后GPT - 5.3将退役。

新智元
算法论文8

用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题

Mila唐建团队发表PerturbDiff,跳出前人认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,在多项基准测试霸榜,还提供应对数据稀缺的思路。

量子位