大模型技术」共找到 10347 篇相关文章

开源动态7

超越ZIP的无损压缩来了!华盛顿学让模型成为无损文本压缩器

华盛顿学SyFI实验室提出LLMc,利用型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
算法论文8

ACL'25 | CIGEval:一种基于多模态模型的可控生图评测智能体

阿里国际AI团队提出CIGEval,这是基于多模态模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。

PaperAgent
算法论文8

ICML 2026 |让模型边想边说:这篇文章把「何时开口」变成可学习策略

论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。

机器之心
开源动态8

首创TTFA指标!港团队开源FASTER,让VLA模型真正实现「即刻响应」

团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。

机器之心
新闻资讯7

独家 | 开普勒联合创始人胡德波成立「索塔无界」,聚焦通用基座模型+海外市场

AI科技评论独家消息,开普勒机器人联合创始人胡德波2026年4月成立索塔无界。该公司聚焦通用基座模型,以统一潜空间世界动作模型为核心,提出物理智能技术路线,已与欧美企业达成合作意向。

AI科技评论
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
算法论文8

除了prompting外,不动参数,如何改变模型行为?

文章指出传统提示工程控制模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏自编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果超现有技术,还能控制推理长度。

深度学习自然语言处理
算法论文9

从自己出题到自己选题:耶鲁新方法让模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城夺冠CVRP国际顶级赛事

近日,华为与港城联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心