测试时计算」共找到 1858 篇相关文章

产品应用8

准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升

Memento - Skills系统抛弃大量力微调模型参数的方式,靠读写反思、“写日记”式学习机制,在不改变模型参数下实现能力跃升,在GAIA和HLE基准实验中准确率显著提高。

AIGC开放社区
新闻资讯8

黄仁勋,开启智元(Token)时代

全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。

新智元
新闻资讯7

发 token 当工资?工程师不只拿现金和期权,开始按 token 分身价了

硅谷正用 token 吸引人才,国内也有类似趋势。AI 使用成本渐成人力成本关键,token 对应力争夺,其价格上涨,大厂还想将 token 变成新价值单位,引发质疑。

InfoQ
开源动态8

最强开源搜索再升级,研究、预测能力实测超惊艳!

MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。

开源先锋
新闻资讯7

挺搞笑,MiniMax模型就是不认识「马嘉祺」

网友发现 MiniMax 模型不认识「马嘉祺」,不同接口和平台均能稳定复现。这或因训练数据清洗和分布问题,使特定词汇生成异常。论文指出 tokenizer 机制缺陷或致模型异常,问题不会随参数规模增大消失。

机器之心
算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
新闻资讯7

配置一改就要重启的时代结束了:Dev Proxy 2.1 正式上线

Dev Proxy团队发布2.1版本,围绕开发效率和本地测试体验更新,有配置热重载、stdio流量代理等新功能,还改进配置、性能及细节问题。Dev Proxy Toolkit 1.12同步发布。

InfoQ
产品应用8

马斯克视频生成模型首次交卷!电影级运镜+音效,免费可玩

xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网可免费玩。

量子位
开源动态8

蚂蚁抛弃向量推荐!用8B小模型构建「用户“话”像」,实现跨模型通用并拿下SOTA

2026年AI开发者关注爆款大模型应用,个性化是关键。蚂蚁集团和东北大学团队推出AlignXplore+,实现文本化用户建模新范式,有全域通用、极致迁移、实战适配特性,小参数超越基线,未来将继续探索。

量子位
算法论文8

拒绝计“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”

现代大语言模型用全注意力机制计复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。

深度学习自然语言处理