预测方法」共找到 1919 篇相关文章

产品应用7

字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流

文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,预训练语料丰富,后训练结合多种方法,推荐在huggingface体验。

CourseAI
开源动态8

60000小时炼出新开源VLA!20多种机器人都能用

蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。

量子位
算法论文7

近期,不错的LLM Agent统一记忆框架综述~

随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。

PaperAgent
推荐文章8

以前写书比看书慢,现在看书比写书慢——AI时代最被低估的变局

AI时代信息生产速度超消费速度,这是文明范式转移。过去知识稀缺,现在过剩,多数人应对信息爆炸的方法有误。应从消费信息转为使用信息,这还会重塑教育、社交与社会分层。

AI Reading Hub
推荐文章7

搞不懂Skills?看看Claude Code内部工程师们是怎么玩的

文章来自Anthropic的Claude Code团队工程师,介绍了Claude Code中Skills功能。阐述Skills定义、类型,给出制作技巧,如避免陈述显而易见内容、构建陷阱部分等,还提及分发、管理、组合及衡量效果的方法

机器之心
8

重磅发现!大模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民大学等联合团队研究发现,大模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心
算法论文8

规范对齐:回答前的深思,让安全与行为边界更清晰

OpenAI等厂商将规范融入大模型。上海交大等团队提出规范对齐概念,构建评测基准SpecBench,揭示主流模型不足。探索测试时深思方法,如Align3,能提升模型规范遵循度,项目已开源。

深度学习自然语言处理
推荐文章8

谁在赚钱,谁爱花钱,谁是草台班子,2025 年度最全面的 AI 报告

Nathan Benaich发布《State of AI Report(2025)》,如AI全景地图,覆盖研究、行业等领域。2025年AI业务赶上炒作,模型竞争激烈,开源、智能体等发展显著,还对未来一年AI发展作出预测

Founder Park
产品应用7

Ollama 推出免费搜索API + MCP集成:Cline、Codex一键接入网络搜索( + Qwen 搭建迷你搜索代理 )

Ollama推出免费Web搜索API,个人使用免费,本地和云端模型均可调用,还出了MCP服务器。它能让开源模型执行长期研究任务,还介绍了用其与Qwen搭建迷你搜索代理及MCP集成的方法

AI进修生
开源动态8

腾讯AI Lab开源可复现的深度研究智能体,最大限度降低外部依赖

腾讯AI Lab推出全开源智能体框架Cognitive Kernel - Pro,解决现有开源框架依赖付费工具问题。它有模块化架构等核心设计,创新训练方法,在多任务中表现出色,降低外部依赖,相关论文登HuggingFace热榜。

量子位