「PhyT2V框架」共找到 3397 篇相关文章
BesiegeField:LLM能否学会设计机器?
香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。
告别微调!斯坦福提出Agentic上下文工程
当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。
让大模型学会“像人一样”查证真伪
伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。
清华开源首个股票k线大模型
清华开源首个股票K线大模型Kronos,是专为金融市场K线序列预训练的模型,处理金融数据高噪声特性。采用两阶段框架,有安装、预测步骤,还有批量预测方法,项目地址为https://github.com/shiyu-coder/Kronos。
突破LLM数据瓶颈:Meta等提出语言自我博弈,一台模型,两个角色,无限进化
Meta等团队提出“语言自我博弈”(LSP)框架,让语言模型自己和自己“玩游戏”,在无外部数据输入下自我改进。实验显示,其性能可媲美甚至超越用大量人类数据训练的模型,为缓解数据稀缺提供新思路。
真碾压Sora了!谷歌Veo 3首次实现音画同步,视频模型直接「开口说话」
谷歌正式发布Veo 3,它能生成高质量视频,还能理解原始像素,自动生成与画面同步的对话、多种音效。得益于DeepMind的V2A底层技术,其音画合成功能领先。虽有时长和使用门槛限制,但已足够震撼。
AutoResearch-LLM:让 Agent 接手 LLM 训练优化
本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。
Cursor新模型,你怎么还在套Kimi?马斯克你怎么还吆喝上了??
Cursor模型更新至Composer 2.5,测评成绩亮眼,性能接近Claude Opus 4.7,价格仅为其1/10。该模型以Kimi打底,在训练栈上做了改进。此外,Cursor与马斯克达成算力合作,走上自研之路。
GLM-5架构曝光,智谱两日涨60%:采用DeepSeek同款稀疏注意力
GitHub代码确认GLM - 5架构细节,它采用DeepSeek - V3/V3.2架构,含稀疏注意力和多Token预测,参数量745B。OpenRouter上神秘「Pony Alpha」被指是其测试版,受消息影响智谱AI港股两日涨60%。
小米在AI方向有了大动作,但AI不该是资本掩盖信息的手段。
今年下半年小米MiMo团队陆续开源多个模型,或因年初挖来技术天才罗福莉。新开源MiMo - V2 - Flash模型,总参数量309B。但小米AI对外服务网站搜自家产品舆论无果,引发对AI应坦诚审慎的思考。