「中训练」共找到 4238 篇相关文章
老黄唱衰编程,GitHub CEO硬刚:放弃写代码等于放弃智能体未来话语权
GitHub CEO托马斯·多姆克在采访中反驳“编程无用论”,认为2025年是编程智能体之年,但未来仍属人类程序员。公司推出多个SWE智能体产品,Copilot用户增长显著,还将评估商业模式,专注打造最佳产品。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。
68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩
《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数大厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被大量静默弃用等,研究团队给出改进建议,官方也进行了回应。
仅隔一天,OpenAI同步上线o3和o4 mini,它们能调用ChatGPT里的多种工具,可基于图像思考。o3是强大推理模型,o4-mini专为快速经济推理优化。即日起部分会员可体验,还开源了Codex CLI。
ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律
openJiuwen社区的ScienceDiscovery把科研试错交给程序,通过树搜索实现科研场景产物RSI。它能在多个案例中高效产出成果,成本低、耗时短,且底座灵活,可换算法和任务,但推广需解决验证速度和可信度问题。
刚刚,Top级的视频AI免费了!我反手做了个精致版《牛来》
明星AI实验室Agnes发布的Agnes Video 2.5系列已上线Pavo创作平台。其中,Agnes Video 2.5 Flash免费,适合AI短剧创作者;Agnes Video 2.5每天送积分,适合商业场景。实测显示其效果佳,免费还能大胆试错。
突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
给Cursor、Claude Code装上这个CLI,能变现
teamai-cli 是腾讯开源的命令行工具,能集中管理团队调教 AI 编程助手的成果,同步给全团队。它复用软件工程方法,解决 AI 协作中经验不沉淀、行为不一致等问题,让 AI 能力从个人资产变为团队资产。
写2000字提示词,不如先一键生成3D白模!AI视频创作进入“预演时代”
随着AI模型能力增强,科班人士利用其专业能力在AI视频创作赛道优势明显。updream预演台将影视行业预演工作流引入创作画布,解决了AI视频生成中‘拍什么’和‘怎么拍’的问题,虽有局限但意义重大。
Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!
8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。