「大模型预训练」共找到 9676 篇相关文章
「百万级」视频推理数据集!30+顶尖高校联合发布
AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。
Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定
现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。
LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?
LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合多步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。
Mythos:普通人能自由使用旗舰 AI 的时代,可能要结束了
两天前,Anthropic 发布最强模型 Claude Mythos Preview,各方位性能超 Opus 4.6 模型,却不公开发布,只面向少数合作方开放。这或预示普通人自由用旗舰 AI 的时代将结束,引发对 AI 未来商业与使用模式的思考。
Jina AI创业复盘:AI团队的Scaling Law是什么
本文是对 Jina AI 创始人肖涵的访谈,复盘六年创业历程。他两次转型,最终聚焦搜索底座模型,公司被 Elastic 收购。他分享创业得失,认为团队聚焦、高效运营是壁垒,还给出未来创业者专注、找优秀人才等建议。
腾讯混元Hy3发布:Agent能力和产品体验跃升
7月6日腾讯混元Hy3发布,智能水平强于同尺寸模型,比肩大尺寸旗舰模型,定价降低。它已接入多个业务,API上线腾讯云TokenHub。在多领域表现出色,性价比高,采用开源协议,将在多平台上线。
1/10成本、Opus 4.7级表现,Cursor甩出了性价比之王Composer 2.5
Cursor推出新模型Composer 2.5,成本仅为Claude Opus 4.7的1/10,性能几乎追平。它更智能,擅长处理长时任务,遵循复杂指令更可靠。未来一周使用额度翻倍,还宣布与SpaceXAI合作训练新模型。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。
60天融资数千万,何泳澔出任CTO!这家黑马冲刺「最后一公里」
本文报道具身智能赛道初创虚时科技,60天内累计完成数千万元融资,前地瓜机器人具身智能算法负责人何泳澔出任CTO。公司押注仿真训练解决机器人落地数据瓶颈,推出全链路闭环仿真训练系统,已获得工业场景订单。
混元 Hy3 发布:99% 的任务,够用了
腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。