「多任务训练」共找到 6694 篇相关文章
穿越周期的早期投资:从赛道思维到认知红利|甲子引力
2025 年 12 月 3 日,「甲子光年」举办年终盛典,科技产业投资专场圆桌对话探讨早期投资从“赛道思维”到“认知红利”转变。英诺王晟主持,红杉张涵等嘉宾参与,指出决胜点在对人、周期和非共识的理解。
Alex Wang“没资格接替我”!Yann LeCun揭露Meta AI“内斗”真相,直言AGI是“彻头彻尾的胡扯”
图灵奖得主 Yann LeCun 在访谈中,尖锐评价当前 AI 发展路径,认为规模化大模型是死胡同。他正通过新公司 AMI 推动“世界模型”技术路线,还谈到 AI 关键要素、安全等问题,与主流观点分歧明显。
Medeo 教程:一次生成无脑抽卡不可取,真正的视频 Agent 应该啥样
本文介绍AI视频生成Agent Medeo 1.0版本,它支持短或超长提示词,泛化性好,多种垂类视频都能做。文中介绍其基础操作、展示案例和提示词,还剖析了能兼顾质量与灵活度的原因,目前产品在内测将全量上线。
没了遥控器,还被扔进荒野,具身智能该「断奶」了
在第五届ATEC科技精英赛上,人形机器人在户外场景状况百出,如摔倒、罢工等。专家认为过去高估其通用能力,五年内走进家庭承担家务较难。具身智能面临感知、决策、硬件等难题,但也有队伍取得成果。
10人创业团干翻行业“潜规则”!全员必须会AI、让跑大模型全程“裸奔”,谷歌老兵不烧钱创业
谷歌老兵Bryan Zhou投身AI创业,组建AnyInt团队。该平台定位AI Infra中间件,一个API对接所有模型,提倡“去中心化”。团队一开始就奔着付费用户,还做了极致性能优化,吸引众多开发者。
OpenAI 收购了自己的“甲方”公司
当地时间12月3日,OpenAI宣布收购Neptune.ai,该公司为企业提供AI模型训练跟踪工具,OpenAI本就是其客户。虽未披露财务条款,但报道称将以不到4亿美元股票支付,交易仍需满足成交条件。
DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈
在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。
开源 VibeSDK:把一句话变成线上应用,用它一键搭好自己的 AI平台
Cloudflare VibeSDK 是开源 AI vibe coding 平台,跑在 Cloudflare 开发者生态上,支持自然语言生成全栈 Web 应用,有分阶段代码生成、交互式聊天等功能,适用于多类人群和场景,还对比了同类项目。
首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!
中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。
真情实感体验了阿里「千问APP」后,为什么说它是「中国的ChatGPT」?
近日阿里推出面向全球的千问APP。从产品定位、模型能力、效果来看,它接近ChatGPT,是“中国的ChatGPT”。它打通Qwen模型和应用,界面极简,功能多,体验佳,有望让大家重新认识阿里大模型应用。