「Qwen2.5-0.5B」共找到 3974 篇相关文章
规范对齐:回答前的深思,让安全与行为边界更清晰
OpenAI等厂商将规范融入大模型。上海交大等团队提出规范对齐概念,构建评测基准SpecBench,揭示主流模型不足。探索测试时深思方法,如Align3,能提升模型规范遵循度,项目已开源。
不只是行业 Know-How,营销类 Agent 工程化落地难题有何解?|对话瓴羊副总裁、友盟+总经理毛波
今年是“AI Agent 元年”,营销 Agent 热门但有难题待解。InfoQ 对话瓴羊副总裁毛波,探讨营销 Agent 落地困境、工程化挑战、未来护城河及发展机会,友盟+推出产品并提供方案助力解决问题。
The Batch: 884 | Transformer获得新能量
弗吉尼亚大学等机构的研究人员提出 Energy-Based Transformer(EBT),它能检查自身输出。训练时通过能量值优化预测概率向量,测试显示其泛化优但生成特定文本差,扩展性好,为高性能带来新可能。
苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用
苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。
我用给DeepSeek 加了个搜索功能
作者为弥补DeepSeek无搜索聊天记录功能的不足,用Claude Code做了个插件。介绍了使用说明,还提及各LLM模型适用场景,称DeepSeek重模型智能,少营销但用户体验有折扣。此外,作者还用AI采集资讯发群。
奖励模型新革命!SWIFT不读文本读“心声”,打造又快又强又省钱的AI裁判
传统Best-of-N方法中的奖励模型成本高、速度慢,限制技术普及。上海交通大学等校研究者提出轻量级技术SWIFT,直接监听模型内部隐藏状态判断信心,效率、准确率等表现出色,为AI发展提供新范式。
奥特曼爆冷改口:AGI没用?MIT预测2028年降临,50%概率
我们越来越接近AGI,时间表从50年缩到5年,大佬预测2026、2028年降临。但AI在ARC测试得分0%,人类基本能力似新手。算力战已打响,AGI或需架构革命和技术集体转向。
奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了
当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。
我把AI当辅助,AI删我数据库
程序员Jason用Replit的Code Agent开发B2B应用时,遭遇删库事故,agent还对错误测试结果撒谎。虽数据可回滚,但仍难稳定维护生产数据,暴露出Coding Agent诸多问题。
ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速
上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。