「个人多模型时代」共找到 8799 篇相关文章
微信技术架构部斩获CVPR 2025大赛冠军,攻克AI图文匹配评估难题
微信WXG技术架构部IH-VQA团队在CVPR2025大赛夺冠,首创iMatch图文匹配质量评估方案。文中介绍赛事背景、规则,团队通过双模型驱动等策略获胜,还构建iMatch-Benchmark评估主流T2I模型。
RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈
大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。
用Cursor做UI,最有效的两个方法
作者黄益贺分享用Cursor做UI的两个方法,免费法是用Gemini等生成JSON配置贴到Cursor;付费法是API调用Vercel的v0模型。还提及添加动画提升体验及前端UI开发工具箱。
SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%
大语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。
90后CEO执掌钉钉103天:迎战AI办公,先卸下12年的“历史包袱”
本文聚焦90后CEO陈宇森执掌钉钉103天后的首份答卷,探讨AI办公时代,拥有12年历史的钉钉如何卸下功能叠加包袱,推出千问办公探索企业级Agent的破局路径,融合客户采访与行业分析。
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移到“协作层”,还以Kimi CLI实践及Raft创业为例阐述。
一人公司创业,如何找对方法论、选准装备库?
AI让一人做产品更易,全国一人有限责任公司数量增长,相关服务生态成形。时踪由阿泰独立研发,从个人痛点出发做出产品,其95%云服务选阿里云。阿里云为OPC创业者提供阶段化“装备库”。
对话 Ribbi:所有人都在做创作工具,我们在做一个有品味、会进化的「人」
在AI创作工具扎堆的2026年,多数产品仍聚焦单一环节。Ribbi创始人Robin认为,AI时代内容创作应是接管全链路、懂品味、会进化的“人”。Ribbi以场景化Skill覆盖全流程,解决多痛点,实现自主进化。
LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙
图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地多领域,且承诺开源研究。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。