「AI模型性能」共找到 14034 篇相关文章
多模态AI黑马刷榜后再造神器:一个产品搞定图片视频播客生成,自带百种特效,大牛梅涛团队出品
AI大牛梅涛创立的智象未来公司推出vivago2.0(智小象AI),支持图片、视频、播客生成,有上百种特效模板,生图还能自动优化prompt。其依托HiDream - A1,结合HiDream - I1和HiDream - E1能力,团队技术实力强且融资顺利。
图灵奖得主Bengio再创业:启动资金就筹集了3000万美元
图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
Anthropic 官方:Genspark 是如何构建 Agents 的?
Genspark借助Claude打造自适应AI Agents,突破传统搜索工作流限制。其Super Agent以Claude为核心,实现动态协调,变革用户创造和研究方式,带来显著商业影响,揭示AI开发新原则。
超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动
当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。
全网刷屏爆火的Clawdbot到底神在哪?我花了24小时,这是你需要的全部真相。
Clawdbot是爆火的个人桌面AI助理,可在手机远程操控,赋予Claude等模型本地执行权限。它开箱即用,有进阶玩法,但开发有风险、成本高,适合繁琐工作多的人。
1000 行 Java 代码手搓 OpenAI gpt-oss 推理引擎
2025年8月OpenAI发布gpt - oss,作者受相关项目启发,用约1000行Java代码实现gpt - oss推理引擎并发布在亚马逊官方github。文章分享开发体会,介绍模型架构、Java实现、性能优化等内容。
AGI 投资清单:为什么这 30+公司值得关注?|Best Ideas
今年 AI 进入‘业绩兑现期’,市场看重真实效益和收入。文章围绕技术、资本开支和宏观趋势筛选 30+ 公司,覆盖多领域,分析各公司优势与投资价值,为投资者提供参考。
测试时也能RL,英伟达等提出全新范式:TTT-Discover
近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。