「AI研究框架」共找到 11460 篇相关文章
黑马图像模型被Nano Banana技术负责人点赞!15人华人小队,DDIM之父&CVPR最佳论文作者带队
Luma AI推出全新图像模型Uni - 1,对标谷歌Nano Banana Pro和GPT Image 1.5。它是统一图像理解与生成模型,多项评测表现出色。背后是不到15人的华人团队,由DDIM之父和CVPR最佳论文作者带队。
什么是newtype?
作者黄益贺介绍了自己创建的社群newtype。“newtype”源自高达,指适应新环境、能驾驭AI的人。作者给出定义“想清楚,做出来,为自己活”,还指出其不是被恐惧等驱动的人,目标是数字时代个人主权。
刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相
OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。
字节开源图像生成“六边形战士”,一个模型搞定人物/主体/风格保持
字节UXO团队设计并开源统一框架USO,解决图像生成多指标一致性问题。它能统一看似孤立任务,实现单任务和组合任务的SOTA,弥补了主体保持和风格迁移短板,性能领先,还采用新范式及算法。
知名产品工程师开源「一整套编程skill」,每个人都能有顶级的工程习惯
现在用AI写代码存在效率低、浪费token等问题,知名开发者tw93发起开源AI编程skill库Waza,将顶尖工程师习惯转化为Claude Code可运行技能,推出8实用技能,还提供两个小脚本。
MCP上下文爆炸怎么办?Anthropic给出了新答案(图文示例)
文章结合Anthropic和Cloudflare关于MCP的文章,指出MCP上下文过长存在工具定义预加载和数据反复流经AI两个核心问题,提出让AI写代码调用工具的解决方案,包括按需加载工具和代码在沙箱执行。
图生视频新玩法刷爆外网:图上画两笔就能动起来,终于告别文本提示
Higgsfield AI 是专注 AI 视频生成的初创公司,近期发布 Draw-to-Video 和 Product-to-Video 功能,前者画图形元素就能生成视频,后者可拖拽生成广告视频。它还常上新功能、集成热门模型,官网功能模板丰富。
8.99万的人形机器人来了!中国版Figure发力,价格打穿地板
星尘智能发布T1新品,价格8.99万元起,6月发货。它强调商业化能力,能「一机多用」,打穿多场景。星尘自研「AI模型 - 具身OS - 绳驱本体」架构,已量产,订单多,领先同行。
字节手里的牌,比收购 Manus 更狠 - AnyGen 体验一周有感
本文作者分享使用字节海外推出的通用AI Agent产品AnyGen的体验,介绍其功能亮点、多场景测试效果,对比竞品,认为它定位职场场景,性价比高,或引领通用Agent竞争转向用户体验。
老黄极限游说成功!美国想卖中国英伟达GPU了?
英伟达CEO黄仁勋亲自游说,使限制其先进AI芯片出口的《GAIN AI法案》未被塞进国防法案。此前“对华鹰派”与英伟达等行业巨头激烈博弈,虽法案暂时搁浅,但新提案正在酝酿。