「高强度工作」共找到 2774 篇相关文章
1.5B推理模型新SOTA,RL训练新解法打破「简单题过拟合、难题学不动」的魔咒
QuestA通过在训练中注入解题提示,实现两项成果:在1.5B模型上实现Pass@1的SOTA性能,还提升了Pass@k性能。它解决了RL训练中简单与困难任务的权衡问题,为开发强推理模型打开大门。
Sora 2刷屏全网:拍《瑞克和莫蒂》、过物理测试,太棒了
OpenAI推出的Sora 2刷屏海外,能完成以往视频生成模型极难实现的任务,在物理准确性、逼真度和可控性上有重大提升。它还能进行二创、模拟电脑操作等。OpenAI发布由Sora 2驱动的社交APP,强调促进创作,保障安全。
我觉得“Agent”这个词,现在终于有了一个大家都认可的定义了
作者Simon Willison认为现在‘Agent’有了大家认可的定义,即一个AI Agent是为实现目标循环调用工具的大语言模型。还分析了此前难统一定义的情况、‘工具循环实现目标’含义,指出不同人群对‘Agent’理解有偏差。
阿里王牌Agent横扫SOTA,全栈开源力压OpenAI!博士级难题一键搞定
阿里昨晚开源通义DeepResearch,在多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案全开源,开发者可在相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。
提速30倍,Meta重新定义了新一代RAG!
LLM时代,RAG成知识密集型任务标准范式,但处理长上下文时面临延迟高、内存贵问题。Meta超级智能Lab针对RAG特殊结构优化,提出REFRAG框架,有独特训练策略,实验效果显著。
一致性对标Nano Banana,国产Vidu Q1同时支持7张参考 | 实测
AI生图赛道竞争激烈,专注视频大模型的Vidu推出Q1参考生图模型,能同时支持7张参考图,主体一致性对标谷歌Nano Banana。实测玩法多样,有高可操作性,现已全球同步上线。
16岁创业,22岁做成百亿独角兽!3位高中同学帮大厂训AI年入1亿美金
Meta豪掷143亿收购Scale AI,其CEO加盟Meta。这一并购让Mercor创始人Brendan Foody看到机会,认为Scale AI失去中立性,大厂或不再合作。Mercor为AI实验室提供训练人员,年入1亿美金,估值达百亿。
Claude Code 开发者谈如何用 Claude Code 开发 Claude Code
Anthropic的Claude Code创建者Boris Cherny在访谈分享智能体编程未来看法,介绍用Claude Code开发它自身的方法,还谈及Claude Code发展、使用技巧及对编程工作未来变化的预测。
谷歌Nano Banana全网刷屏,起底背后团队
谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。
谷歌2.5 Image:『你是我的神』,准备丢掉PS了
谷歌新出的大模型Gemini 2.5 Flash Image实现AI图像创作一致性、真实性新高度。它能理解手绘图表、解答问题及完成复杂编辑指令,可在Gemini和Google AI Studio免费使用,表现出色,有望取代很多PS任务。