「AI工作能力」共找到 11397 篇相关文章
AI 画图不是玩具,而是可以变成效率工具 | 豆包 P 图Seedream 4.0 效率场景挖掘
作者测试豆包P图Seedream 4.0,发现它有对指令深度意图理解等能力且中文支持好。还分享用其提升效率的场景,如制作封面图、翻译图片文字等,也给出发掘AI应用场景思路和写画图提示词方法。
OpenAI 设计师:不写代码的设计师,将成为团队瓶颈
OpenAI 的 Ed Bayes 和 Figma AI 设计总监 Gui Seiz 深度对谈,探讨 AI 打通编程与设计工具后设计师工作流程的变化。涉及画布与代码的使用、代码与设计稿同步、实际应用效果、工作方式转变等内容,还给出新手入门建议。
连肝12小时!一轮狂刷1500篇论文,写4.2万行代码,AI科学家卷疯科研圈
Kosmos是一款全程无需人类插手的AI科学家,最长能连续工作12小时,平均一次研究读1500篇论文、写4.2万行分析代码,79%研究结果可被人类复现,已在多领域有7个真发现。
大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%
上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。
非Transformer架构落地之王,带着离线智能和原生记忆能力在上海WAIC浮出水面
在上海WAIC现场,RockAI展台的机器狗和灵巧手在离线状态表现出色,背后是其非Transformer架构的大模型Yan 2.0 Preview,有原生记忆和离线智能能力。该公司成立两年,押注此架构,产品已商业落地,还构想群体智能未来。
爆冷!首届大模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰
谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。
168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案
Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。
亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三大技术准备
亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。
Docker 通过 Cagent 提供 AI 代理确定性测试
AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。
全球首个全链式空间天气AI预报模型“风宇”!国家卫星气象中心牵头,联合南昌大学、华为共同研发
当前太阳活动高发,传统空间天气预报难满足需求。2025年7月26日,国家卫星气象中心牵头联合研发的“风宇”模型发布,它是全球首个全链式空间天气AI预报模型,提升了我国空间天气预报能力。