「文本驱动动作生成」共找到 1298 篇相关文章
刚刚开源就爆火,轻量快速,GB 大文件都秒开!
文章介绍刚开源就爆火的文本编辑器Fresh,它基于Rust语言,目标轻量、快速、功能强大,支持多平台。有上手0门槛、轻量快速等特性,还给出多平台安装方式和基本使用方法,值得开发者尝试。
开发者把掌舵人骂到关回复!Windows 要变成“Agent OS”?这位印度裔高管遭遇大型翻车现场
微软高管 Pavan Davuluri 宣传 Windows 将演变为 Agentic OS,推文评论区却被批评淹没,他无奈关评论。微软正推动 Windows 向 AI 驱动转型,可开发者和用户更想要稳定系统,对 AI 改造不满。
Meta开始用KPI考核,强迫所有员工尽可能多使用AI
Meta从面试到绩效评估全方位推动员工使用AI。招聘允许用AI助手,2026年绩效评估将纳入“AI驱动的影响”,还推游戏和绩效助手鼓励员工用AI,这也是硅谷科技巨头的大势所趋。
从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019
雷峰网邀请三位嘉宾解码IROS 2025背后具身智能前沿趋势。探讨了IROS现场变化、具身智能认知升级、Sim2Real实用边界、商业落地路径等,还预测具身智能“GPT时刻”或由“World Model+VLA”组合推动。
评估工程正成为下一轮 Agent 演进的重点
文章指出传统软件工程测试方法难用于 AI 系统,促使评估工程成 Agent 演进重点。它贯穿 AI 生命周期,正走向体系化。介绍评估工程发展阶段,还提及阿里云 RM - Gallery 和云监控 2.0 实践。
字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名
现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害性。
让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品
斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。
Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”
来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。
DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式
DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。
MIT成果登Nature正刊:90天,「AI科学家」完成3500次电化学测试
美国麻省理工学院李巨团队在Nature发表论文,展示多模态机器人平台CRESt。它结合多模态模型驱动的材料设计与高通量自动化实验,大幅提升催化剂研发速度和质量,还解决了实验结果可重复性不足问题。