「多语言推理」共找到 6088 篇相关文章
MIT团队完成AI控制人类行为实验项目
MIT团队的Human Operator项目是实时人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。
一下午一句话 Codex 帮我开发了一个完整的游戏!
作者用 Codex 一下午开发出完整游戏《夜巡录:荒庙篇》。Codex 能力惊人,能自建角色流水线、找素材、拼素材图,还结合多个工具打磨细节。项目已开源,作者考虑将流程封装成 Skill 开源。
24小时、78轮实验、持续迭代,AiScientist自己把最优解一步一步逼出来了
中国人民大学高瓴人工智能学院的AiScientist挑战让AI持续推进研究工程。它采用“thin control over thick state”设计,通过分层编排和File - as - Bus等方式,在多任务上表现出色,为AI科研工程补上关键底座。
刚刚!传英飞凌发布调价函,4月1日起实施
2月5日消息,英飞凌向客户发调价函,4月1日新价生效。此轮半导体涨价潮由AI引领,已波及多领域。英飞凌调价影响下游行业,或加速供应链整合,成本与供应平衡成今年关键课题。
WASI 1.0:WebAssembly可能在2026年悄然普及
WebAssembly在Wasm 3.0和组件模型发布后进展巨大,预计WASI 0.3.0在2026年发布将使其成熟落地,可在多场景替代传统容器,还介绍了其优势、关键特性及标准化情况。
突发!微软刚开源GitHub Copilot Chat,超强AI Agent自动化编程
今天凌晨4点30,微软首席执行官分享VS Code的最新AI开源编辑器GitHub Copilot Chat。其亮点是支持AI Agent自动化编程,能执行多步骤编码任务。还支持人机协作、MCP协议等,在GitHub很受欢迎。
谷歌杀疯!百万token神器免费开源,Claude和Codex都顶不住了?
谷歌开源免费AI编程工具Gemini CLI,权限拉满,有百万token上下文、千次调用额度,打通VS Code与终端。它与OpenAI、Anthropic竞争,功能不止写代码,还支持多通用任务,谷歌这次来真的!
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。
我在OpenAI修中文
OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。
LeCun离职后不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会
离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。