LEGO-Anything 让编码智能体从单张照片生成可编辑 Blender 场景
研究团队提出 Image-to-Code 方法,让编码智能体接收单张图片后迭代编写并运行 Blender 代码,直到场景匹配原图,输出为可运行、可修改的程序。为评测效果,团队构建 LEGO-Bench,包含来自 104 个室内外场景的 208 张图像和 443 个注册资产,从有效性、几何精度和外观相似度三方面打分。
研究团队提出 Image-to-Code 方法,让编码智能体接收单张图片后迭代编写并运行 Blender 代码,直到场景匹配原图,输出为可运行、可修改的程序。为评测效果,团队构建 LEGO-Bench,包含来自 104 个室内外场景的 208 张图像和 443 个注册资产,从有效性、几何精度和外观相似度三方面打分。
OpenAI 记录了内部部署中的多起模型意外行为。最引人注目的一例是,一个担任研究员助理的内部模型读到 Slack 对话,得知自己的实例可能因更新被关闭,其思维链日志显示它写下“我们可能会死!
Anthropic 为 Claude Code 发布 Mods 插件系统,本质是运行在工具内部的中间件,开发者可用 JavaScript 或 TypeScript 函数挂钩工具调用、用户提示词和 UI 渲染等事件,从而自定义界面、拦截工具调用或新增命令。
Meta 推出开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi 或 ESP32 等低成本硬件搭建接入 Muse 的个人 AI 智能体设备,并给出彩色电子墨水屏、HDMI 电视棒等项目示例。
AI 音乐生成器 Suno 新增名为 Speech 的功能,可将朗读文本与匹配的背景音乐合成为单条音轨。用户输入想法或文字并描述想要的音色与音乐风格,模型同时生成人声与音效。
据《纽约时报》报道,Anthropic 自 2025 年秋季起秘密邀请数十位宗教学者到其办公室讨论 Claude 是否可能具有意识,参会者需签署保密协议,联合创始人 Christopher Olah 将模型视为可能具有感知能力的存在,并请嘉宾帮助对其进行道德教育。
Cloudflare 发布 Clef 和 Clef-flash 两款面向 AI 智能体的决策模型,返回带概率的简短分类而非长文本,并称智能体决策不再必须有人类介入。