豆包手机助手推消费者版,Suno与华纳合作发布v6音乐模型
豆包手机助手消费者版上线,支持指纹直唤与跨应用自动办事
字节跳动正式推出豆包手机助手的消费者版本,这次更新重点强化了交互方式、本地记忆、任务执行和隐私安全。最直观的变化是新增“AI键”功能——用户可在锁屏状态下通过指纹验证一键唤醒助手,无需解锁手机。
在能力层面,新版本不再局限于问答,而是能主动跨应用执行任务。比如用户说“把昨天会议里提到的预算表发给张经理”,助手会自动进入邮件或聊天软件查找文件并发送。这种从“被动响应”到“主动办事”的转变,依赖于其增强的记忆系统,可安全检索本地相册、文档、日历等数据,但所有敏感操作均需用户二次确认。
安全方面采用端云协同架构:简单查询在设备端处理,复杂任务才上传加密数据至云端。字节强调,用户数据不会用于模型训练,且可随时清除记忆记录。
Suno v6音乐模型发布,与华纳、BMG共建创作生态
AI音乐公司Suno宣布推出v6版本,并首次公开与华纳音乐集团、BMG等主流唱片公司的合作。v6并非单一模型,而是一套包含旗舰版、探索版和轻量版的模型组合,分别面向专业制作人、独立创作者和移动端用户。
新模型支持文字、音频、图片甚至短视频作为输入。例如上传一段吉他演奏视频,再输入“改成80年代合成器流行风格,加入鼓点和贝斯线”,v6就能生成完整编曲。更关键的是,它允许用自然语言对已有歌曲进行局部修改,比如“把副歌升半音”或“在第二段主歌后插入一段萨克斯独奏”。
Suno称,此次合作不仅提供合法授权的训练数据,还共同设计了版权归属机制:用户生成的内容版权归创作者所有,但若使用厂牌提供的音色或样本库,则需遵守特定授权条款。这被视为AI音乐走向商业化的重要一步。
ElevenLabs Music v2.5上线,主打版权合规与多风格覆盖
几乎同步,ElevenLabs也发布了Music v2.5音频生成模型,并开放移动App和API接口。该版本在R&B、灵魂乐、嘻哈、摇滚及管弦乐等风格上表现突出,尤其擅长处理人声与乐器的融合。
与Suno不同,ElevenLabs特别强调其训练数据全部来自合法授权的音乐库,明确表示“避免陷入版权争议”。目前提供免费版(每日生成时长有限)和专业版(支持高保真输出和商业用途)两种服务。
值得注意的是,Music v2.5在节奏稳定性和动态范围控制上有明显提升。测试显示,生成的歌曲在副歌高潮部分不会出现音量突变或乐器失真,这对实际应用场景至关重要。
宇树人形机器人G1+发布,续航与感知能力升级
宇树科技推出人形机器人G1+,在运动控制、环境感知和交互体验上做了多项改进。最显著的是颈部新增两个自由度(+2DOF),使其能更自然地转头、点头,配合双目视觉系统实现更精准的人脸追踪。
硬件方面,G1+搭载双摄像头、3D激光雷达和腹部广角相机,构建多层级空间感知网络。电机系统经过热管理优化,持续输出能力提升约20%。供电采用快拆式智能电池,支持外接电源,单次续航约2小时,适合展厅导览、科研实验等需要长时间在线的场景。
标准版售价9.5万元,同时推出面向高校和研究机构的G1+ EDU版本,开放底层控制接口,便于开发定制化算法。
智谱完成50亿美元融资,推进GLM递归自改进
大模型公司智谱宣布完成约50亿美元的新一轮融资。这笔资金将主要用于下一代GLM基础模型的研发,核心方向是建立“递归自我改进”体系——即用上一代GLM的能力来构建训练环境、生成高质量数据、评估模型输出,形成闭环迭代。
具体来说,团队正在搭建自动化任务生成平台,让模型在模拟环境中完成复杂推理任务(如代码调试、多步规划),并通过反馈机制筛选有效训练样本。工程层面则聚焦国产芯片适配,包括深度优化算子库和KV Cache存储策略,目标是在同等硬件条件下将推理效率提升3倍以上。
Apple TV或迎秋季更新,Siri成AI核心入口
据多方消息,苹果计划在今年秋季低调发布新一代Apple TV机顶盒。虽然外观变化不大,但内部升级聚焦AI能力:搭载更强芯片以支持Apple Intelligence生态,并深度整合Siri助手。

新版Siri将具备跨应用情境理解能力。例如用户说“把上周看的那部科幻片续集加到我的观看列表”,Siri需结合观看历史、语音上下文和内容库进行推理。此外,Apple TV将进一步强化其作为家庭智能中枢的角色,全面支持Thread和Matter协议,实现对灯光、温控、安防等设备的统一调度。

京东开源可交互视听世界模型EchoWM

在JDD大会上,京东发布了JoyAI-Echo1.5和EchoWM两大模型。前者支持生成10分钟以上的连贯音视频内容,适用于短视频、广告片等场景;后者则是可交互的“视听世界模型”,用户可在生成的虚拟环境中进行多轮探索——比如点击画面中的门,角色会走过去开门,同时环境音效随之变化。

EchoWM已开源,开发者可基于此构建游戏、教育或虚拟导购应用。京东同时展示了JoyAI基础模型矩阵,覆盖文本生成、图像理解、视频合成等多个模块,意图打通从数字内容生成到物理世界交互的链条。

DeepSeek-V4.1-Flash上线千问平台

深度求索(DeepSeek)的V4.1-Flash版本已在千问AI平台开放API调用。该模型采用稀疏MoE架构,激活参数约8B(输入)至16B(输出),支持图文混合理解,适合长文档解析、客服知识库问答等企业级任务。
成本控制是其亮点:KV Cache对HBM显存的需求降至前代的1/4,SSD存储占用减少至1/8,大幅降低部署门槛。目前支持北京、新加坡、美国、德国、日本、香港等多地节点调用,延迟表现稳定。