抖音上线声音冒用举报入口,Grok Build新增长期记忆功能
抖音上线“冒用声音”举报入口
抖音最近在用户举报体系中新增了一个专门针对“冒用声音”的入口。这一调整主要是为了应对AI语音合成技术普及后出现的新类型侵权问题——有人用AI模仿他人声音制作内容,但未经本人授权。
过去,这类投诉往往被归入“侵犯肖像权”或“虚假信息”等模糊类别,处理效率不高。现在用户可以直接选择“冒用声音”选项提交证据,平台会结合声纹识别技术进行初步比对,并启动核验流程。如果确认存在未经授权的AI合成行为,相关内容会被下架,严重者账号可能受限。
值得注意的是,抖音并未公开具体使用哪种声纹算法,但内部文档显示其已接入自研的音频特征提取模型,能识别出常见语音克隆工具(如ElevenLabs、MockingBird)生成的痕迹。这一机制标志着平台治理从传统的图文版权保护,延伸到了声音这一生物特征维度。
不过,目前该功能仅对实名认证用户开放,且要求被冒用者本人发起投诉。这意味着公众人物或普通用户若发现他人声音被滥用,仍需通过法律途径主张权利,平台暂不支持第三方代为举报。
Grok Build 推出长期记忆功能
xAI团队为其开发者工具Grok Build上线了“长期记忆”功能。简单来说,AI现在能记住你之前对话中提到的关键信息,比如项目名称、技术栈选择、接口规范等,并在后续交互中自动调用,无需每次重复说明。
用户可通过 /memory 命令查看当前记忆内容,也能手动编辑或删除条目。更实用的是 /dream 指令——它能把零散的聊天记录整理成结构化文档,比如API设计草案或部署清单。这对需要持续迭代的开发项目尤其有用,避免了反复翻查历史消息的麻烦。
这项功能依赖于向量数据库存储用户上下文,但xAI强调所有数据默认加密且仅限当前用户访问。不过目前记忆容量有限,超过一定条数后系统会自动清理旧条目,建议关键信息仍需手动归档。
有开发者测试发现,在连续三天的前后端联调中,Grok Build成功维持了对数据库字段命名规则、认证方式等细节的一致理解,减少了沟通成本。但若切换到全新项目,最好先执行 /memory clear 避免混淆。
豆包座舱助手年内上车
字节跳动旗下的豆包大模型与火山引擎联合发布了“豆包座舱助手”,这是一款专为智能汽车设计的AI原生交互系统。与传统车载语音助手不同,它不仅能听懂指令,还能主动调用车辆底层信号,执行复杂任务。
例如,用户说“我有点累,找个安全的地方停一下”,助手会综合判断当前车速、导航路线、周边停车场信息,甚至结合驾驶员心率(若车辆配备监测设备)来推荐休息点,并自动开启座椅按摩、调节空调温度。这种能力源于其对车辆“原子能力”的深度整合——包括门窗控制、动力系统状态、传感器数据等。
目前该助手已与上汽集团达成合作,预计今年第四季度起在飞凡、智己等品牌的新车型中陆续搭载。此外,手车互联功能也同步上线:手机上的导航、音乐播放列表可无缝流转到车机,下车后未完成的操作还能在手机端继续。
不过,由于涉及车辆控制权限,豆包助手在量产前需通过严格的车规级安全认证。火山引擎表示,所有AI决策都会经过本地边缘计算节点二次校验,确保不会因网络延迟或模型误判导致危险操作。
阿里云Wan3.0支持30秒长视频生成
阿里云在近期技术发布会上展示了升级版视频大模型Wan3.0。最大突破是单次推理可生成30秒的连贯高清视频,而此前主流模型通常只能输出4-8秒片段。更关键的是,它支持同时参考最多五条已有视频作为风格或动作模板。
举个例子,广告公司可以上传品牌过往的三条TVC和两条竞品视频,Wan3.0能融合这些素材的运镜节奏、色彩基调和角色动作,生成符合品牌调性的新脚本。生成过程中,画面稳定性明显优于早期版本,很少出现肢体扭曲或背景闪烁的问题。
阿里云还开放了API接口,允许影视工作室将Wan3.0嵌入现有制作流程。测试数据显示,在短视频预告片制作场景中,人工剪辑时间平均缩短了60%。不过,目前生成内容仍需人工审核,尤其涉及人脸或商标的部分,模型尚未完全解决版权合规问题。
百度提出“产业智能体操作系统”
在2026智能经济论坛上,百度CTO沈抖提出了“产业智能体操作系统”的概念。他认为,大模型要真正产生经济价值,不能只停留在问答或内容生成层面,而应成为企业运营的“数字员工”。
他将产业智能体分为三类:通用智能体负责基础任务,如会议纪要整理、数据报表生成;专业智能体深耕垂直领域,比如医疗问诊或金融风控,内置行业知识库和合规规则;定制智能体则完全适配特定企业的业务流程,例如对接某制造厂的ERP系统,自动调度生产排期。
沈抖强调,这三类智能体需协同工作。例如,一家零售企业的新品上市流程中,通用智能体起草营销方案,专业智能体分析市场数据并预测销量,定制智能体则根据库存和供应链状态调整铺货计划。百度正在与多家企业试点该架构,目标是让AI从“辅助工具”变为“经营主体”。
不过,他也承认挑战不小:如何保证智能体决策的可解释性?怎样防止多智能体协作时出现逻辑冲突?这些问题尚无标准解法。
MiniMax产品进入新加坡官方培训计划
新加坡技能与劳动力发展局(SSG)近期推出了面向全民的AI技能培训课程,中国公司MiniMax的三款核心产品——包括其文本生成模型、语音合成引擎和代码辅助工具——被纳入官方推荐工具集。

参与课程的学员可免费获得6个月的高级订阅权限,用于实践项目。课程内容涵盖提示词工程、AI内容审核、自动化脚本编写等实用技能,目标是提升劳动者在AI时代的就业竞争力。

这是中国AI企业首次进入新加坡国家级培训体系。MiniMax方面表示,其产品因支持中英双语及东南亚本地语言(如马来语、泰米尔语),且API响应延迟较低,获得了新加坡政府的技术认可。不过,所有训练数据均存储在新加坡本地服务器,符合该国数据主权要求。

Anthropic统一Claude工作空间

Anthropic将此前独立的Claude Cowork(面向复杂任务)与标准版Claude Chat合并为单一界面。现在用户无需手动切换模式,AI会根据输入内容自动判断是否需要调用高级工具链。
例如,当用户要求“分析这份财报并做PPT”,Claude会自动启用云端计算资源处理Excel文件,并在聊天窗口内直接生成幻灯片草稿。用户可实时编辑文字、调整图表,所有操作都在同一页面完成,避免了在多个应用间跳转。
新版本还支持多任务并行。你可以一边让AI写代码,一边让它整理会议记录,进度条会分别显示。不过,免费用户每月有任务并发数限制,企业版则无此约束。
腾讯内测ChatterFly语音工具
腾讯正在小范围测试一款名为ChatterFly的桌面端AI语音工具。它不只是把你说的话转成文字,而是直接理解意图并生成结构化内容。比如对着麦克风说“给张经理发邮件,说明周报延迟是因为接口调试”,几秒后就能得到一封格式完整的邮件草稿。
该工具特别优化了弱网和嘈杂环境下的识别准确率,即使在地铁上轻声说话,也能正确捕捉关键词。背后是腾讯混元大模型的语音理解模块,结合了上下文语义分析,而非单纯依赖声学模型。
此外,ChatterFly会学习用户的表达习惯。如果你经常用“搞定了”代替“已完成”,它会在生成内容时保留这种风格。个人词库和语音历史数据都加密存储在本地,除非用户主动同步,否则不会上传云端。
目前内测仅限腾讯内部员工和部分合作伙伴,macOS和Windows版本已可用,移动端预计年底前上线。