本期内容


本期六件事,横跨安全威胁、模型竞争、语音交互、工程实践与认知框架。从能自我复制并现场推理攻击策略的 AI 蠕虫,到 LLM 批量生成假安全漏洞报告骗过权威数据库,AI 正在改变的不只是我们怎么工作,还有我们怎么验证信息。与此同时,阿里 Qwen 3.8-Max 正面挑战顶级闭源模型,语音 AI 终于解决了打断与延迟的老问题,而关于 AI 代理与专业知识溢价的讨论,则提供了一个更清醒的认知框架。


本期要点


- 研究者构建的 AI 蠕虫能对每台新目标机器临时生成定制攻击策略,并寄生在已入侵机器上自给自足运行,这是一个新的威胁类别

- 阿里 Qwen 3.8-Max 参数达 2.4 万亿,在部分基准上声称超过 GPT-5.6 和 Claude Fable 5,并将于下周开源权重

- OpenAI GPT Live 移除了独立的转折探测器,让语言模型全程监听音频自主判断换话时机,响应延迟降至 300 毫秒以内

- 真实团队的 AI 代理实践揭示了另一面:代理容易在边界不清时大量空转,token 账单飞涨,需要像管理协作者一样主动管理

- 专家通过 LLM 获得更大放大效应,因为判断 AI 输出是否正确需要真正的深度理解,AI 拉大的是真正的能力差距而非缩小

- LLM 批量生成的假 SQLite 漏洞报告骗过了 NVD 和 CISA 的自动化系统,揭示了一个核心问题:现有接收系统只验证格式,不验证内容


参考资料


AI Agents Enable Adaptive Computer Worms — https://arxiv.org/abs/2606.03811

Qwen3.8-Max arrives with a bold claim — https://venturebeat.com

Continuous voice interaction with GPT Live — https://openai.com/index/continuous-voice-interaction-with-gpt-live/

AI coding agents are blowing through budgets — https://venturebeat.com

LLMs reward expertise — https://seangoedecke.com

SQLite Critical CVEs or LLM Slop? — https://jfrog.com/blog/


---


BearTalk 狗熊有话说播客,始于 2012 年。

订阅地址:https://beartalking.com/page/podcast

Podden och tillhörande omslagsbild på den här sidan tillhör Bear Liu. Innehållet i podden är skapat av Bear Liu och inte av, eller tillsammans med, Poddtoppen.