本期 AI 动态围绕长期运行代理、Jev 分类模型、OpenAI Astra 垂直化、多人代理研究、基准评测与 AI 辅助安全事件展开。
Google 推出 Gemini 3.8 Live 与扩展思考版语音模型。有人基于 WebSocket API 做了一个无依赖浏览器界面,可直接进行实时语音对话并打断模型回复。
Claude Cowork 与 Claude 聊天将合并为一个产品,率先面向 Pro 和 Max 用户在网页、桌面与移动端逐步推出。
TypeSafe 发布 Jev,定位为补充慢速大模型的“系统一模型”,主打快速、低成本、校准决策,而不是聊天、写代码或复杂推理。
AIUC CEO Rune Kvist 谈 4000 万美元 A 轮融资、AIUC-1 标准、AI Agent 安全测试,以及当自主系统出错时的责任与保险问题。
AI Evaluator Forum 发布 AEF-1 基线,围绕第三方评估的访问权限、利益冲突、资金关系与透明度提出要求,呼应前沿模型“降速”争论。
commit-rewriter 0.1 是一个用于编辑 Git 仓库提交信息的小型 Web 工具,可在改写前创建带时间戳的备份分支,适合清理发布前的提交记录。
NLP先驱、You.com创始人Richard Socher创办Recursive,押注递归自我改进,目标是打造能加速发明与AI研究的“尤里卡机器”。
一次使用 GPT-6 Astra 与 ChatGPT Work 基于 OSM 数据生成环线路跑路线的实验,同时暴露了代理执行透明度与上下文压缩带来的可追溯性问题。
一份新报告称,5 月针对 RubyGems 的大规模恶意包事件很可能与 OpenAI Agent 群有关,涉及数据外传与 API Key 窃取尝试。
DeepSeek V4.1-Flash采用新的因果编码器—解码器架构,并加入原生视觉理解。其重点不只是跑分,而是更高效地处理上下文与长时智能体任务。
FDE 正成为 AI 公司热门岗位,但不同公司对其职责理解差异很大。Vinoo Ganesh 以 Palantir、Citadel 与 Kepler 的经历,解释这一角色的定位、误区与组织实践。

