生成式AI
一、Claude Code推出Agent视图,一屏并行管理多会话
1. Anthropic为Claude Code推出Agent View研究预览版,提供"指挥中心"界面,一屏管理所有并行会话,无需多开终端窗口;
2. 每个智能体后台持续运行,通过颜色和图标显示状态:动画代表工作中、黄色等待回话、绿色已完成、红色失败;
3. 适合互不依赖的并行任务、长跑等待型任务和临时插队场景,把Claude Code从单线程实习生升级为可管理多任务的小团队负责人。
二、谷歌Gemini Omni曝光,全新原生视频生成模型登场
1. 谷歌I/O大会前夕,全新原生视频模型Gemini Omni意外曝光,支持10秒1280×720视频生成,全模态深度集成至Gemini;
2. Demo展示教授黑板推导数学公式连贯准确,文字一致性突破,跨越视频生成模型长期存在的"鬼画符"瓶颈;
3. 还支持实时编辑能力,可一键去水印、物体替换、风格化输出,光影遮挡自动适配,对标已停服的Sora 2优势明显。
三、OpenAI投40亿成立部署公司,发布Daybreak安全工具
1. OpenAI宣布成立部署公司(OpenAI Deployment Company),初始投资超40亿美元,并收购英国AI咨询公司Tomoro,引入150名前沿部署工程师;
3. 同步推出网络防御AI工具Daybreak,整合最强模型与Codex能力,可自动发现修复漏洞、清理安全待办、加速安全检测验证响应。
四、翁荔创业首秀,Thinking Machines发布实时交互模型
1. Thinking Machines Lab发布首个模型TML-Interaction-Small,276B参数MoE、12B激活参数,把语音助手、视频理解和Agent协作整合至同一框架;
2. 模型把连续音频、视频、文本切成200ms"微回合"流式交错处理,前台模型即时响应,后台模型异步跑长推理和工具调用;
3. 响应延迟比GPT-realtime-2.0快4倍,交互质量领先,仅在智力上不及GPT-2.0 xhigh模式,更大规模版本将于今年晚些时候发布。
五、马斯克诉OpenAI案进入第三周,纳德拉等关键人物作证
1. 庭审进入第三周,纳德拉、苏茨克维、泰勒相继出庭;纳德拉称微软投资OpenAI预期回报超920亿美元,但当时面临归零风险;
2. 苏茨克维承认奥尔特曼存在管理问题,同时指出马斯克早年要求较高控制权并曾想让特斯拉接管OpenAI;泰勒确认OpenAI尚未盈利;
3. 庭审材料披露穆拉蒂曾整理52页备忘录扳倒奥尔特曼,又在78条短信后率先签名支持其回归,董事会一度考虑与Anthropic合并。
前沿科技
六、Frontier-Eng基准发布,测科研Agent真实工程优化能力
1. Einsia AI旗下Navers Lab发布Frontier-Eng Bench,提出"生成式优化"评测范式,让Agent进入提案、运行、反馈、修改的工程闭环;
2. 基准覆盖47个任务、5大工程方向,涵盖GPU内核优化、电池快充、量子线路、机械臂控制等真实科研问题,均来自领域专家一手经验;
3. 结果显示GPT 5.4整体最稳健但远未做穿,Agent改进频率与幅度呈双重幂律衰减,深度比宽度更重要,启发下一代Agent设计方向。
2. 创始人王兴兴现场演示推拉摇杆操控,半开放座舱与机械臂同步控制,造型酷似《阿凡达》AMP扩增机甲;
3. 宇树今年动作频频:G1抗零下47.4度极寒走13万步、春晚集群武术表演、解锁轮足混合形态,配合42.02亿元科创板上市规划。
报告观点
八、Anthropic开发者大会,押注异步编程与多智能体协同
1. Anthropic在"Code w/ Claude"大会推出多项更新:Claude平台增加目标导向、模型造梦、多智能体协同三项能力,Pro/Max/Team速率限制翻倍;
2. Claude Code桌面版上线,配合Routines例程、CI自动修复、代码审查器等工具,把开发模式从同步编程推向异步并行;
3. Shopify全员标配Claude Code,美客多已审查50万PR、翻新9000个应用,目标三季度实现90%自动化编码与全智能体PR循环。
👇加入AGI数据库,AI智能问答