[AI每日快讯·20241125]步步紧逼谷歌!OpenAI正在研发与ChatGPT集成的AI浏览器

发布时间:2024-11-25 09:00:35 · 责任编辑:字母汇 · 浏览量:59 次

一、  抱紧AWS大腿!Anthropic获40亿美金投资,计划合作AI芯片

1.  AWS向Anthropic追加40亿美元投资,合作开发Trainium AI芯片,通过软硬件深度整合,提升模型训练性能和性价比;

2.  Claude模型成为Amazon Bedrock服务核心,支持企业构建可扩展AI解决方案,覆盖药物研发、税务处理和文档分析等领域;

3.  Claude模型在AWS上提供可定制AI解决方案,确保数据安全,并满足企业和政府的严格监管需求。

https://mp.weixin.qq.com/s/aGUnt_TtGXDz_TD6slcxmw

二、  步步紧逼谷歌!OpenAI正在研发与ChatGPT集成的AI浏览器

1.  OpenAI计划开发与ChatGPT集成的AI浏览器,并推出“自然语言网络”(NLWeb)技术以优化行业搜索和交互体验;

2.  OpenAI招聘前Google Chrome核心开发者并与三星合作,意图通过AI服务挑战Google在市场中的主导地位;

3.  浏览器项目目标是实现对话式网站互动,但因技术挑战和安全问题,短期内或难以与现有成熟浏览器竞争。

https://mp.weixin.qq.com/s/x2xtQ8qSbrhXhXRT7JONpw

三、  FLUX“官方版ControlNet”景深轮廓更精准控制,四款官方工具

1.  FLUX推出四款新工具,包括Fill、Canny、Depth和Redux,提升AI绘图的可操控性和精确性;

2.  工具支持图像扩展、轮廓和景深控制,以及角色动作和画面风格变换,全面优化生成效果;

3.  提供开发版代码和模型权重,Pro版通过API使用,整合到常用绘画工作流中,显著领先第三方插件和其他模型。

https://mp.weixin.qq.com/s/FwlMZ3J85Ya-AQbLeAqc4Q

四、  AI编程爆火新品Windsurf,首创copilots和agents结合新范式

1.  Windsurf结合Copilots协作能力和Agents独立能力,支持实时感知开发者操作,实现多文件编辑与迭代推理;

2.  Cascade功能增强代码理解与工具集访问能力,支持深度集成现有代码库,优化开发效率;

3.  Codeium估值12.5亿美元,定位AI编程市场,通过Windsurf挑战Cursor等竞争对手,吸引广泛用户和企业客户。

https://mp.weixin.qq.com/s/8VYkAxA73JcRaUZ7MoNKcA

五、  真开源模型!公开「后训练」,Tülu 3或超越Llama 3.1 Instruct

1.  艾伦人工智能研究所发布Tülu 3开源模型,性能超越Llama 3.1 Instruct,并公开后训练方法、数据集和基础设施;

2.  后训练方案采用监督微调、偏好优化和强化学习,创新可验证奖励强化学习(RLVR),显著提升核心技能表现;

3.  Tülu 3在多个基准上表现优异,尤其是70B版本接近Claude 3.5,推动开源模型性能与封闭模型的竞争。

https://mp.weixin.qq.com/s/sTtBkVkqy0CQtpzcR6SN-A

六、  DeepSeek等新作JanusFlow: 1.3B大模型统一视觉理解和生成

1.  JanusFlow结合视觉理解和生成框架,采用解耦编码器设计,通过SigLIP与SDXL-VAE实现高效训练和任务性能统一;

2.  引入表征对齐(REPA)策略,加速生成任务收敛速度,同时在视觉理解与生成任务上达到相当于专用模型的性能;

3.  JanusFlow在多模态基准测试中表现优异,统一了LLM和Rectified Flow,展示出强大的视觉任务竞争力。

https://mp.weixin.qq.com/s/NLk9JUJskvCIy7IiMCQAUw

七、  陶哲轩宣布“等式理论计划”成功,57天2200万+数学关系证明

1.  陶哲轩发起的“等式理论计划”利用数学家、AI工具和Lean证明语言,57天完成2200万+magma等式蕴含关系的证明和反驳;

2.  项目快速进展得益于AI工具如GitHub Copilot和Vampire的辅助,但AI表现低于预期,主要用于代码加速和可视化工具开发;

3.  计划成果为AI数学工具提供基准测试,促进大规模人机协作在数学研究中的应用,部分衍生项目仍在进行。

https://mp.weixin.qq.com/s/UAaW6YYANyHIYQd18DsJhA

八、  Meta重磅开源7B-Spirit LM,一个可以保留情感的音频大模型

1.  Meta开源7B参数的Spirit LM,整合语音与文本模态,支持自由转换并保留情感和风格表达,覆盖ASR、TTS等多模态任务;

2.  模型采用交错训练策略和多元化标记,表达版额外加入音高与风格Token,显著增强语音生成的情感和自然表现力;

3.  实验显示Spirit LM在语音到文本、文本到语音任务中表现优异,尤其在情感表达建模和跨模态对齐能力上潜力巨大。

https://mp.weixin.qq.com/s/EdhQ8S0ik5a6-EGJtTV1tw