News — aggregated AI coverage from 30+ publications

  1. 5461. CO₂ Emissions and Models Performance: Insights from the Open LLM Leaderboard (huggingface.co) huggingface.co · 1 year ago | discuss
  2. 5462. Controlling Language Model Generation with NVIDIA's LogitsProcessorZoo (huggingface.co) huggingface.co · 1 year ago | discuss
  3. 5463. FACTS Grounding: A new benchmark for evaluating the factuality of large language models (deepmind.google) deepmind.google · 1 year ago | discuss
  4. 5464. OpenAI o1 and new tools for developers (openai.com) openai.com · 1 year ago | discuss
  5. 5465. Court case: Musk v. OpenAI regarding for-profit structure (openai.com) openai.com · 1 year ago | discuss
  6. 5466. Sora: Video generation model now available (openai.com) openai.com · 1 year ago | discuss
  7. 5467. Sora System Card (openai.com) openai.com · 1 year ago | discuss
  8. 5468. [OpenAI] o1 System Card: Safety evaluation and red teaming report (openai.com) openai.com · 1 year ago | discuss
  9. 5469. How good are LLMs at fixing their mistakes? A chatbot arena experiment with Keras and TPUs (huggingface.co) huggingface.co · 1 year ago | discuss
  10. 5470. Morgan Stanley's use of AI in financial services evaluation (openai.com) openai.com · 1 year ago | discuss
  11. 5471. Rethinking LLM Evaluation with 3C3H: AraGen Benchmark and Leaderboard (huggingface.co) huggingface.co · 1 year ago | discuss
  12. 5472. Investing in Performance: Fine-tune small models with LLM insights - a CFM case study (huggingface.co) huggingface.co · 1 year ago | discuss
  13. 5473. Open Source Developers Guide to the EU AI Act (huggingface.co) huggingface.co · 1 year ago | discuss
  14. 5474. Advancing red teaming with people and AI (openai.com) openai.com · 1 year ago | discuss
  15. 5475. Letting Large Models Debate: The First Multilingual LLM Debate Competition (huggingface.co) huggingface.co · 1 year ago | discuss
  16. 5476. Introducing the Open Leaderboard for Japanese LLMs! (huggingface.co) huggingface.co · 1 year ago | discuss
  17. 5477. Judge Arena: Benchmarking LLMs as Evaluators (huggingface.co) huggingface.co · 1 year ago | discuss
  18. 5478. Share your open ML datasets on Hugging Face Hub! (huggingface.co) huggingface.co · 1 year ago | discuss
  19. 5479. [NTIA] OpenAI comments on data center growth, resilience, and security (openai.com) openai.com · 1 year ago | discuss
  20. 5480. Expert Support case study: Bolstering a RAG app with LLM-as-a-Judge (huggingface.co) huggingface.co · 1 year ago | discuss
  21. 5481. Introducing HUGS - Scale your AI with Open Models (huggingface.co) huggingface.co · 1 year ago | discuss
  22. 5482. Hugging Face Teams Up with Protect AI: Enhancing Model Security for the ML Community (huggingface.co) huggingface.co · 1 year ago | discuss
  23. 5483. Scaling AI-based Data Processing with Hugging Face + Dask (huggingface.co) huggingface.co · 1 year ago | discuss
  24. 5484. OpenAI and Hearst Content Partnership (openai.com) openai.com · 1 year ago | discuss
  25. 5485. Introducing the Open FinLLM Leaderboard (huggingface.co) huggingface.co · 1 year ago | discuss
  26. 5486. A Short Summary of Chinese AI Global Expansion (huggingface.co) huggingface.co · 1 year ago | discuss
  27. 5487. New funding to scale the benefits of AI (openai.com) openai.com · 1 year ago | discuss
  28. 5488. 🇨🇿 BenCzechMark - Can your LLM Understand Czech? (huggingface.co) huggingface.co · 1 year ago | discuss
  29. 5489. Exploring the Daily Papers Page on Hugging Face (huggingface.co) huggingface.co · 1 year ago | discuss
  30. 5490. Optimize and deploy with Optimum-Intel and OpenVINO GenAI (huggingface.co) huggingface.co · 1 year ago | discuss